Skip to main content

Corpo da Requisição

Timeout de solicitações síncronas: este endpoint não-chat aguarda o modelo roteado terminar. Entradas grandes, áudios longos ou lotes grandes podem exceder os padrões comuns de 30s dos clientes, então configure o timeout do seu cliente HTTP para pelo menos 120s. Os campos opcionais compatíveis variam por família de modelo. O TokenLab valida esta matriz antes do roteamento: OpenAI TTS aceita voice, instructions, response_format, stream_format e speed; MiniMax speech aceita voice, voice_id, response_format, stream_format e speed; Gemini TTS aceita prompt, language_code, voice, response_format, stream_format, speed e temperature; rotas TTS mais restritas do tipo Vidu/Kling podem aceitar apenas input e stream_format. Campos de nível superior desconhecidos, incluindo user, retornam 400 unsupported_parameter em vez de serem ignorados.
string
padrão:"tts-1"
Modelo TTS. Exemplos incluem tts-1, gpt-4o-mini-tts, speech-02-hd e gemini-2.5-flash-tts. Consulte GET /v1/models?recommended_for=tts para a lista atual.
string
obrigatório
O texto para o qual o áudio será gerado. Máximo de 4096 caracteres.
string | object
Seletor de voz. Envie um nome integrado como nova, uma voz Gemini como Kore ou um objeto como { "id": "voice-id" } para vozes personalizadas compatíveis.
string
Seletor de voz nativo do provedor para modelos speech compatíveis com MiniMax.
string
Instruções opcionais de estilo ou entrega para modelos TTS compatíveis com OpenAI que oferecem suporte.
string
Prompt opcional de estilo de fala para modelos Gemini TTS.
string
Código de idioma opcional, por exemplo en-US, para rotas Gemini, xAI e TTS compatíveis.
string
Formato de áudio. Valores comuns incluem mp3, opus, aac, flac, wav e pcm; os valores compatíveis variam por família de modelo.
string
padrão:"audio"
Formato de entrega do TokenLab: audio ou sse. stream_format=sse não é compatível com tts-1 nem tts-1-hd.
number
Velocidade de fala para famílias de modelos que oferecem suporte (0.25 a 4.0).
number
Temperatura de amostragem para rotas TTS compatíveis com Gemini (0 a 2).

Resposta

Retorna o arquivo de áudio no formato solicitado.

Amostras de Voz

Exemplo de resposta

Campos importantes

string
Tipo de evento ou mensagem retornado pela API.
binary
Corpo bruto da resposta. Salve diretamente sem interpretar como JSON.