Skip to main content

Cuerpo de la solicitud

Tiempo de espera de solicitudes síncronas: este endpoint no-chat espera a que el modelo enrutado termine. Entradas grandes, audio largo o lotes grandes pueden superar los valores predeterminados habituales de 30s del cliente, así que configura el timeout de tu cliente HTTP en al menos 120s. Los campos opcionales admitidos varían según la familia de modelo. TokenLab valida esta matriz antes de enrutar: OpenAI TTS acepta voice, instructions, response_format, stream_format y speed; MiniMax speech acepta voice, voice_id, response_format, stream_format y speed; Gemini TTS acepta prompt, language_code, voice, response_format, stream_format, speed y temperature; las rutas TTS más estrechas de tipo Vidu/Kling pueden aceptar solo input y stream_format. Los campos de nivel superior desconocidos, incluido user, devuelven 400 unsupported_parameter en lugar de ignorarse.
string
predeterminado:"tts-1"
Modelo TTS. Algunos ejemplos son tts-1, gpt-4o-mini-tts, speech-02-hd y gemini-2.5-flash-tts. Consulta GET /v1/models?recommended_for=tts para la lista actual.
string
requerido
El texto para el que se generará audio. Máximo 4096 caracteres.
string | object
Selector de voz. Pasa un nombre integrado como nova, una voz de Gemini como Kore o un objeto como { "id": "voice-id" } para voces personalizadas compatibles.
string
Selector de voz nativo del proveedor para modelos speech compatibles con MiniMax.
string
Instrucciones opcionales de estilo o entrega para modelos TTS compatibles con OpenAI que las admitan.
string
Prompt opcional de estilo de habla para modelos Gemini TTS.
string
Código de idioma opcional, por ejemplo en-US, para rutas Gemini, xAI y TTS compatibles.
string
Formato de audio. Valores comunes: mp3, opus, aac, flac, wav y pcm; los valores admitidos varían según la familia de modelo.
string
predeterminado:"audio"
Formato de entrega de TokenLab: audio o sse. stream_format=sse no está admitido para tts-1 ni tts-1-hd.
number
Velocidad del habla para familias de modelos que la admitan (0.25 a 4.0).
number
Temperatura de muestreo para rutas TTS compatibles con Gemini (0 a 2).

Respuesta

Devuelve el archivo de audio en el formato solicitado.

Muestras de voz

Ejemplo de respuesta

Campos importantes

string
Tipo de evento o mensaje devuelto por la API.
binary
Cuerpo bruto de la respuesta. Guárdalo directamente sin parsearlo como JSON.