Resumen
Traduce audio en cualquier idioma compatible a texto en inglés. A diferencia de la transcripción, este endpoint siempre devuelve texto en inglés independientemente del idioma de entrada.Cuerpo de la solicitud
Tiempo de espera de solicitudes síncronas: este endpoint no-chat espera a que el modelo enrutado termine. Entradas grandes, audio largo o lotes grandes pueden superar los valores predeterminados habituales de 30s del cliente, así que configura el timeout de tu cliente HTTP en al menos120s.
file
requerido
El archivo de audio a traducir. Formatos compatibles:
flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm. El tamaño máximo del archivo es de 25 MB.string
predeterminado:"whisper-1"
El modelo que se utilizará. Actualmente, solo se admite
whisper-1.string
Un texto opcional para guiar el estilo del modelo o continuar un segmento anterior. Debe estar en inglés.
string
predeterminado:"json"
El formato de la salida. Opciones:
json, text, srt, verbose_json, vtt.number
La temperatura de muestreo, entre 0 y 1. Los valores más altos, como 0.8, producen una salida más aleatoria, mientras que los valores más bajos, como 0.2, hacen que la salida sea más enfocada y determinista.
Respuesta
string
El texto traducido en inglés.
verbose_json, la respuesta también incluye:
string
El idioma detectado del audio de entrada.
number
La duración del audio de entrada en segundos.
array
Segmentos del texto traducido con marcas de tiempo.
Traducción vs Transcripción
El endpoint de traducción detecta automáticamente el idioma de origen y traduce al inglés. El parámetro
language de la transcripción se ignora.