Visão geral
Traduz áudio em qualquer idioma suportado para texto em inglês. Diferentemente da transcrição, este endpoint sempre retorna texto em inglês, independentemente do idioma de entrada.Corpo da requisição
Timeout de solicitações síncronas: este endpoint não-chat aguarda o modelo roteado terminar. Entradas grandes, áudios longos ou lotes grandes podem exceder os padrões comuns de 30s dos clientes, então configure o timeout do seu cliente HTTP para pelo menos120s.
file
obrigatório
O arquivo de áudio a ser traduzido. Formatos suportados:
flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm. O tamanho máximo do arquivo é 25 MB.string
padrão:"whisper-1"
O model a ser usado. Atualmente, apenas
whisper-1 é suportado.string
Um texto opcional para orientar o estilo do model ou continuar um segmento anterior. Deve estar em inglês.
string
padrão:"json"
O formato da saída. Opções:
json, text, srt, verbose_json, vtt.number
A temperatura de sampling, entre 0 e 1. Valores mais altos, como 0.8, produzem uma saída mais aleatória, enquanto valores mais baixos, como 0.2, tornam a saída mais focada e determinística.
Resposta
string
O texto traduzido em inglês.
verbose_json, a resposta também inclui:
string
O idioma detectado do áudio de entrada.
number
A duração do áudio de entrada em segundos.
array
Segmentos do texto traduzido com timestamps.
Tradução vs Transcrição
O endpoint de tradução detecta automaticamente o idioma de origem e traduz para inglês. O parâmetro
language da transcrição é ignorado.