Skip to main content

Visão geral

Traduz áudio em qualquer idioma suportado para texto em inglês. Diferentemente da transcrição, este endpoint sempre retorna texto em inglês, independentemente do idioma de entrada.

Corpo da requisição

Timeout de solicitações síncronas: este endpoint não-chat aguarda o modelo roteado terminar. Entradas grandes, áudios longos ou lotes grandes podem exceder os padrões comuns de 30s dos clientes, então configure o timeout do seu cliente HTTP para pelo menos 120s.
file
obrigatório
O arquivo de áudio a ser traduzido. Formatos suportados: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm. O tamanho máximo do arquivo é 25 MB.
string
padrão:"whisper-1"
O model a ser usado. Atualmente, apenas whisper-1 é suportado.
string
Um texto opcional para orientar o estilo do model ou continuar um segmento anterior. Deve estar em inglês.
string
padrão:"json"
O formato da saída. Opções: json, text, srt, verbose_json, vtt.
number
A temperatura de sampling, entre 0 e 1. Valores mais altos, como 0.8, produzem uma saída mais aleatória, enquanto valores mais baixos, como 0.2, tornam a saída mais focada e determinística.

Resposta

string
O texto traduzido em inglês.
Para o formato verbose_json, a resposta também inclui:
string
O idioma detectado do áudio de entrada.
number
A duração do áudio de entrada em segundos.
array
Segmentos do texto traduzido com timestamps.

Tradução vs Transcrição

O endpoint de tradução detecta automaticamente o idioma de origem e traduz para inglês. O parâmetro language da transcrição é ignorado.