Ringkasan
Menerjemahkan audio dalam bahasa apa pun yang didukung ke dalam teks bahasa Inggris. Tidak seperti transcription, endpoint ini selalu menghasilkan teks bahasa Inggris terlepas dari bahasa input.Isi Permintaan
Timeout permintaan sinkron: endpoint non-chat ini menunggu model yang dirutekan selesai. Input besar, audio panjang, atau batch besar dapat melebihi default client umum 30s, jadi atur timeout HTTP client Anda minimal120s.
file
wajib
File audio yang akan diterjemahkan. Format yang didukung:
flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm. Ukuran file maksimum adalah 25 MB.string
default:"whisper-1"
Model yang akan digunakan. Saat ini hanya
whisper-1 yang didukung.string
Teks opsional untuk memandu gaya model atau melanjutkan segmen sebelumnya. Harus dalam bahasa Inggris.
string
default:"json"
Format output. Opsi:
json, text, srt, verbose_json, vtt.number
Temperature sampling, antara 0 dan 1. Nilai yang lebih tinggi seperti 0.8 menghasilkan output yang lebih acak, sedangkan nilai yang lebih rendah seperti 0.2 membuat output lebih terfokus dan deterministik.
Respons
string
Teks terjemahan dalam bahasa Inggris.
verbose_json, response juga mencakup:
string
Bahasa yang terdeteksi dari audio input.
number
Durasi audio input dalam detik.
array
Segmen dari teks terjemahan beserta timestamp.
Terjemahan vs Transcription
Endpoint translation secara otomatis mendeteksi bahasa sumber dan menerjemahkannya ke bahasa Inggris. Parameter
language dari transcription diabaikan.