Skip to main content

Ringkasan

Menerjemahkan audio dalam bahasa apa pun yang didukung ke dalam teks bahasa Inggris. Tidak seperti transcription, endpoint ini selalu menghasilkan teks bahasa Inggris terlepas dari bahasa input.

Isi Permintaan

Timeout permintaan sinkron: endpoint non-chat ini menunggu model yang dirutekan selesai. Input besar, audio panjang, atau batch besar dapat melebihi default client umum 30s, jadi atur timeout HTTP client Anda minimal 120s.
file
wajib
File audio yang akan diterjemahkan. Format yang didukung: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm. Ukuran file maksimum adalah 25 MB.
string
default:"whisper-1"
Model yang akan digunakan. Saat ini hanya whisper-1 yang didukung.
string
Teks opsional untuk memandu gaya model atau melanjutkan segmen sebelumnya. Harus dalam bahasa Inggris.
string
default:"json"
Format output. Opsi: json, text, srt, verbose_json, vtt.
number
Temperature sampling, antara 0 dan 1. Nilai yang lebih tinggi seperti 0.8 menghasilkan output yang lebih acak, sedangkan nilai yang lebih rendah seperti 0.2 membuat output lebih terfokus dan deterministik.

Respons

string
Teks terjemahan dalam bahasa Inggris.
Untuk format verbose_json, response juga mencakup:
string
Bahasa yang terdeteksi dari audio input.
number
Durasi audio input dalam detik.
array
Segmen dari teks terjemahan beserta timestamp.

Terjemahan vs Transcription

Endpoint translation secara otomatis mendeteksi bahasa sumber dan menerjemahkannya ke bahasa Inggris. Parameter language dari transcription diabaikan.