Skip to main content

Body Permintaan

Timeout permintaan sinkron: endpoint non-chat ini menunggu model yang dirutekan selesai. Input besar, audio panjang, atau batch besar dapat melebihi default client umum 30s, jadi atur timeout HTTP client Anda minimal 120s.
file
wajib
File audio untuk ditranskripsikan. Format yang didukung: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm.
string
default:"whisper-1"
Model yang digunakan. Saat ini hanya whisper-1 yang didukung.
string
Bahasa audio dalam format ISO-639-1 (misalnya, en, zh, ja).
string
Teks opsional untuk memandu gaya model atau melanjutkan segmen sebelumnya.
string
default:"json"
Format output: json, text, srt, verbose_json, vtt.
number
default:"0"
Temperatur sampling (0 hingga 1).
array
Granularitas timestamp: word dan/atau segment. Memerlukan verbose_json.

Respons

string
Teks hasil transkripsi.
Untuk verbose_json:
string
Selalu transcribe.
string
Bahasa yang terdeteksi.
number
Durasi audio dalam detik.
array
Segmen transkripsi dengan timestamp.
array
Timestamp tingkat kata (jika diminta).

Terjemahan

Untuk menerjemahkan audio ke bahasa Inggris, gunakan endpoint translations: