Body Permintaan
Timeout permintaan sinkron: endpoint non-chat ini menunggu model yang dirutekan selesai. Input besar, audio panjang, atau batch besar dapat melebihi default client umum 30s, jadi atur timeout HTTP client Anda minimal120s.
file
wajib
File audio untuk ditranskripsikan. Format yang didukung: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm.
string
default:"whisper-1"
Model yang digunakan. Saat ini hanya
whisper-1 yang didukung.string
Bahasa audio dalam format ISO-639-1 (misalnya,
en, zh, ja).string
Teks opsional untuk memandu gaya model atau melanjutkan segmen sebelumnya.
string
default:"json"
Format output:
json, text, srt, verbose_json, vtt.number
default:"0"
Temperatur sampling (0 hingga 1).
array
Granularitas timestamp:
word dan/atau segment. Memerlukan verbose_json.Respons
string
Teks hasil transkripsi.
verbose_json:
string
Selalu
transcribe.string
Bahasa yang terdeteksi.
number
Durasi audio dalam detik.
array
Segmen transkripsi dengan timestamp.
array
Timestamp tingkat kata (jika diminta).