Nội dung Request
Timeout cho yêu cầu đồng bộ: endpoint không phải chat này chờ model được định tuyến hoàn tất. Input lớn, audio dài, hoặc batch lớn có thể vượt quá mặc định 30s phổ biến của client, vì vậy hãy đặt timeout của HTTP client ít nhất là120s.
file
bắt buộc
Tệp audio cần chép lời. Các định dạng được hỗ trợ: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm.
string
mặc định:"whisper-1"
Model sẽ sử dụng. Hiện tại chỉ hỗ trợ
whisper-1.string
Ngôn ngữ của audio theo định dạng ISO-639-1 (ví dụ:
en, zh, ja).string
Văn bản tùy chọn để định hướng phong cách của model hoặc tiếp tục một đoạn trước đó.
string
mặc định:"json"
Định dạng đầu ra:
json, text, srt, verbose_json, vtt.number
mặc định:"0"
Nhiệt độ lấy mẫu (0 đến 1).
array
Độ chi tiết của dấu thời gian:
word và/hoặc segment. Yêu cầu verbose_json.Phản hồi
string
Văn bản đã được chép lời.
verbose_json:
string
Luôn là
transcribe.string
Ngôn ngữ được phát hiện.
number
Thời lượng audio tính bằng giây.
array
Các đoạn chép lời kèm dấu thời gian.
array
Dấu thời gian ở cấp độ từ (nếu được yêu cầu).