Skip to main content

Nội dung Request

Timeout cho yêu cầu đồng bộ: endpoint không phải chat này chờ model được định tuyến hoàn tất. Input lớn, audio dài, hoặc batch lớn có thể vượt quá mặc định 30s phổ biến của client, vì vậy hãy đặt timeout của HTTP client ít nhất là 120s.
file
bắt buộc
Tệp audio cần chép lời. Các định dạng được hỗ trợ: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm.
string
mặc định:"whisper-1"
Model sẽ sử dụng. Hiện tại chỉ hỗ trợ whisper-1.
string
Ngôn ngữ của audio theo định dạng ISO-639-1 (ví dụ: en, zh, ja).
string
Văn bản tùy chọn để định hướng phong cách của model hoặc tiếp tục một đoạn trước đó.
string
mặc định:"json"
Định dạng đầu ra: json, text, srt, verbose_json, vtt.
number
mặc định:"0"
Nhiệt độ lấy mẫu (0 đến 1).
array
Độ chi tiết của dấu thời gian: word và/hoặc segment. Yêu cầu verbose_json.

Phản hồi

string
Văn bản đã được chép lời.
Đối với verbose_json:
string
Luôn là transcribe.
string
Ngôn ngữ được phát hiện.
number
Thời lượng audio tính bằng giây.
array
Các đoạn chép lời kèm dấu thời gian.
array
Dấu thời gian ở cấp độ từ (nếu được yêu cầu).

Dịch

Để dịch audio sang tiếng Anh, hãy sử dụng endpoint translations: