Tổng quan
Dịch audio ở bất kỳ ngôn ngữ được hỗ trợ nào thành văn bản tiếng Anh. Không giống như transcription, endpoint này luôn trả về văn bản tiếng Anh bất kể ngôn ngữ đầu vào là gì.Nội dung yêu cầu
Timeout cho yêu cầu đồng bộ: endpoint không phải chat này chờ model được định tuyến hoàn tất. Input lớn, audio dài, hoặc batch lớn có thể vượt quá mặc định 30s phổ biến của client, vì vậy hãy đặt timeout của HTTP client ít nhất là120s.
file
bắt buộc
Tệp audio cần dịch. Các định dạng được hỗ trợ:
flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm. Kích thước tệp tối đa là 25 MB.string
mặc định:"whisper-1"
Model sẽ được sử dụng. Hiện tại chỉ hỗ trợ
whisper-1.string
Văn bản tùy chọn để định hướng phong cách của model hoặc tiếp tục một đoạn trước đó. Nên là tiếng Anh.
string
mặc định:"json"
Định dạng của đầu ra. Các tùy chọn:
json, text, srt, verbose_json, vtt.number
Nhiệt độ lấy mẫu, trong khoảng từ 0 đến 1. Các giá trị cao hơn như 0.8 tạo ra đầu ra ngẫu nhiên hơn, trong khi các giá trị thấp hơn như 0.2 khiến đầu ra tập trung và mang tính xác định hơn.
Phản hồi
string
Văn bản đã dịch bằng tiếng Anh.
verbose_json, phản hồi cũng bao gồm:
string
Ngôn ngữ được phát hiện của audio đầu vào.
number
Thời lượng của audio đầu vào tính bằng giây.
array
Các đoạn của văn bản đã dịch kèm dấu thời gian.
Dịch thuật so với Chuyển lời nói thành văn bản
Endpoint dịch thuật tự động phát hiện ngôn ngữ nguồn và dịch sang tiếng Anh. Tham số
language từ transcription sẽ bị bỏ qua.