Skip to main content
Ses işleri iki biçimdedir. Text-to-speech, transkripsiyon ve ses çevirisi gibi dosya benzeri istekler için audio endpointlerini kullanın. Düşük gecikmeli etkileşimli ses veya multimodal olaylar gerektiğinde gerçek zamanlı WebSocket endpointini kullanın.

Akışı Seç

Modelleri Keşfet

Bir modeli hard-code etmeden önce model kataloğunu sorgulayın. Speech ve transcription için önerilen listeleri kullanın; socket açmadan önce model detaylarında realtime desteğini doğrulayın.

Senkron Ses İstekleri

Speech, transcription ve translation istekleri doğrudan HTTP isteğinden döner. Büyük girdiler yaygın client timeout değerlerinden uzun sürebilir, bu yüzden geniş timeout belirleyin ve destek için request ID saklayın.

Gerçek Zamanlı Oturumlar

Model query string içinde, API key Authorization header içinde olacak şekilde WebSocket açın. Seçilen realtime model için belgelenen olay formatını kullanın ve oturum tamamlanınca socketi kapatın. Bu kılavuz yalnızca WebSocket proxy’sini kapsar. TokenLab şu anda OpenAI Realtime REST client secret, translation client secret, Calls veya legacy beta session yönetim endpoint’lerini sağlamaz.

Durum Yönetimi

  • Sayfa yenilenince aynı isteği tekrar çalıştırmak yerine üretilen ses dosyalarını saklayın.
  • Transkripsiyon ve çeviride API çağrısı senkron olsa bile yükleme ve işleme durumlarını gösterin.
  • Realtime için close olaylarını ele alın ve yalnızca kullanıcı yeni oturum başlatınca yeniden bağlanın.
  • API key, özel URL veya hesap sırlarını ses metni girişine koymayın.

API Referansı