Skip to main content
Ses işleri iki biçimdedir. Text-to-speech, transkripsiyon ve ses çevirisi gibi dosya benzeri istekler için audio endpointlerini kullanın. Düşük gecikmeli etkileşimli ses veya multimodal olaylar gerektiğinde gerçek zamanlı WebSocket endpointini kullanın.

Akışı Seç

Modelleri Keşfet

Bir modeli hard-code etmeden önce model kataloğunu sorgulayın. Speech ve transcription için önerilen listeleri kullanın; socket açmadan önce model detaylarında realtime desteğini doğrulayın.

Senkron Ses İstekleri

Konuşma üretimi HTTP yanıtında ses döndürür. Transkripsiyon ve çeviri son metni veya kabul edilmiş bir görevi döndürebilir. Yanıtta son metin yerine görev kimliği ve durum varsa kimliği saklayın ve tamamlanana veya başarısız olana kadar poll_url adresini sorgulayın. Büyük dosyalara yeterli süre tanıyın ve Request ID’yi saklayın.

Gerçek Zamanlı Oturumlar

Model query string içinde, API key Authorization header içinde olacak şekilde WebSocket açın. Seçilen realtime model için belgelenen olay formatını kullanın ve oturum tamamlanınca socketi kapatın. Bu kılavuz yalnızca WebSocket subset kapsamını anlatır. TokenLab şu anda OpenAI Realtime REST client secret, translation client secret, Calls veya legacy beta session yönetim endpoint’lerini sağlamaz. Sunucu örneği için ws kurun ve TOKENLAB_REALTIME_MODEL değerini ayrıntılarında /v1/realtime belirtilen güncel bir modele ayarlayın. TOKENLAB_API_KEY sunucu ortamında sağlanmalıdır; ad tek başına realtime desteğini kanıtlamaz.

Durum Yönetimi

  • Sayfa yenilenince aynı isteği tekrar çalıştırmak yerine üretilen ses dosyalarını saklayın.
  • Transkripsiyon ve çeviride API çağrısı senkron olsa bile yükleme ve işleme durumlarını gösterin.
  • Realtime için close olaylarını ele alın ve yalnızca kullanıcı yeni oturum başlatınca yeniden bağlanın.
  • API key, özel URL veya hesap sırlarını ses metni girişine koymayın.

API Referansı