Skip to main content

Model Seçimi

Doğru modeli seçmek, maliyet ve kaliteyi önemli ölçüde etkileyebilir.

Görev Bazlı Öneriler

Maliyet Katmanları

Maliyet Optimizasyonu

1. Önce Daha Küçük Modeller Kullanın

2. max_tokens Ayarlayın

Her zaman makul bir max_tokens sınırı belirleyin:

3. Prompt’ları Optimize Edin

4. Benzer İstekleri Batch Edin

Performans Optimizasyonu

5. UX için Streaming Kullanın

Streaming, algılanan performansı artırır:

6. Etkileşimli Kullanım için Hızlı Modeller Seçin

7. Timeout Değerleri Ayarlayın

Güvenilirlik

8. Retry Mekanizması Uygulayın

9. Hataları Zarif Şekilde Yönetin

10. Fallback Modeller Kullanın

Güvenlik

11. API Key’leri Koruyun

12. Kullanıcı Girdisini Doğrulayın

13. API Key Limitleri Belirleyin

Şunlar için harcama limitlerine sahip ayrı API key’leri oluşturun:
  • Geliştirme/test
  • Üretim
  • Farklı uygulamalar

İzleme

14. Kullanımı Takip Edin

Aşağıdakiler için dashboard’unuzu düzenli olarak kontrol edin:
  • Modele göre token kullanımı
  • Maliyet dağılımı
  • Cache hit oranları
  • Hata oranları

15. Önemli Metrikleri Loglayın

16. Uyarıları Ayarlayın

Hizmet kesintisini önlemek için dashboard’unuzda düşük bakiye uyarılarını yapılandırın.

Kontrol Listesi

  • Her görev için uygun model kullanımı
  • max_tokens limitleri belirlenmiş
  • Prompt’lar kısa ve öz
  • Uygun yerlerde caching etkin
  • Benzer istekler batch ediliyor
  • Etkileşimli UX için streaming
  • Gerçek zamanlı kullanım için hızlı modeller
  • Timeout’lar yapılandırılmış
  • Retry mantığı uygulanmış
  • Hata yönetimi mevcut
  • Fallback modeller yapılandırılmış
  • API key’leri environment variable içinde
  • Girdi doğrulama
  • Geliştirme/production için ayrı key’ler
  • Harcama limitleri belirlenmiş