Pemetaan Rute
| Beban kerja yang ada | URL dasar TokenLab | Endpoint utama | Catatan migrasi |
|---|---|---|---|
| OpenAI Chat Completions | https://api.tokenlab.sh/v1 | /chat/completions | Perubahan terkecil untuk chat dan pemanggilan fungsi yang kompatibel dengan OpenAI |
| OpenAI Responses | https://api.tokenlab.sh/v1 | /responses | Gunakan saat aplikasi Anda bergantung pada input, tools, atau penanganan output khusus Responses |
| Anthropic SDK | https://api.tokenlab.sh | /v1/messages | Jangan tambahkan /v1 ke URL dasar SDK |
| Gemini REST | https://api.tokenlab.sh | /v1beta/models/:model:generateContent | Pertahankan field asli Gemini pada rute Gemini |
| Pembuatan media | https://api.tokenlab.sh/v1 | /images, /videos, /music, /3d | Temukan model dengan recommended_for dan antisipasi polling asinkron di tempat yang didokumentasikan |
| Manajemen dan penagihan | https://api.tokenlab.sh/v1 | /management/... | Gunakan token manajemen untuk penggunaan sisi server dan rekonsiliasi penagihan |
Resep Migrasi Cepat
OpenAI ke TokenLab
Ubah hanyabase_url / baseURL SDK menjadi https://api.tokenlab.sh/v1, pertahankan nama variabel lingkungan kunci API OpenAI Anda yang sudah ada jika itu lebih mudah untuk peluncuran, dan ganti ID model setelah memeriksa GET /v1/models.
OpenRouter ke TokenLab
Gunakanhttps://api.tokenlab.sh/v1 di mana aplikasi Anda sebelumnya menggunakan URL dasar yang kompatibel dengan OpenAI dari OpenRouter. Hapus ID model dengan awalan penyedia dan gunakan ID model publik TokenLab dari /v1/models; ketika beban kerja memerlukan Claude Messages atau generateContent Gemini, pindahkan ke endpoint asli TokenLab alih-alih memaksanya melalui chat yang kompatibel dengan OpenAI.
LiteLLM ke TokenLab
Gunakan rutecustom_openai/<model> milik LiteLLM dengan api_base: https://api.tokenlab.sh/v1. Pisahkan alias LiteLLM dari ID model TokenLab yang sebenarnya agar Anda dapat mengubah kebijakan perutean tanpa mengubah prompt aplikasi.
Claude Messages melalui TokenLab
Arahkan klien SDK Anthropic kehttps://api.tokenlab.sh dan panggil messages.create. Jangan tambahkan /v1 ke URL dasar SDK; SDK sudah memiliki jalur /v1/messages.
Gemini Native melalui TokenLab
Pertahankan payload Gemini padahttps://api.tokenlab.sh/v1beta/models/{model}:generateContent. contents, parts, file, konten yang di-cache, deklarasi fungsi, dan tools bawaan asli Gemini harus tetap berada di rute ini saat aplikasi Anda bergantung pada perilaku Gemini.
Migrasi yang Kompatibel dengan OpenAI
GET /v1/models sebelum trafik produksi. Untuk pembuatan gambar, kirim model secara eksplisit dan baca panduan gambar karena model gambar lebih bervariasi daripada model chat.
Migrasi Anthropic
/v1/messages untuk penggunaan tool asli Claude, alur berpikir (thinking flows), dan semantik pesan Anthropic. Jangan menerjemahkan field khusus Anthropic melalui Chat Completions kecuali Anda sengaja menginginkan perubahan perilaku yang kompatibel dengan OpenAI.
Migrasi Gemini
/v1beta saat aplikasi Anda bergantung pada perilaku asli Gemini.
Migrasi Media
- Kueri
GET /v1/models?recommended_for=image|video|music|3d. - Baca
GET /v1/modelsdalam respons daftar danGET /v1/models/{model}lengkap jika tersedia. - Kirim
modelsecara eksplisit, terutama untuk endpoint gambar. - Simpan
task_id,poll_url, endpoint, model, dan ID pekerjaan Anda sendiri untuk pekerjaan asinkron. - Rekonsiliasi biaya melalui catatan penggunaan dan
billing_transaction_id, bukan ID tugas penyedia.
Rencana Peluncuran Produksi
| Fase | Tujuan | Pemeriksaan |
|---|---|---|
| 1. Inventaris | Daftar endpoint, model, field permintaan, perilaku streaming/asinkron, dan pemilik penagihan | Tidak ada field khusus penyedia tersembunyi yang dianggap publik |
| 2. Pilot satu rute | Pindahkan satu endpoint dan satu keluarga model | Bentuk respons, biaya, dan log sesuai ekspektasi |
| 3. Shadow atau sampel | Bandingkan output yang dipilih dengan penyedia sebelumnya | Kualitas dan latensi yang terlihat oleh pengguna dapat diterima |
| 4. Peluncuran bertahap | Tingkatkan trafik berdasarkan kunci, organisasi, atau fitur flag | Pantau 4xx, 5xx, latensi, saldo, dan duplikasi pekerjaan asinkron |
| 5. Pembersihan | Hapus jalur penyedia lama hanya setelah penggunaan stabil | Jalur rollback dan buku panduan dukungan didokumentasikan |
Kendala Migrasi
- Jangan menempatkan setiap model di balik satu jalur OpenAI Chat Completions jika aplikasi Anda memerlukan perilaku asli Anthropic, Gemini, atau Responses.
- Jangan berasumsi menggunakan default gambar lama. Kirim
modelsecara eksplisit. - Jangan melakukan retry pada permintaan pembuatan asinkron tanpa memeriksa apakah tugas sudah dibuat.
- Jangan mengekspos pengenal khusus penyedia di log atau UI Anda.
- Jangan membandingkan penagihan dengan ID tugas penyedia. Gunakan catatan penggunaan TokenLab.
Referensi API
| Topik | Referensi |
|---|---|
| Multi-Format API | Multi-Format API |
| OpenAI SDK | OpenAI SDK |
| Anthropic SDK | Anthropic SDK |
| Gemini Native | Gemini Native API |
| Pembuatan Gambar | Image Generation |
| Pekerjaan Asinkron & Polling | Async Jobs & Polling |