Skip to main content
TokenLab hỗ trợ đa định dạng: bạn có thể giữ nguyên các client tương thích với OpenAI, các lệnh gọi Messages gốc của Anthropic, các lệnh gọi REST gốc của Gemini và các endpoint media ở định dạng tự nhiên của chúng. Cách di chuyển an toàn nhất không phải là chuyển đổi mọi khối lượng công việc sang một định dạng chung duy nhất. Hãy chọn lộ trình sở hữu hành vi mà ứng dụng của bạn cần.

Ánh xạ lộ trình (Route Mapping)

Các công thức di chuyển nhanh

Từ OpenAI sang TokenLab

Chỉ thay đổi base_url / baseURL của SDK thành https://api.tokenlab.sh/v1, giữ nguyên tên biến môi trường chứa API key OpenAI hiện tại của bạn nếu điều đó giúp việc triển khai dễ dàng hơn, và thay thế các ID model sau khi đã kiểm tra qua GET /v1/models.

Từ OpenRouter sang TokenLab

Sử dụng https://api.tokenlab.sh/v1 ở nơi ứng dụng của bạn trước đây sử dụng URL cơ sở tương thích với OpenAI của OpenRouter. Loại bỏ các ID model có tiền tố nhà cung cấp và sử dụng ID model công khai của TokenLab từ /v1/models; khi một khối lượng công việc cần Claude Messages hoặc generateContent của Gemini, hãy chuyển nó sang endpoint gốc của TokenLab thay vì ép buộc nó thông qua chat tương thích với OpenAI.

Từ LiteLLM sang TokenLab

Sử dụng lộ trình custom_openai/<model> của LiteLLM với api_base: https://api.tokenlab.sh/v1. Giữ các bí danh (alias) của LiteLLM tách biệt với các ID model thực của TokenLab để bạn có thể thay đổi chính sách định tuyến mà không cần thay đổi các prompt của ứng dụng.

Claude Messages qua TokenLab

Trỏ các client Anthropic SDK vào https://api.tokenlab.sh và gọi messages.create. Không thêm /v1 vào URL cơ sở của SDK; SDK đã sở hữu đường dẫn /v1/messages.

Gemini Native qua TokenLab

Giữ các payload của Gemini trên https://api.tokenlab.sh/v1beta/models/{model}:generateContent. Các thành phần contents, parts, tệp tin, nội dung được lưu cache, khai báo hàm và các công cụ tích hợp sẵn của Gemini nên được giữ trên lộ trình này khi ứng dụng của bạn phụ thuộc vào hành vi của Gemini.

Di chuyển tương thích với OpenAI

Giữ nguyên mã xử lý thử lại (retry), timeout và streaming hiện tại của bạn, nhưng hãy xác thực các ID model bằng GET /v1/models trước khi đưa vào lưu lượng truy cập thực tế. Đối với việc tạo hình ảnh, hãy gửi model một cách rõ ràng và đọc hướng dẫn về hình ảnh vì các model hình ảnh khác biệt nhiều hơn so với các model chat.

Di chuyển Anthropic

Sử dụng /v1/messages cho việc sử dụng công cụ gốc của Claude, các luồng suy nghĩ (thinking flows) và ngữ nghĩa tin nhắn của Anthropic. Đừng chuyển đổi các trường chỉ dành riêng cho Anthropic thông qua Chat Completions trừ khi bạn cố tình muốn thay đổi hành vi tương thích với OpenAI.

Di chuyển Gemini

Giữ các công cụ tích hợp sẵn của Gemini, tham chiếu File API, nội dung được lưu cache, khai báo hàm và các phần nội dung gốc trên /v1beta khi ứng dụng của bạn phụ thuộc vào hành vi gốc của Gemini.

Di chuyển Media

  1. Truy vấn GET /v1/models?recommended_for=image|video|music|3d.
  2. Đọc GET /v1/models trong các phản hồi danh sách và GET /v1/models/{model} đầy đủ nếu có.
  3. Gửi một model rõ ràng, đặc biệt là đối với các endpoint hình ảnh.
  4. Lưu trữ task_id, poll_url, endpoint, model và ID công việc của riêng bạn cho các công việc bất đồng bộ.
  5. Đối soát chi phí thông qua hồ sơ sử dụng và billing_transaction_id, không phải ID tác vụ của nhà cung cấp.
Các khối lượng công việc media cần kế hoạch triển khai riêng vì độ trễ, việc thử lại và tài sản cuối cùng hoạt động khác với các tác vụ chat completions.

Kế hoạch triển khai Production

Các cạm bẫy khi di chuyển

  • Đừng đặt mọi model đằng sau một đường dẫn OpenAI Chat Completions nếu ứng dụng của bạn cần hành vi gốc của Anthropic, Gemini hoặc Responses.
  • Đừng giả định các giá trị mặc định cũ của hình ảnh. Hãy gửi model một cách rõ ràng.
  • Đừng thử lại các yêu cầu tạo bất đồng bộ mà không kiểm tra xem tác vụ đã được tạo hay chưa.
  • Đừng để lộ các định danh cụ thể của nhà cung cấp trong nhật ký hoặc giao diện người dùng của bạn.
  • Đừng so sánh thanh toán với ID tác vụ của nhà cung cấp. Hãy sử dụng hồ sơ sử dụng của TokenLab.

Tài liệu tham khảo API