Skip to main content
TokenLab es multiformato: puedes mantener clientes compatibles con OpenAI, llamadas a Messages nativas de Anthropic, llamadas REST nativas de Gemini y endpoints multimedia en sus formatos originales. La migración más segura no consiste en traducir cada carga de trabajo a un formato universal. Elige la ruta que posea el comportamiento que tu aplicación necesita.

Mapeo de rutas

Recetas de migración rápida

De OpenAI a TokenLab

Cambia solo la base_url / baseURL del SDK a https://api.tokenlab.sh/v1, mantén el nombre de tu variable de entorno de clave API de OpenAI existente si eso facilita el despliegue, y reemplaza los IDs de modelo después de verificar GET /v1/models.

De OpenRouter a TokenLab

Usa https://api.tokenlab.sh/v1 donde tu aplicación utilizaba anteriormente la URL base compatible con OpenAI de OpenRouter. Elimina los IDs de modelo con prefijo de proveedor y utiliza los IDs de modelo públicos de TokenLab desde /v1/models; cuando una carga de trabajo necesite Claude Messages o generateContent de Gemini, muévela al endpoint nativo de TokenLab en lugar de forzarla a través del chat compatible con OpenAI.

De LiteLLM a TokenLab

Usa la ruta custom_openai/<model> de LiteLLM con api_base: https://api.tokenlab.sh/v1. Mantén los alias de LiteLLM separados de los IDs de modelo reales de TokenLab para que puedas cambiar la política de enrutamiento sin modificar los prompts de la aplicación.

Claude Messages vía TokenLab

Apunta los clientes del SDK de Anthropic a https://api.tokenlab.sh y llama a messages.create. No añadas /v1 a la URL base del SDK; el SDK posee la ruta /v1/messages.

Gemini Native vía TokenLab

Mantén los payloads de Gemini en https://api.tokenlab.sh/v1beta/models/{model}:generateContent. Los campos contents, parts, archivos, contenidos cacheados, declaraciones de funciones y herramientas integradas nativos de Gemini deben permanecer en esta ruta cuando tu aplicación dependa del comportamiento de Gemini.

Migración compatible con OpenAI

Mantén tu código existente de reintentos, tiempos de espera y streaming, pero valida los IDs de modelo con GET /v1/models antes del tráfico de producción. Para la generación de imágenes, envía el model explícitamente y lee la guía de imágenes, ya que los modelos de imagen difieren más que los modelos de chat.

Migración de Anthropic

Usa /v1/messages para el uso de herramientas nativas de Claude, flujos de pensamiento y semántica de mensajes de Anthropic. No traduzcas campos exclusivos de Anthropic a través de Chat Completions a menos que intencionalmente desees un cambio de comportamiento compatible con OpenAI.

Migración de Gemini

Mantén las herramientas integradas de Gemini, referencias de File API, contenidos cacheados, declaraciones de funciones y partes de contenido nativas en /v1beta cuando tu aplicación dependa del comportamiento nativo de Gemini.

Migración de medios

  1. Consulta GET /v1/models?recommended_for=image|video|music|3d.
  2. Lee GET /v1/models en las respuestas de lista y el GET /v1/models/{model} completo donde esté disponible.
  3. Envía un model explícito, especialmente para endpoints de imágenes.
  4. Almacena task_id, poll_url, endpoint, modelo y tu propio ID de trabajo para tareas asíncronas.
  5. Concilia los costos a través de registros de uso y billing_transaction_id, no mediante IDs de tarea del proveedor.
Las cargas de trabajo multimedia necesitan su propio plan de despliegue porque la latencia, los reintentos y los activos finales se comportan de manera diferente a las completaciones de chat.

Plan de despliegue en producción

Errores comunes de migración

  • No pongas todos los modelos detrás de una ruta de OpenAI Chat Completions si tu aplicación necesita el comportamiento nativo de Anthropic, Gemini o Responses.
  • No asumas los valores predeterminados de imágenes antiguos. Envía el model explícitamente.
  • No reintentes solicitudes de creación asíncronas sin verificar si ya se creó una tarea.
  • No expongas identificadores específicos del proveedor en tus registros o interfaz de usuario.
  • No compares la facturación con los IDs de tarea del proveedor. Usa los registros de uso de TokenLab.

Referencia de API