Skip to main content

Übersicht

TokenLab bietet mit einem API-Schlüssel vier Protokolloberflächen: Chat Completions, Responses, Anthropic Messages und natives Gemini. Ein nativer Einstieg ist nur verfügbar, wenn das Modell dieses Format ausweist und eine gleichartige Upstream-Route existiert; native Einstiege fallen nie auf Chat Completions zurück. Nur der Chat-Einstieg kann einseitig in ein kompatibles Zielprotokoll kompiliert werden.

OpenAI-Format

/v1/chat/completions Standardformat, größte Kompatibilität

Responses

/v1/responses Native Responses-Lebenszyklen und Ereignisse

Anthropic-Format

/v1/messages Erweitertes Denken, native Claude-Funktionen

Gemini-Format

/v1beta/models/:model:generateContent Integration ins Google-Ökosystem

Warum Multi-Format?

Formatvergleich

OpenAI-Format

Verwenden Sie diesen Kompatibilitätsweg für bestehende OpenAI-SDK-Integrationen und portable Chat- oder Embedding-Flows. Für Claude- oder Gemini-natives Verhalten verwenden Sie das unten stehende Anthropic- oder Gemini-Format.
Am besten geeignet für:
  • Allgemeiner Einsatz
  • Bestehende OpenAI-SDK-Integrationen
  • Maximale Kompatibilität

Anthropic-Format

Native Anthropic Messages API. Erforderlich für Claude-spezifische Funktionen wie erweitertes Denken.

Erweitertes Denken (Claude Opus 4.6)

Nur im Anthropic-Format verfügbar:
Am besten geeignet für:
  • Claude-spezifische Funktionen
  • Modus für erweitertes Denken
  • Nutzer des nativen Anthropic SDK

Gemini-Format

Native Google Gemini API-Format zur Integration ins Google-Ökosystem.

Streaming

Am besten geeignet für:
  • Google Cloud-Integrationen
  • Bestehender Gemini-SDK-Code
  • Native Gemini-Funktionen
Gemini Files und Cache: Die native Gemini-Route unterstützt /upload/v1beta/files, /v1beta/files, /v1beta/files:register und /v1beta/cachedContents. Files nutzt upstream Kanäle, die mit der Gemini File API kompatibel sind; explizite Cache-Ressourcen können auch über Vertex AI Kanäle geroutet werden. Über TokenLab erstellte Ressourcen werden an denselben upstream Kanal/key gebunden und spätere generateContent Aufrufe nutzen diese Bindung weiter.

Grenze der Tool-Kompatibilität

Funktionstools können nur vom Chat-Einstieg einseitig kompiliert werden, wenn die Zielroute den vollständigen Tool-Zyklus darstellen kann. Provider-native Tools müssen auf ihrer nativen Route bleiben:
  • Gehostete und native OpenAI Responses-Tools wie tool_search, web_search, file_search, code_interpreter, MCP, shell/apply_patch und computer-use Tools benötigen /v1/responses.
  • Anthropic server/native Tools wie web_search_*, web_fetch_*, code_execution_*, tool_search_*, bash, computer-use und text-editor Tools benötigen /v1/messages.
  • Gemini Built-in-Tools wie googleSearch, codeExecution, urlContext, computerUse und ähnliche tools-Felder benötigen /v1beta.
TokenLab stuft native Protokollanfragen nicht zu Chat Completions herab. Unbekannte Felder und Tool-Kombinationen werden bestmöglich weitergeleitet; der ausgewählte Upstream entscheidet über die Unterstützung.

Wahl des richtigen Formats

Migrationsanleitungen

Von der offiziellen OpenAI-API

Von der offiziellen Anthropic-API

Von Google AI Studio

Portable Chat-Kompatibilität

Verwenden Sie /v1/chat/completions, wenn ein Client Modelle über unterschiedliche physische Upstream-Protokolle erreichen soll. Eine portable Chat-Anfrage kann einseitig zu Responses, Messages oder Gemini kompiliert werden, sofern sie vollständig darstellbar ist. Native Responses-, Messages- und Gemini-Anfragen werden nie in Chat umgewandelt; Modell- oder Providernamen allein belegen keine native Verfügbarkeit.

Grenzen von Responses und Gemini

Die aktuelle Responses-Oberfläche umfasst Erstellen, Kompaktieren, Abrufen, Löschen und SSE. Background läuft nur über HTTP. WebSocket akzeptiert nur response.create; Streaming ist implizit, background und response.cancel werden auf diesem Transport nicht angeboten. Löschen ist kein Abbrechen. Bei Gemini sind sowohl ProtoJSON-lowerCamelCase als auch ursprüngliche proto-snake_case-Namen offiziell und werden auch in gemischten Anfragen erhalten. Die aktuelle Oberfläche umfasst model list/get, generateContent, streamGenerateContent, countTokens, embedContent und batchEmbedContents; Interactions und Live sind nicht enthalten. Unbekannte Felder werden bestmöglich weitergeleitet, und der Upstream entscheidet über ihre Unterstützung.