Skip to main content

Überblick

Dieser Endpoint bietet native Kompatibilität mit der Anthropic Messages API. Verwenden Sie ihn für Claude-Modelle mit Funktionen wie Extended Thinking. Dieser Endpunkt behält den nativen Anthropic-Vertrag bei. messages muss ein Array aus user- / assistant-Nachrichten sein, system gehört in das Top-Level-Feld system, und max_tokens ist erforderlich. Wenn dein Payload OpenAI-Rollen wie system, developer oder tool innerhalb von messages verwendet, sende ihn stattdessen an /v1/chat/completions.
Base URL für Anthropic SDK: https://api.tokenlab.sh (ohne /v1-Suffix)

Request-Header

string
erforderlich
Ihr TokenLab API-Schlüssel. Alternative zum Bearer-Token.
string
erforderlich
Anthropic API-Version. Verwenden Sie 2023-06-01.

Request-Body

string
erforderlich
Claude-Modell-ID (z. B. claude-sonnet-4-6 oder claude-opus-4-6).
array
erforderlich
Array von Nachrichtenobjekten mit role und content.
integer
erforderlich
Maximale Anzahl zu generierender Tokens.
string
System-Prompt (separat vom messages-Array).
number
Standard:"1"
Sampling-Temperatur (0-1).
boolean
Standard:"false"
Streaming-Antworten aktivieren.
object
Extended-Thinking-Konfiguration (Claude Opus 4.5).
  • type (string): "enabled" zum Aktivieren
  • budget_tokens (integer): Token-Budget für das Denken
array
Verfügbare Tools für das Modell.
object
Wie das Modell Tools verwenden soll. Optionen: auto, any, tool (spezifisches Tool).
number
Nucleus-Sampling-Parameter. Verwenden Sie entweder temperature oder top_p, nicht beides.
integer
Für jedes Token nur aus den obersten K-Optionen sampeln.
array
Benutzerdefinierte Stop-Sequenzen, die dazu führen, dass das Modell die Generierung beendet.
object
Metadaten, die zur Nachverfolgung an die Anfrage angehängt werden.

Antwort

string
Eindeutige Nachrichtenkennung.
string
Immer message.
string
Immer assistant.
array
Array von Content-Blöcken (text, thinking, tool_use).
string
Verwendetes Modell.
string
Warum die Generierung gestoppt wurde (end_turn, max_tokens, tool_use).
object
Token-Nutzung mit input_tokens und output_tokens.

Vision-Eingabebeispiel

Bei Claude-Modellen mit Vision-Unterstützung platzieren Sie Bilder in messages[].content als strukturierte Bildblöcke.

Beispiel für Extended Thinking

Anthropic Message-Batches

TokenLab stellt jetzt zusätzlich zu /v1/messages auch den nativen Anthropic-Message-Batches-Flow bereit. Verfügbare Routen:
  • POST /v1/messages/batches
  • GET /v1/messages/batches
  • GET /v1/messages/batches/:message_batch_id
  • GET /v1/messages/batches/:message_batch_id/results
  • POST /v1/messages/batches/:message_batch_id/cancel
  • DELETE /v1/messages/batches/:message_batch_id
Hinweise für den Betrieb:
  • Verwende denselben TokenLab-API-Key zusammen mit den nativen Anthropic-Headern.
  • Wenn Batch-Items auf file_id verweisen, füge zusätzlich anthropic-beta: files-api-2025-04-14 hinzu.
  • Batch-Jobs behalten die nativen Anthropic-Request/Response-Formate bei, während TokenLab den internen Abrechnungs-Lifecycle nachverfolgt.