Skip to main content

Vue d’ensemble

Ce endpoint fournit une compatibilité native avec l’API Anthropic Messages. Utilisez-le pour les modèles Claude avec des fonctionnalités telles que la réflexion étendue. Ce point d’accès conserve le contrat Anthropic natif. messages doit être un tableau de messages user / assistant, system doit être placé dans le champ racine system, et max_tokens est requis. Si votre payload utilise des rôles OpenAI comme system, developer ou tool dans messages, envoyez-le plutôt à /v1/chat/completions.
URL de base pour le SDK Anthropic : https://api.tokenlab.sh (sans suffixe /v1)

En-têtes de requête

string
requis
Votre clé API TokenLab. Alternative au token Bearer.
string
requis
Version de l’API Anthropic. Utilisez 2023-06-01.

Corps de la requête

string
requis
ID du modèle Claude (par ex., claude-sonnet-4-6 ou claude-opus-4-6).
array
requis
Tableau d’objets message avec role et content.
integer
requis
Nombre maximal de tokens à générer.
string
Prompt système (séparé du tableau messages).
number
défaut:"1"
Température d’échantillonnage (0-1).
boolean
défaut:"false"
Active les réponses en streaming.
object
Configuration de la réflexion étendue (Claude Opus 4.5).
  • type (string) : "enabled" pour activer
  • budget_tokens (integer) : Budget de tokens pour la réflexion
array
Outils disponibles pour le modèle.
object
Comment le modèle doit utiliser les outils. Options : auto, any, tool (outil spécifique).
number
Paramètre de nucleus sampling. Utilisez soit temperature soit top_p, pas les deux.
integer
Échantillonner uniquement parmi les K meilleures options pour chaque token.
array
Séquences d’arrêt personnalisées qui entraîneront l’arrêt de la génération par le modèle.
object
Métadonnées à attacher à la requête à des fins de suivi.

Réponse

string
Identifiant unique du message.
string
Toujours message.
string
Toujours assistant.
array
Tableau de blocs de contenu (text, thinking, tool_use).
string
Modèle utilisé.
string
Pourquoi la génération s’est arrêtée (end_turn, max_tokens, tool_use).
object
Utilisation des tokens avec input_tokens et output_tokens.

Exemple d’entrée visuelle

Pour les modèles Claude avec prise en charge de la vision, placez les images dans messages[].content sous forme de blocs d’image structurés.

Exemple de réflexion étendue

Lots de messages Anthropic

TokenLab expose désormais le flux natif Anthropic Message Batches en plus de /v1/messages. Routes disponibles :
  • POST /v1/messages/batches
  • GET /v1/messages/batches
  • GET /v1/messages/batches/:message_batch_id
  • GET /v1/messages/batches/:message_batch_id/results
  • POST /v1/messages/batches/:message_batch_id/cancel
  • DELETE /v1/messages/batches/:message_batch_id
Notes d’exploitation :
  • Utilisez la même clé API TokenLab ainsi que les en-têtes natifs Anthropic.
  • Si des éléments du batch référencent file_id, ajoutez aussi anthropic-beta: files-api-2025-04-14.
  • Les batch jobs conservent les formats natifs de requête/réponse Anthropic, tandis que TokenLab suit leur cycle interne de règlement.