Skip to main content
Responses est le protocole natif stateful d’OpenAI. TokenLab ne l’expose que lorsque les détails du modèle annoncent le format Responses et qu’une route upstream du même protocole est disponible ; cela n’est pas déduit du nom du modèle ou du fournisseur, et la requête ne se replie jamais sur Chat Completions. TokenLab conserve la forme JSON, y compris les champs inconnus, null explicite et les tableaux vides, puis la transmet au mieux.

Corps de la requête

string
requis
ID du modèle à utiliser. Voir Models pour les options disponibles.
string | array
L’entrée est facultative lorsque la requête utilise à la place un prompt réutilisable ou poursuit une réponse stockée avec previous_response_id.Une liste d’éléments d’entrée constituant la conversation.Chaque élément peut être :
  • message : Un message de conversation avec rôle et contenu
  • function_call : Une requête d’appel de fonction
  • function_call_output : Sortie d’un appel de fonction
Pour les entrées multimodales, message.content peut être soit une chaîne simple, soit un tableau de blocs de contenu. Pour les modèles capables de traiter des images, comme les variantes GPT-5.4, transmettez les images en tant que blocs input_image au lieu d’incorporer directement des URLs ou des chaînes Base64 dans du texte brut.Exemples de blocs de contenu :
  • { "type": "input_text", "text": "Describe this image" }
  • { "type": "input_image", "image_url": "https://example.com/image.jpg" }
  • { "type": "input_image", "image_url": "data:image/png;base64,..." }
string
Instructions système pour le modèle (équivalent du message système).
integer
Nombre maximal de tokens à générer.
number
défaut:"1"
Température d’échantillonnage entre 0 et 2.
array
Liste des outils que le modèle peut appeler. TokenLab transmet les définitions natives sans allowlist locale ; l’upstream sélectionné décide des types et combinaisons pris en charge.
boolean
défaut:"false"
Si true, renvoie un flux d’événements.
string
ID d’une réponse précédente à partir de laquelle continuer la conversation.
boolean
défaut:"true"
Indique s’il faut stocker la réponse pour une récupération ultérieure.
object
Métadonnées à attacher à la réponse à des fins de suivi.
object
Options de configuration pour la génération de texte. Le comportement de text.format dépend du modèle sélectionné et du chemin routé ; il n’est pas garanti de manière uniforme sur tous les modèles.
boolean
défaut:"true"
Indique s’il faut autoriser plusieurs appels d’outils en parallèle.
number
Paramètre de sampling Nucleus (0-1).
object
Configuration du raisonnement pour les modèles prenant en charge le raisonnement, tels que les variantes de la famille GPT-5.
  • effort (string) : Niveau d’effort de raisonnement (low, medium, high)

Réponse

string
Identifiant unique de la réponse.
string
Toujours response.
integer
Timestamp Unix de création de la réponse.
array
Liste des éléments de sortie générés par le modèle.
object
Statistiques d’utilisation des tokens.