null explícito y arrays vacíos, y la reenvía con el mejor esfuerzo.
Cuerpo de la solicitud
string | array
La entrada es opcional cuando la solicitud usa en su lugar un
prompt reutilizable o continúa una respuesta almacenada con previous_response_id.Una lista de elementos de entrada que componen la conversación.Cada elemento puede ser:message: Un mensaje de la conversación con role y contentfunction_call: Una solicitud de llamada a funciónfunction_call_output: Salida de una llamada a función
message.content puede ser una cadena de texto simple o un arreglo de bloques de contenido. Para modelos con capacidad de imágenes, como las variantes GPT-5.4, pase las imágenes como bloques input_image en lugar de incrustar URLs o cadenas Base64 directamente en texto plano.Ejemplos de bloques de contenido:{ "type": "input_text", "text": "Describe this image" }{ "type": "input_image", "image_url": "https://example.com/image.jpg" }{ "type": "input_image", "image_url": "data:image/png;base64,..." }
string
Instrucciones del sistema para el modelo (equivalente al mensaje del sistema).
integer
Número máximo de tokens a generar.
number
predeterminado:"1"
Temperatura de muestreo entre 0 y 2.
array
Lista de herramientas que el modelo puede invocar. TokenLab reenvía las definiciones nativas sin una allowlist local; el upstream elegido decide qué tipos y combinaciones admite.
boolean
predeterminado:"false"
Si es true, devuelve un flujo de eventos.
string
ID de una respuesta previa desde la cual continuar la conversación.
boolean
predeterminado:"true"
Si se debe almacenar la respuesta para recuperación posterior.
object
Metadatos para adjuntar a la respuesta con fines de seguimiento.
object
Opciones de configuración de generación de texto. El comportamiento de
text.format depende del modelo seleccionado y de la ruta enrutada; no está garantizado de forma uniforme en todos los modelos.boolean
predeterminado:"true"
Si se permiten múltiples llamadas a herramientas en paralelo.
number
Parámetro de muestreo por núcleo (nucleus sampling) (0-1).
object
Configuración de razonamiento para modelos con capacidades de razonamiento, como las variantes de la familia GPT-5.
effort(string): Nivel de esfuerzo de razonamiento (low,medium,high)
Respuesta
string
Identificador único de la respuesta.
string
Siempre
response.integer
Marca de tiempo Unix de cuando se creó la respuesta.
array
Lista de elementos de salida generados por el modelo.
object
Estadísticas de uso de tokens.