Skip to main content
Responses é o protocolo nativo com estado da OpenAI. O TokenLab só o expõe quando os detalhes do modelo anunciam o formato Responses e existe uma rota upstream do mesmo protocolo; isso não é inferido pelo nome do modelo ou provedor e nunca há fallback para Chat Completions. O TokenLab preserva a forma JSON, incluindo campos desconhecidos, null explícito e arrays vazios, e a encaminha em best-effort.

Corpo da Requisição

string
obrigatório
ID do modelo a ser usado. Veja Models para as opções disponíveis.
string | array
A entrada é opcional quando a solicitação usa um prompt reutilizável ou continua uma resposta armazenada com previous_response_id.Uma lista de itens de entrada que compõem a conversa.Cada item pode ser:
  • message: Uma mensagem de conversa com role e content
  • function_call: Uma solicitação de chamada de função
  • function_call_output: Saída de uma chamada de função
Para entrada multimodal, message.content pode ser uma string simples ou um array de blocos de conteúdo. Para modelos com capacidade de imagem, como variantes GPT-5.4, envie imagens como blocos input_image em vez de incorporar URLs ou strings Base64 diretamente em texto simples.Exemplo de blocos de conteúdo:
  • { "type": "input_text", "text": "Describe this image" }
  • { "type": "input_image", "image_url": "https://example.com/image.jpg" }
  • { "type": "input_image", "image_url": "data:image/png;base64,..." }
string
Instruções do sistema para o modelo (equivalente à mensagem do system).
integer
Número máximo de tokens a serem gerados.
number
padrão:"1"
Temperatura de amostragem entre 0 e 2.
array
Lista de ferramentas que o modelo pode chamar. O TokenLab encaminha definições nativas sem allowlist local; o upstream escolhido decide os tipos e combinações compatíveis.
boolean
padrão:"false"
Se true, retorna um fluxo de eventos.
string
ID de uma resposta anterior para continuar a conversa a partir dela.
boolean
padrão:"true"
Se a resposta deve ser armazenada para recuperação posterior.
object
Metadados para anexar à resposta para fins de rastreamento.
object
Opções de configuração para geração de texto. O comportamento de text.format depende do modelo selecionado e do caminho roteado; não é garantido de forma uniforme em todos os modelos.
boolean
padrão:"true"
Se permite múltiplas chamadas de ferramentas em paralelo.
number
Parâmetro de amostragem nucleus (0-1).
object
Configuração de raciocínio para modelos com suporte a raciocínio, como variantes da família GPT-5.
  • effort (string): Nível de esforço de raciocínio (low, medium, high)

Resposta

string
Identificador único da resposta.
string
Sempre response.
integer
Timestamp Unix de quando a resposta foi criada.
array
Lista de itens de saída gerados pelo modelo.
object
Estatísticas de uso de tokens.