Skip to main content

Visão Geral

Este endpoint faz parte da API de Lote compatível com OpenAI da TokenLab. Trabalhos em lote utilizam arquivos JSONL carregados, são executados de forma assíncrona e podem retornar arquivos de saída/erro posteriormente.

Observações

  • Arquivos de entrada em lote devem usar purpose=batch.
  • completion_window é atualmente 24h.
  • A ordenação da saída não é garantida; sempre combine pelo custom_id.
  • Streaming não é suportado dentro dos itens de lote.
  • Os endpoints de item de lote atualmente compatíveis são /v1/chat/completions e /v1/embeddings; trabalhos em lote de /v1/responses são rejeitados até que um executor nativo de lotes Responses esteja disponível.

Exemplo

Solicitação / Resposta

Use o painel interativo do OpenAPI acima para o esquema exato.

Dicas Operacionais

  • Use custom_id para reconciliação idempotente a montante.
  • Espere output_file_id e error_file_id apenas após o trabalhador finalizar o lote.
  • A precificação de lote pode diferir da precificação síncrona porque as regras de desconto isBatchRequest=true se aplicam.

Exemplo de resposta

Campos importantes

string
Identificador para chamadas seguintes e suporte.
string
Estado atual do ciclo de vida deste recurso.
string|null
Identificador de arquivo usado por APIs relacionadas.