Skip to main content
Reordena documentos utilizando modelos de similitud semántica. Útil para mejorar los resultados de búsqueda y las aplicaciones RAG.

Cuerpo de la solicitud

Tiempo de espera de solicitudes síncronas: este endpoint no-chat espera a que el modelo enrutado termine. Entradas grandes, audio largo o lotes grandes pueden superar los valores predeterminados habituales de 30s del cliente, así que configura el timeout de tu cliente HTTP en al menos 120s.
string
requerido
ID del modelo de reranker a utilizar (por ejemplo, qwen3-vl-rerank).
string
requerido
La consulta con la que se clasificarán los documentos. Longitud máxima: 32,000 caracteres.
array
requerido
Lista de documentos (cadenas de texto) a reordenar. Límites: hasta 1,000 documentos, cada documento hasta 100,000 caracteres y como máximo 2,000,000 caracteres de documentos en total.
integer
Número de mejores resultados a devolver. Por defecto se devuelven todos los documentos. Debe ser al menos 1 y no puede superar documents.length. TokenLab no aplica actualmente un límite público inferior específico de proveedor; si este límite cambia, esta página se actualizará antes de aplicarlo.
boolean
predeterminado:"false"
Indica si se debe incluir el texto original del documento en la respuesta.

Respuesta

array
Lista clasificada de documentos con puntuaciones.Cada resultado contiene:
  • index (integer): Índice original del documento
  • relevance_score (number): Puntuación de relevancia (0-1)
  • document (string): Texto original (si return_documents=true)
string
El modelo utilizado para el reordenamiento.
object
Estadísticas de uso de tokens.