Skip to main content
Réorganisez les documents à l’aide de modèles de similitude sémantique. Utile pour améliorer les résultats de recherche et les applications RAG.

Corps de la requête

Timeout des requêtes synchrones : cet endpoint non-chat attend que le modèle routé termine son traitement. Les entrées volumineuses, les longs fichiers audio ou les grands lots peuvent dépasser les valeurs par défaut courantes de 30s côté client ; configurez donc le timeout de votre client HTTP à au moins 120s.
string
requis
ID du modèle de reranker à utiliser (par ex., qwen3-vl-rerank).
string
requis
La requête par rapport à laquelle classer les documents. Longueur maximale : 32,000 caractères.
array
requis
Liste de documents (chaînes de caractères) à réorganiser. Limites : jusqu’à 1,000 documents, chaque document jusqu’à 100,000 caractères, et au plus 2,000,000 caractères de documents au total.
integer
Nombre de meilleurs résultats à retourner. Par défaut, tous les documents. Doit être au moins 1 et ne pas dépasser documents.length. TokenLab n’applique actuellement aucun plafond public plus bas propre à un fournisseur ; si cette limite change, cette page sera mise à jour avant son application.
boolean
défaut:"false"
Indique s’il faut inclure le texte original du document dans la réponse.

Réponse

array
Liste classée des documents avec scores.Chaque résultat contient :
  • index (integer) : Index du document original
  • relevance_score (number) : Score de pertinence (0-1)
  • document (string) : Texte original (si return_documents=true)
string
Le modèle utilisé pour la réorganisation.
object
Statistiques d’utilisation des tokens.