Skip to main content
Urutkan ulang dokumen menggunakan model kesamaan semantik. Berguna untuk meningkatkan hasil pencarian dan aplikasi RAG.

Isi Permintaan

Timeout permintaan sinkron: endpoint non-chat ini menunggu model yang dirutekan selesai. Input besar, audio panjang, atau batch besar dapat melebihi default client umum 30s, jadi atur timeout HTTP client Anda minimal 120s.
string
wajib
ID model reranker yang akan digunakan (misalnya, qwen3-vl-rerank).
string
wajib
Kueri untuk membandingkan peringkat dokumen. Panjang maksimum: 32,000 karakter.
array
wajib
Daftar dokumen (string) untuk diurutkan ulang. Batas: hingga 1,000 dokumen, setiap dokumen hingga 100,000 karakter, dan total karakter dokumen paling banyak 2,000,000.
integer
Jumlah hasil teratas yang akan dikembalikan. Default ke semua dokumen. Nilainya harus minimal 1 dan tidak boleh lebih besar dari documents.length. Saat ini TokenLab tidak menerapkan batas publik yang lebih rendah khusus provider; jika batas ini berubah, halaman ini akan diperbarui sebelum diberlakukan.
boolean
default:"false"
Apakah akan menyertakan teks dokumen asli dalam respons.

Respons

array
Daftar dokumen yang telah diurutkan beserta skornya.Setiap hasil berisi:
  • index (integer): Indeks dokumen asli
  • relevance_score (number): Skor relevansi (0-1)
  • document (string): Teks asli (jika return_documents=true)
string
Model yang digunakan untuk reranking.
object
Statistik penggunaan token.