リクエストボディ
同期リクエストのタイムアウト: この非チャットエンドポイントは、ルーティング先モデルの処理完了を待ちます。大きな入力、長い音声、大きなバッチは一般的な 30s のクライアント既定値を超えることがあるため、HTTP クライアントのタイムアウトは少なくとも120s に設定してください。
string
必須
使用するリランカーモデルの ID(例:
qwen3-vl-rerank、qwen3-vl-rerank)。string
必須
ドキュメントをランク付けするためのクエリ。最大長は
32,000 文字です。array
必須
再ランク付けするドキュメント(文字列)のリスト。上限は最大
1,000 件、各ドキュメント最大 100,000 文字、ドキュメント合計最大 2,000,000 文字です。integer
返す上位結果の数です。既定ではすべての documents を返します。
1 以上、かつ documents.length 以下である必要があります。将来プロバイダーがより厳しい公開制限を示した場合、TokenLab はここに記録して適用します。boolean
デフォルト:"false"
レスポンスに元のドキュメントテキストを含めるかどうか。
レスポンス
array
スコア順にランク付けされたドキュメントのリスト。各結果には以下が含まれます:
index(integer): 元のドキュメントのインデックスrelevance_score(number): 関連性スコア (0-1)document(string): 元のテキスト(return_documents=trueの場合)
string
再ランク付けに使用されたモデル。
object
トークン使用統計。