Skip to main content

Cuerpo de la solicitud

Tiempo de espera de solicitudes síncronas: este endpoint no-chat espera a que el modelo enrutado termine. Entradas grandes, audio largo o lotes grandes pueden superar los valores predeterminados habituales de 30s del cliente, así que configura el timeout de tu cliente HTTP en al menos 120s.
string
requerido
ID del modelo de embedding que se va a usar (p. ej., text-embedding-3-small).
string | array
requerido
Texto de entrada para generar el embedding. Puede ser una cadena o un array de cadenas.
string
predeterminado:"float"
Formato para los embeddings: float o base64.
integer
Número de dimensiones para la salida (específico del modelo).
string
Un identificador único que representa a tu usuario final para la supervisión de abuso.

Modelos disponibles

Respuesta

string
Siempre list.
array
Array de objetos de embedding.Cada objeto contiene:
  • object (string): embedding
  • index (integer): Índice en el array de entrada
  • embedding (array): El vector de embedding
string
Modelo utilizado.
object
Uso de tokens con prompt_tokens y total_tokens.

Embeddings por lotes