Cuerpo de la solicitud
Tiempo de espera de solicitudes síncronas: este endpoint no-chat espera a que el modelo enrutado termine. Entradas grandes, audio largo o lotes grandes pueden superar los valores predeterminados habituales de 30s del cliente, así que configura el timeout de tu cliente HTTP en al menos120s.
string
requerido
ID del modelo de embedding que se va a usar (p. ej.,
text-embedding-3-small).string | array
requerido
Texto de entrada para generar el embedding. Puede ser una cadena o un array de cadenas.
string
predeterminado:"float"
Formato para los embeddings:
float o base64.integer
Número de dimensiones para la salida (específico del modelo).
string
Un identificador único que representa a tu usuario final para la supervisión de abuso.
Modelos disponibles
Respuesta
string
Siempre
list.array
Array de objetos de embedding.Cada objeto contiene:
object(string):embeddingindex(integer): Índice en el array de entradaembedding(array): El vector de embedding
string
Modelo utilizado.
object
Uso de tokens con
prompt_tokens y total_tokens.