概述
TokenLab API 是原生优先,同时兼容 OpenAI 的。需要提供商原生行为时,使用 Anthropic 的POST /v1/messages 或 Gemini 的 /v1beta/models/...:generateContent;迁移已有 OpenAI 风格 SDK 或工具时,使用 OpenAI 兼容的 /v1 端点。POST /v1/responses 仍是需要 Responses 特定行为时的高级可选路径。
基础 URL
认证
所有 API 端点都需要使用 Bearer token 进行认证:支持的端点
聊天与文本生成
嵌入与重排序
图像
某些图像模型可能返回内联结果,某些可能返回基于任务的响应,具体行为可能取决于路由到的提供者路径。如果创建响应包含
poll_url,请严格按照其指示进行轮询。音频
实时
使用
/v1/realtime 发起 WebSocket 升级请求。普通 GET /v1/realtime 会返回端点元信息,方便无法直接检查 WebSocket 路由的客户端使用。它不是 OpenAI Realtime REST 面;client secret、translation client secret、Calls 和 legacy beta session 端点目前不对外提供。视频
对于新客户端,优先使用
/v1/tasks/{id} 并遵循创建响应返回的 poll_url。保留 /v1/videos/generations/{id} 仅用于向后兼容。异步任务
此端点不限于视频、音乐和 3D。某些图像任务也可能使用
/v1/tasks/{id} 作为规范的轮询路径。音乐
对于新客户端,优先使用返回的
poll_url。如果需要固定的任务状态端点,请使用 /v1/tasks/{id};保留 /v1/music/generations/{id} 以用于音乐专用的兼容路径。3D 生成
对于新客户端,优先使用返回的
poll_url。如果需要固定的任务状态端点,请使用 /v1/tasks/{id};保留 /v1/3d/generations/{id} 以用于 3D 专用的兼容路径。模型
Gemini (v1beta)
原生 Google Gemini API 格式支持:Gemini 端点除标准的 Bearer token 外,还支持
?key= 查询参数认证。响应格式
所有响应遵循一致的格式:成功响应
路由透明性
所有响应都包含带有通道信息的_routing 字段:
错误响应
速率限制
速率限制基于角色,并可由管理员配置。默认值:如需自定义速率限制,请联系支持。确切值可能因账户配置而异。
429 状态码,并带有 Retry-After 头,指示需要等待的时间。
OpenAPI 规范
OpenAPI 规范
下载完整的 OpenAPI 3.0 规范