选择 API
Token360 提供多种模型 API。请选择与模型、SDK 和工作负载相匹配的协议,不要把所有端点视为可以互换。
选择表
| OpenAI 兼容的文本或多模态对话 | POST /v1/chat/completions | 现有 OpenAI SDK 集成的默认选择;所选模型支持时可使用流式响应。 |
| 基于 OpenAI Responses API 的应用 | POST /v1/responses | 适用于所选模型支持的 Responses 输入、输出项、推理与工具字段。除非文档明确说明,否则不支持有状态后续操作。 |
| 基于 Anthropic SDK 的应用 | POST /v1/messages | 对支持的模型保留 Anthropic Messages 请求和响应格式。 |
| 单个 Chat 请求需要在后台运行 | POST /v1/async/chat/completions | 轮询返回的任务。这不是 Batch API,也不支持 callback_url。 |
| 一个文件内包含大量独立请求 | Batch API | 上传 JSONL、创建批量任务,然后轮询或配置 Webhook。 |
| 图片生成 | POST /v1/images/generations | 参数因模型而异,以模型详情页为准。 |
| 视频生成 | POST /v1/videos | 异步执行。轮询视频资源或配置支持的回调。 |
| 语音生成或转录 | /v1/audio/* | 选择与音频处理方向对应的端点。 |
兼容性原则
Token360 会规范化常用字段,但兼容并不表示每个模型都支持所有字段。上线前请:
- 打开模型详情页,检查模态、支持参数、限制和价格。
- 使用 SDK 所期望的协议。
- 如果应用同时使用流式和非流式,请分别测试。
- 分别测试工具调用、结构化输出、推理、图片或文件;这些能力取决于模型。
- 多轮对话中保留上一轮 assistant 的原始字段。如果响应还包含推理或工具调用数据,不要只用可见文本重建 assistant 消息。
标准化请求与原生请求
默认模式接收 Token360 文档定义的 OpenAI 风格字段,并映射到所选上游路由。对于需要厂商原生请求体的图片、视频和语音模型,仅在模型文档明确要求时使用 Token360-Native-Params: true。
原生透传会改变请求校验和字段映射,但 Token360 仍负责鉴权、路由、计量和计费。启用前请阅读 模型 → 参数透传(Token360-Native-Params)。
Base URL
OpenAI 兼容客户端使用:
text
1https://api.token360.ai/v1直接发送 HTTP 请求时使用完整端点,例如:
text
1https://api.token360.ai/v1/chat/completions不要在 SDK 的 base_url 后再加 /chat/completions;SDK 会自行追加资源路径。
生产检查清单
- 使用在线模型目录中的公开模型名,不使用上游部署 ID。
- API Key 仅保存在服务端,不放入浏览器或移动端代码。
- 按工作负载设置合理的应用超时。
- 记录响应的 request ID 和 trace ID。
- 使用 request ID 核对生产计费。
- 按 限流、超时与重试 处理
429、5xx和流式中断。
相关文档
- 快速开始:发送第一个请求。
- 模型:查看在线目录和模型参数 Schema。
- 模型能力:工具调用、结构化输出、推理和多模态支持。
- 异步 Chat 与 批量任务:选择后台执行方式。
- API 参考:精确的请求与响应字段。
此页面对您有帮助吗?