选择 API

Token360 提供多种模型 API。请选择与模型、SDK 和工作负载相匹配的协议,不要把所有端点视为可以互换。

选择表

OpenAI 兼容的文本或多模态对话POST /v1/chat/completions现有 OpenAI SDK 集成的默认选择;所选模型支持时可使用流式响应。
基于 OpenAI Responses API 的应用POST /v1/responses适用于所选模型支持的 Responses 输入、输出项、推理与工具字段。除非文档明确说明,否则不支持有状态后续操作。
基于 Anthropic SDK 的应用POST /v1/messages对支持的模型保留 Anthropic Messages 请求和响应格式。
单个 Chat 请求需要在后台运行POST /v1/async/chat/completions轮询返回的任务。这不是 Batch API,也不支持 callback_url
一个文件内包含大量独立请求Batch API上传 JSONL、创建批量任务,然后轮询或配置 Webhook。
图片生成POST /v1/images/generations参数因模型而异,以模型详情页为准。
视频生成POST /v1/videos异步执行。轮询视频资源或配置支持的回调。
语音生成或转录/v1/audio/*选择与音频处理方向对应的端点。

兼容性原则

Token360 会规范化常用字段,但兼容并不表示每个模型都支持所有字段。上线前请:

  1. 打开模型详情页,检查模态、支持参数、限制和价格。
  2. 使用 SDK 所期望的协议。
  3. 如果应用同时使用流式和非流式,请分别测试。
  4. 分别测试工具调用、结构化输出、推理、图片或文件;这些能力取决于模型。
  5. 多轮对话中保留上一轮 assistant 的原始字段。如果响应还包含推理或工具调用数据,不要只用可见文本重建 assistant 消息。

标准化请求与原生请求

默认模式接收 Token360 文档定义的 OpenAI 风格字段,并映射到所选上游路由。对于需要厂商原生请求体的图片、视频和语音模型,仅在模型文档明确要求时使用 Token360-Native-Params: true

原生透传会改变请求校验和字段映射,但 Token360 仍负责鉴权、路由、计量和计费。启用前请阅读 模型 → 参数透传(Token360-Native-Params)

Base URL

OpenAI 兼容客户端使用:

text
1https://api.token360.ai/v1

直接发送 HTTP 请求时使用完整端点,例如:

text
1https://api.token360.ai/v1/chat/completions

不要在 SDK 的 base_url 后再加 /chat/completions;SDK 会自行追加资源路径。

生产检查清单

  • 使用在线模型目录中的公开模型名,不使用上游部署 ID。
  • API Key 仅保存在服务端,不放入浏览器或移动端代码。
  • 按工作负载设置合理的应用超时。
  • 记录响应的 request ID 和 trace ID。
  • 使用 request ID 核对生产计费。
  • 限流、超时与重试 处理 4295xx 和流式中断。

相关文档

  • 快速开始:发送第一个请求。
  • 模型:查看在线目录和模型参数 Schema。
  • 模型能力:工具调用、结构化输出、推理和多模态支持。
  • 异步 Chat批量任务:选择后台执行方式。
  • API 参考:精确的请求与响应字段。
此页面对您有帮助吗?