概述
TokenHub 平台聚合了腾讯混元、DeepSeek、智谱 GLM、Kimi、MiniMax 等多家厂商的语言模型,覆盖对话交互、内容创作、代码生成、推理分析等场景。所有模型统一兼容 OpenAI Chat Completions API 与 Anthropic Messages API 两种协议,您可以直接使用 OpenAI SDK、Anthropic SDK 或任何兼容客户端接入。
模型支持的协议概览
模型名称 | model 参数值 | OpenAI Chat Completions | OpenAI Responses | Anthropic |
Hy3 | hy3 | ✅ | ✅ | ✅ |
Hy3 preview(2026-08-31下线) | hy3-preview | ✅ | ✅ | ✅ |
Hy-MT2-Pro | hy-mt2-pro | ✅ | ❌ | ✅ |
Hy-MT2-Plus | hy-mt2-plus | ✅ | ❌ | ✅ |
Hy-MT2-Lite | hy-mt2-lite | ✅ | ❌ | ✅ |
Hy-Role-Latest | hunyuan-role-latest | ✅ | ❌ | ✅ |
Hy-Role | hy-role | ✅ | ❌ | ✅ |
DeepSeek-V4-Flash 0731 正式版 原厂直供 | deepseek-v4-flash-202605 | ✅ | ✅ | ✅ |
DeepSeek-V4-Pro 0813 正式版 原厂直供 | deepseek-v4-pro-202606 | ✅ | ✅ | ✅ |
DeepSeek-V4-Flash | deepseek-v4-flash | ✅ | ✅* | ✅ |
DeepSeek-V4-Pro | deepseek-v4-pro | ✅ | ✅* | ✅ |
GLM-5.3 | glm-5.3 | ✅ | ✅* | ✅ |
GLM-5.2 | glm-5.2 | ✅ | ✅* | ✅ |
GLM-5.1 | glm-5.1 | ✅ | ✅* | ✅ |
GLM-5V-Turbo | glm-5v-turbo | ✅ | ❌ | ✅ |
GLM-5-Turbo | glm-5-turbo | ✅ | ❌ | ✅ |
GLM-5 | glm-5 | ✅ | ❌ | ✅ |
Kimi K2.7 Code HighSpeed | kimi-k2.7-code-highspeed | ✅ | ❌ | ✅ |
Kimi K3 | kimi-k3 | ✅ | ✅* | ✅ |
Kimi K2.7 Code | kimi-k2.7-code | ✅ | ❌ | ✅ |
Kimi-K2.6 | kimi-k2.6 | ✅ | ✅* | ✅ |
Kimi-K2.5 | kimi-k2.5 | ✅ | ✅* | ✅ |
MiniMax-M3 | minimax-m3 | ✅ | ✅ | ✅ |
MiniMax-M2.7 | minimax-m2.7 | ✅ | ✅ | ✅ |
Qwen3.5-Flash | qwen3.5-flash | ✅ | ✅ | ✅ |
Qwen3.5-Plus | qwen3.5-plus | ✅ | ✅ | ✅ |
MiMo-V2.5-Pro | mimo-v2.5-pro | ✅ | ✅* | ✅ |
说明:
✅ 表示原生支持;✅* 表示通过兼容模式支持 —— 模型原生仅提供 Chat Completions 协议,由平台在服务端自动完成协议转换,调用方式与原生支持的模型一致,但部分参数与内置工具存在限制,详见 Responses API 兼容模式说明。表中模型需在控制台开通对应的模型服务后才可调用。未开通时调用会返回
402 错误,与模型本身是否支持该协议无关。平台模型会持续更新,最新的可用模型列表可通过
GET /v1/models 接口查询,返回结果中 status 为 online 的即为当前可用模型。协议与调用方式
TokenHub 对客户端统一提供三种业界标准协议,所有模型均通过同一组 Base URL 接入,仅需切换协议路径与
model(三种协议均为 POST 请求):协议 | 路径 | 适用 SDK | 说明 |
OpenAI Chat Completions | /v1/chat/completions | OpenAI SDK 及兼容客户端 | 最通用,覆盖全部模型 |
OpenAI Responses | /v1/responses | OpenAI SDK(Responses 接口) | 面向多类型输入与内置工具的新接口,支持模型有限 |
Anthropic Messages | /v1/messages | Anthropic SDK 及兼容客户端 | Claude 风格协议,兼容 DeepSeek 等模型 |
Base URL(按接入地域二选一)
广州:
https://tokenhub.tencentmaas.com/v1新加坡:
https://tokenhub-intl.tencentmaas.com/v1认证方式(按调用协议设置请求头)
OpenAI Chat / Responses 路径:
Authorization: Bearer YOUR_API_KEYAnthropic Messages 路径:
x-api-key: YOUR_API_KEY各协议的完整字段说明与调用示例请参见以下文档:
TokenHub 相对标准 API 的变化
TokenHub 对客户端保持三种标准协议的原生语义,同一份 OpenAI / Anthropic SDK 代码通常只需替换 Base URL、API Key 与
model 即可接入。相较各协议官方标准,主要差异集中在以下方面:统一入口与鉴权:所有模型共用同一组 Base URL,仅按协议切换路径(
/v1/chat/completions、/v1/responses、/v1/messages);OpenAI 兼容路径使用 Authorization: Bearer,Anthropic 路径使用 x-api-key。model 为平台模型名:
model 填写 TokenHub 提供的模型标识即可。能力因模型而异:思考模式、工具调用、多模态、缓存及部分采样参数的支持度取决于所使用的具体模型,标准协议中的个别字段可能被忽略或降级,详见对应协议专篇。
思考内容承载方式:OpenAI 兼容路径通过
reasoning_content 返回思维链,Anthropic 路径通过 thinking 内容块返回,开关方式以对应协议专篇为准。usage 字段差异:不同模型返回的
usage(尤其缓存相关 token 明细)字段不完全一致,请以实际返回为准。错误处理
三种协议的错误响应均为 JSON 结构,包含 HTTP 状态码与平台业务错误码。业务错误码采用 6 位数字,前三位与 HTTP 状态码对应(如
400xxx 对应参数错误、401xxx 对应认证问题、429xxx 对应限流)。接入时常见的几类错误:
401002:API Key 无效。请确认 Key 与所用 Base URL 属于同一站点 —— 广州与新加坡为相互独立的站点,API Key 不互通。402xxx:模型服务未开通或额度不足。需先在控制台开通对应模型,与模型是否支持该协议无关。429xxx:触发限流。响应可能携带 Retry-After 头,建议按指数退避重试。流式请求在返回过程中出错时,错误信息会以 SSE 错误帧的形式出现在数据流中间,需在解析流时一并处理。
接入 AI 工具
TokenHub 兼容 OpenAI 与 Anthropic 两套标准协议,因此绝大多数支持自定义模型服务的 AI 编码工具与 Agent 客户端都可以直接接入,无需改造。
接入方式通常只需三步:
1. 在控制台创建 API Key,并开通所需模型。
2. 在工具的配置项(配置文件或环境变量)中,把服务地址指向 TokenHub 的 Base URL —— 使用 OpenAI 协议的工具填
https://tokenhub.tencentmaas.com/v1,使用 Anthropic 协议的工具同样填该地址,由平台按请求路径自动区分。3. 将模型名替换为 模型支持的协议概览 中的
model 参数值,并确认该模型支持工具所使用的协议。不同工具的配置文件位置、环境变量名称与可选参数各有差异,以下为各工具的详细配置步骤:
Codex
OpenCode
OpenClaw
Cursor
Cline
Roo Code
专用指南入口
以上为跨模型的通用说明。各厂商模型的专属参数、版本差异与最佳实践,请查阅对应厂商专篇:
混元调用指南
GLM 调用指南
部分能力有独立专篇,涉及时请一并查阅:
深度思考
联网搜索
批量推理