帮你快速理解、总结文档立即下载

语言模型调用概览

最近更新时间:2026-08-14 13:02:00
本文档已由 AI 辅助审校
我的收藏

概述

TokenHub 平台聚合了腾讯混元、DeepSeek、智谱 GLM、Kimi、MiniMax 等多家厂商的语言模型,覆盖对话交互、内容创作、代码生成、推理分析等场景。所有模型统一兼容 OpenAI Chat Completions APIAnthropic Messages API 两种协议,您可以直接使用 OpenAI SDK、Anthropic SDK 或任何兼容客户端接入。

模型支持的协议概览

模型名称
model 参数值
OpenAI Chat Completions
OpenAI Responses
Anthropic
Hy3
hy3
Hy3 preview(2026-08-31下线)
hy3-preview
Hy-MT2-Pro
hy-mt2-pro
Hy-MT2-Plus
hy-mt2-plus
Hy-MT2-Lite
hy-mt2-lite
Hy-Role-Latest
hunyuan-role-latest
Hy-Role
hy-role
DeepSeek-V4-Flash 0731 正式版 原厂直供
deepseek-v4-flash-202605
DeepSeek-V4-Pro 0813 正式版
原厂直供
deepseek-v4-pro-202606
DeepSeek-V4-Flash
deepseek-v4-flash
✅*
DeepSeek-V4-Pro
deepseek-v4-pro
✅*
GLM-5.3
glm-5.3
✅*
GLM-5.2
glm-5.2
✅*
GLM-5.1
glm-5.1
✅*
GLM-5V-Turbo
glm-5v-turbo
GLM-5-Turbo
glm-5-turbo
GLM-5
glm-5
Kimi K2.7 Code HighSpeed
kimi-k2.7-code-highspeed
Kimi K3
kimi-k3
✅*
Kimi K2.7 Code
kimi-k2.7-code
Kimi-K2.6
kimi-k2.6
✅*
Kimi-K2.5
kimi-k2.5
✅*
MiniMax-M3
minimax-m3
MiniMax-M2.7
minimax-m2.7
Qwen3.5-Flash
qwen3.5-flash
Qwen3.5-Plus
qwen3.5-plus
MiMo-V2.5-Pro
mimo-v2.5-pro
✅*
说明:
表示原生支持;✅* 表示通过兼容模式支持 —— 模型原生仅提供 Chat Completions 协议,由平台在服务端自动完成协议转换,调用方式与原生支持的模型一致,但部分参数与内置工具存在限制,详见 Responses API 兼容模式说明
表中模型需在控制台开通对应的模型服务后才可调用。未开通时调用会返回 402 错误,与模型本身是否支持该协议无关。
平台模型会持续更新,最新的可用模型列表可通过 GET /v1/models 接口查询,返回结果中 statusonline 的即为当前可用模型。

协议与调用方式

TokenHub 对客户端统一提供三种业界标准协议,所有模型均通过同一组 Base URL 接入,仅需切换协议路径与 model(三种协议均为 POST 请求):
协议
路径
适用 SDK
说明
OpenAI Chat Completions
/v1/chat/completions
OpenAI SDK 及兼容客户端
最通用,覆盖全部模型
OpenAI Responses
/v1/responses
OpenAI SDK(Responses 接口)
面向多类型输入与内置工具的新接口,支持模型有限
Anthropic Messages
/v1/messages
Anthropic SDK 及兼容客户端
Claude 风格协议,兼容 DeepSeek 等模型
Base URL(按接入地域二选一)
广州:https://tokenhub.tencentmaas.com/v1
新加坡:https://tokenhub-intl.tencentmaas.com/v1
认证方式(按调用协议设置请求头)
OpenAI Chat / Responses 路径:Authorization: Bearer YOUR_API_KEY
Anthropic Messages 路径:x-api-key: YOUR_API_KEY
各协议的完整字段说明与调用示例请参见以下文档:

TokenHub 相对标准 API 的变化

TokenHub 对客户端保持三种标准协议的原生语义,同一份 OpenAI / Anthropic SDK 代码通常只需替换 Base URL、API Key 与 model 即可接入。相较各协议官方标准,主要差异集中在以下方面:
统一入口与鉴权:所有模型共用同一组 Base URL,仅按协议切换路径(/v1/chat/completions/v1/responses/v1/messages);OpenAI 兼容路径使用 Authorization: Bearer,Anthropic 路径使用 x-api-key
model 为平台模型名model 填写 TokenHub 提供的模型标识即可。
能力因模型而异:思考模式、工具调用、多模态、缓存及部分采样参数的支持度取决于所使用的具体模型,标准协议中的个别字段可能被忽略或降级,详见对应协议专篇。
思考内容承载方式:OpenAI 兼容路径通过 reasoning_content 返回思维链,Anthropic 路径通过 thinking 内容块返回,开关方式以对应协议专篇为准。
usage 字段差异:不同模型返回的 usage(尤其缓存相关 token 明细)字段不完全一致,请以实际返回为准。
各协议逐字段的差异标注与调用示例,请以上文 协议与调用方式 中的三篇协议专篇为准。

错误处理

三种协议的错误响应均为 JSON 结构,包含 HTTP 状态码与平台业务错误码。业务错误码采用 6 位数字,前三位与 HTTP 状态码对应(如 400xxx 对应参数错误、401xxx 对应认证问题、429xxx 对应限流)。
完整的错误码列表、含义与处理建议,请参见 API 错误码说明
接入时常见的几类错误:
401002:API Key 无效。请确认 Key 与所用 Base URL 属于同一站点 —— 广州与新加坡为相互独立的站点,API Key 不互通。
402xxx:模型服务未开通或额度不足。需先在控制台开通对应模型,与模型是否支持该协议无关。
429xxx:触发限流。响应可能携带 Retry-After 头,建议按指数退避重试。
流式请求在返回过程中出错时,错误信息会以 SSE 错误帧的形式出现在数据流中间,需在解析流时一并处理。

接入 AI 工具

TokenHub 兼容 OpenAI 与 Anthropic 两套标准协议,因此绝大多数支持自定义模型服务的 AI 编码工具与 Agent 客户端都可以直接接入,无需改造。
接入方式通常只需三步:
1. 在控制台创建 API Key,并开通所需模型。
2. 在工具的配置项(配置文件或环境变量)中,把服务地址指向 TokenHub 的 Base URL —— 使用 OpenAI 协议的工具填 https://tokenhub.tencentmaas.com/v1,使用 Anthropic 协议的工具同样填该地址,由平台按请求路径自动区分。
3. 将模型名替换为 模型支持的协议概览 中的 model 参数值,并确认该模型支持工具所使用的协议。
不同工具的配置文件位置、环境变量名称与可选参数各有差异,以下为各工具的详细配置步骤:
Codex
OpenCode
OpenClaw
Cursor
Cline
Roo Code
Kilo Code
WorkBuddy

专用指南入口

以上为跨模型的通用说明。各厂商模型的专属参数、版本差异与最佳实践,请查阅对应厂商专篇:
部分能力有独立专篇,涉及时请一并查阅: