帮你快速理解、总结文档立即下载

语言模型调用概览

最近更新时间:2026-09-23 22:30:01
本文档已由 AI 辅助审校
我的收藏

概述

TokenHub 平台聚合了腾讯混元、DeepSeek、智谱 GLM、Kimi、MiniMax 等多家厂商的语言模型,覆盖对话交互、内容创作、代码生成、推理分析等场景。所有模型统一兼容 OpenAI Chat Completions API 与 Anthropic Messages API 两种协议,您可以直接使用 OpenAI SDK、Anthropic SDK 或任何兼容客户端接入。

模型支持的协议概览

模型名称
model 参数值
OpenAI Chat Completions
OpenAI Responses
Anthropic
Hy4 preview
hy4-preview
✅
✅
✅
Hy3
hy3
✅
✅
✅
Hy-MT2-Pro
hy-mt2-pro
✅
❌
❌
Hy-MT2-Plus
hy-mt2-plus
✅
❌
❌
Hy-MT2-Lite
hy-mt2-lite
✅
❌
❌
Hy-Role-Latest
hunyuan-role-latest
✅
❌
✅
Hy-Role
hy-role
✅
❌
✅
DeepSeek-V4.1-Flash 原厂直供
deepseek/deepseek-flash
✅
✅
✅
DeepSeek-V4-Flash 0731 正式版 原厂直供
deepseek-v4-flash-202605
deepseek/deepseek-v4-flash-0731
deepseek/deepseek-v4-flash
✅
✅
✅
DeepSeek-V4-Pro 0813 正式版
原厂直供
deepseek-v4-pro-202606
deepseek/deepseek-v4-pro-0813
deepseek/deepseek-v4-pro
✅
✅
✅
DeepSeek-V4-Flash-Vision-Exp 原厂直供
deepseek/deepseek-v4-flash-vision-exp
✅
✅
✅
DeepSeek-V4-Flash 0731 正式版
deepseek-v4-flash-0731
✅
✅*
✅
DeepSeek-V4-Pro 0813 正式版
deepseek-v4-pro-0813
✅
✅*
✅
DeepSeek-V4-Flash
deepseek-v4-flash
✅
✅*
✅
DeepSeek-V4-Pro
deepseek-v4-pro
✅
✅*
✅
GLM-5.3
glm-5.3
✅
✅*
✅
GLM-5.3-Flash
glm-5.3-flash
✅
✅
✅
GLM-5.3-FlashX
glm-5.3-flashx
✅
✅
✅
GLM-5.2
glm-5.2
✅
✅*
✅
GLM-5.1(即将下线)
glm-5.1
✅
✅*
✅
GLM-5V-Turbo(即将下线)
glm-5v-turbo
✅
❌
✅
GLM-5-Turbo(即将下线)
glm-5-turbo
✅
❌
✅
GLM-5(即将下线)
glm-5
✅
❌
✅
Kimi K2.7 Code HighSpeed
kimi-k2.7-code-highspeed
✅
❌
✅
Kimi K3
kimi-k3
✅
✅*
✅
Kimi K2.8 Preview
kimi-k2.8-preview
✅
❌
✅
Kimi K2.7 Code
kimi-k2.7-code
✅
❌
✅
Kimi-K2.6
kimi-k2.6
✅
✅*
✅
MiniMax-M3
minimax-m3
✅
✅
✅
MiniMax-M2.7
minimax-m2.7
✅
✅
✅
Qwen3.5-Flash
qwen3.5-flash
✅
✅
✅
Qwen3.5-Plus
qwen3.5-plus
✅
✅
✅
MiMo-V2.6-Pro
mimo-v2.6-pro
✅
✅
✅
MiMo-V2.6-Flash
mimo-v2.6-flash
✅
✅
✅
MiMo-V2.5-Pro
mimo-v2.5-pro
✅
✅*
✅
说明:
✅ 表示原生支持;✅* 表示通过兼容模式支持 —— 模型原生仅提供 Chat Completions 协议,由平台在服务端自动完成协议转换,调用方式与原生支持的模型一致,但部分参数与内置工具存在限制,详见 Responses API 兼容模式说明。
表中模型需在控制台开通对应的模型服务后才可调用。未开通时调用会返回 402 错误,与模型本身是否支持该协议无关。
平台模型会持续更新,最新的可用模型列表可通过 GET /v1/models 接口查询,返回结果中 status 为 online 的即为当前可用模型。

协议与调用方式

TokenHub 对客户端统一提供三种业界标准协议,所有模型均通过同一组 Base URL 接入,仅需切换协议路径与 model(三种协议均为 POST 请求):
协议
路径
适用 SDK
说明
OpenAI Chat Completions
/v1/chat/completions
OpenAI SDK 及兼容客户端
最通用,覆盖全部模型
OpenAI Responses
/v1/responses
OpenAI SDK(Responses 接口)
面向多类型输入与内置工具的新接口,支持模型有限
Anthropic Messages
/v1/messages
Anthropic SDK 及兼容客户端
Claude 风格协议,兼容 DeepSeek 等模型

Base URL
(按接入地域二选一)
广州:https://tokenhub.tencentmaas.com/v1
新加坡:https://tokenhub-intl.tencentmaas.com/v1
认证方式(按调用协议设置请求头)
OpenAI Chat / Responses 路径:Authorization: Bearer YOUR_API_KEY
Anthropic Messages 路径:x-api-key: YOUR_API_KEY
各协议的完整字段说明与调用示例请参见以下文档:

TokenHub 相对标准 API 的变化

TokenHub 对客户端保持三种标准协议的原生语义,同一份 OpenAI / Anthropic SDK 代码通常只需替换 Base URL、API Key 与 model 即可接入。相较各协议官方标准,主要差异集中在以下方面:
统一入口与鉴权:所有模型共用同一组 Base URL,仅按协议切换路径(/v1/chat/completions、/v1/responses、/v1/messages);OpenAI 兼容路径使用 Authorization: Bearer,Anthropic 路径使用 x-api-key。
model 为平台模型名:model 填写 TokenHub 提供的模型标识即可。
能力因模型而异:思考模式、工具调用、多模态、缓存及部分采样参数的支持度取决于所使用的具体模型,标准协议中的个别字段可能被忽略或降级,详见对应协议专篇。
思考内容承载方式:OpenAI 兼容路径通过 reasoning_content 返回思维链,Anthropic 路径通过 thinking 内容块返回,开关方式以对应协议专篇为准。
usage 字段差异:不同模型返回的 usage(尤其缓存相关 token 明细)字段不完全一致,请以实际返回为准。
各协议逐字段的差异标注与调用示例,请以上文 协议与调用方式 中的三篇协议专篇为准。

错误处理

三种协议的错误响应均为 JSON 结构,包含 HTTP 状态码与平台业务错误码。业务错误码采用 6 位数字,前三位与 HTTP 状态码对应(如 400xxx 对应参数错误、401xxx 对应认证问题、429xxx 对应限流)。
完整的错误码列表、含义与处理建议,请参见 API 错误码说明。
接入时常见的几类错误:
401002:API Key 无效。请确认 Key 与所用 Base URL 属于同一站点 —— 广州与新加坡为相互独立的站点,API Key 不互通。
402xxx:模型服务未开通或额度不足。需先在控制台开通对应模型,与模型是否支持该协议无关。
429xxx:触发限流。响应可能携带 Retry-After 头,建议按指数退避重试。
流式请求在返回过程中出错时,错误信息会以 SSE 错误帧的形式出现在数据流中间,需在解析流时一并处理。

接入 AI 工具

TokenHub 兼容 OpenAI 与 Anthropic 两套标准协议,因此绝大多数支持自定义模型服务的 AI 编码工具与 Agent 客户端都可以直接接入,无需改造。
接入方式通常只需三步:
1. 在控制台创建 API Key,并开通所需模型。
2. 在工具的配置项(配置文件或环境变量)中,把服务地址指向 TokenHub 的 Base URL —— 使用 OpenAI 协议的工具填 https://tokenhub.tencentmaas.com/v1,使用 Anthropic 协议的工具同样填该地址,由平台按请求路径自动区分。
3. 将模型名替换为 模型支持的协议概览 中的 model 参数值,并确认该模型支持工具所使用的协议。
不同工具的配置文件位置、环境变量名称与可选参数各有差异,以下为各工具的详细配置步骤:
Codex
OpenCode
OpenClaw
Cursor
Cline
Roo Code
Kilo Code
WorkBuddy

专用指南入口

以上为跨模型的通用说明。各厂商模型的专属参数、版本差异与最佳实践,请查阅对应厂商专篇:
部分能力有独立专篇,涉及时请一并查阅: