帮你快速理解、总结文档立即下载

Token Plan 企业版专业套餐

最近更新时间:2026-08-21 16:57:45
本文档已由 AI 辅助审校
我的收藏
Token Plan 企业版专业套餐是面向企业及团队的大语言模型 API 按月预付费套餐,采用月度预付费模式,支持自定义月度预算和多 Key 配额分配,并通过积分制统一管理多模型调用额度,帮助企业更灵活地进行预算管控与团队用量分配。

快速开始

已经了解 Token Plan 企业版专业套餐的用户,可以参照 快速入门 指引快速开始。

套餐详情

套餐规格与定价

层级
说明
套餐规格
支持按月自定义购买积分额度,单次购买最低 10 万积分,最终价格及规则请以 控制台 为准。
刊例价
10 万积分售价为 1 千元/月

可用模型

不同地域支持模型如下:
注意:
为持续优化模型服务能力与使用体验,平台套餐内提供的 AI 模型为动态更新的模型库,可能根据模型性能、服务稳定性、合规要求、授权状况及第三方模型供应情况等进行新增、替换、版本升级、可用范围调整或逐步下线。套餐所提供的是“可使用平台当期模型库中相应模型”的服务,而非对任一特定模型的持续、固定或永久提供作出承诺。用户在订阅时所见的模型仅代表当时的可用情况,实际可用模型、版本及调用范围以购买页、控制台展示及平台公告为准。对可能影响已订阅用户使用的模型下线或重大调整,平台将通过公告、站内信或控制台提示等合理方式提前告知。
广州
新加坡
Model Name
Model ID
备注
Auto
auto
-
GLM-5.3
glm-5.3
glm-5-3
-
GLM-5.2
glm-5.2
glm-5-2
-
GLM-5
glm-5
glm-5-0
-
GLM-5.1
glm-5.1
glm-5-1
-
GLM-5-Turbo
glm-5-turbo
-
Kimi K2.7 Code
kimi-k2.7-code
-
Kimi K2.7 Code HighSpeed
kimi-k2.7-code-highspeed
-
Kimi-K2.5
即将下线
kimi-k2.5
kimi-k-2-5
将于2026年8月31日下线。
Kimi-K2.6
kimi-k2.6
kimi-k-2-6
-
MiniMax-M2.7
minimax-m2.7
minimax-m-2-7
-
MiniMax-M3
minimax-m3
minimax-m-3-0
-
DeepSeek-V4-Flash
deepseek-v4-flash
-
DeepSeek-V4-Pro
deepseek-v4-pro
-
DeepSeek-V4-Flash 正式版 原厂直供
deepseek-v4-flash-202605
deepseek/deepseek-v4-flash-0731
deepseek/deepseek-v4-flash
由 DeepSeek 直接提供的 DeepSeek V4 Flash 正式版模型服务,TokenHub 不对该服务提供 SLA 保障。使用该模型即视为您已知晓并同意遵守 DeepSeek 的服务协议,请您在使用前务必仔细阅读相关内容,如不接受上述内容,请立即停止使用。DeepSeek-V4-Flash 正式版专为高并发与低延迟设计的生产级利器,以 1M 上下文为全系标配,Agent 能力大幅增强,基准测试远超 V4-Pro-Preview。版本说明:DeepSeek-V4-Flash 正式版对应深度求索 DeepSeek-V4-Flash-0731 正式版,API 调用方式不变,model 调用参数设置为 deepseek-v4-flash-202605 即可使用最新版本。原本使用 DeepSeek-V4-Flash(model:deepseek-v4-flash-202605)的用户,平台将自动完成静默升级,无需任何操作即可体验新能力。
DeepSeek-V4-Pro 正式版 原厂直供
deepseek-v4-pro-202606
deepseek/deepseek-v4-pro-0813
deepseek/deepseek-v4-pro
由 DeepSeek 直接提供的 DeepSeek V4 Pro 正式版模型服务,TokenHub 不对该服务提供 SLA 保障。使用该模型即视为您已知晓并同意遵守 DeepSeek 的服务协议,请您在使用前务必仔细阅读相关内容,如不接受上述内容,请立即停止使用。版本说明:DeepSeek-V4-Pro 正式版对应深度求索 DeepSeek-V4-Pro-0813 正式版,API 调用方式不变,model 调用参数设置为 deepseek-v4-pro-202606 即可使用最新版本。原本使用 DeepSeek-V4-Pro(model:deepseek-v4-pro-202606)的用户,平台将自动完成静默升级,无需任何操作即可体验新能力。
Model Name
Model ID
备注
Auto 模型
auto
-
GLM-5.3
glm-5.3
glm-5-3
-
GLM-5.2
glm-5.2
glm-5-2
-
MiniMax-M3
minimax-m3
minimax-m-3-0
-
Kimi K2.7 Code
kimi-k2.7-code
-
Kimi K2.7 Code HighSpeed
kimi-k2.7-code-highspeed
-
DeepSeek-V4-Flash
deepseek-v4-flash
-
DeepSeek-V4-Pro
deepseek-v4-pro
-
DeepSeek-V4-Flash 正式版 原厂直供
deepseek-v4-flash-202605
deepseek/deepseek-v4-flash-0731
deepseek/deepseek-v4-flash
由 DeepSeek 直接提供的 DeepSeek V4 Flash 正式版模型服务,TokenHub 不对该服务提供 SLA 保障。使用该模型即视为您已知晓并同意遵守 DeepSeek 的服务协议,请您在使用前务必仔细阅读相关内容,如不接受上述内容,请立即停止使用。DeepSeek-V4-Flash 正式版专为高并发与低延迟设计的生产级利器,以 1M 上下文为全系标配,Agent 能力大幅增强,基准测试远超 V4-Pro-Preview。版本说明:DeepSeek-V4-Flash 正式版对应深度求索 DeepSeek-V4-Flash-0731 正式版,API 调用方式不变,model 调用参数设置为 deepseek-v4-flash-202605 即可使用最新版本。原本使用 DeepSeek-V4-Flash(model:deepseek-v4-flash-202605)的用户,平台将自动完成静默升级,无需任何操作即可体验新能力。
DeepSeek-V4-Pro 正式版 原厂直供
deepseek-v4-pro-202606
deepseek/deepseek-v4-pro-0813
deepseek/deepseek-v4-pro
由 DeepSeek 直接提供的 DeepSeek-V4-Pro 正式版模型服务,TokenHub 不对该服务提供 SLA 保障。使用该模型即视为您已知晓并同意遵守 DeepSeek 的服务协议,请您在使用前务必仔细阅读相关内容,如不接受上述内容,请立即停止使用。版本说明:DeepSeek-V4-Pro 正式版对应深度求索 DeepSeek-V4-Pro-0813 正式版,API 调用方式不变,model 调用参数设置为 deepseek-v4-pro-202606 即可使用最新版本。原本使用 DeepSeek-V4-Pro(model:deepseek-v4-pro-202606)的用户,平台将自动完成静默升级,无需任何操作即可体验新能力。

接入地址

针对不同的地域,平台提供了不同的接入地址,以便于为您提供稳定的接入。默认接入地址如下:
注意:
请根据服务开通的地域选择对应的接口地址,不支持跨地域、跨站点调用服务。
地域
接入地址
资源调度范围
广州
Base URL
兼容 OpenAI 接口协议工具:https://tokenhub.tencentmaas.com/plan/v3
兼容 Anthropic 接口协议工具:https://tokenhub.tencentmaas.com/plan/anthropic
完整 URL
兼容 OpenAI 接口协议工具:https://tokenhub.tencentmaas.com/plan/v3/chat/completions
兼容 Anthropic 接口协议工具:https://tokenhub.tencentmaas.com/plan/anthropic/v1/messages
中国大陆
新加坡
Base URL
兼容 OpenAI 接口协议工具:https://tokenhub-intl.tencentmaas.com/plan/v3
兼容 Anthropic 接口协议工具:https://tokenhub-intl.tencentmaas.com/plan/anthropic
完整 URL
兼容 OpenAI 接口协议工具:https://tokenhub-intl.tencentmaas.com/plan/v3/chat/completions
兼容 Anthropic 接口协议工具:https://tokenhub-intl.tencentmaas.com/plan/anthropic/v1/messages
全球

积分抵扣规则

积分是 Token Plan 企业版套餐的用量计费单位,用于量化模型资源的消耗。同一套餐下的所有 API Key 共享该套餐的积分池,按实际调用量实时扣减。

抵扣公式

单次请求的积分消耗 = (缓存命中输入 token 数 × 缓存命中输入价 + 未命中缓存输入 token 数 × 未命中缓存输入价 + 输出 token 数 × 输出价) / 1,000,000

积分抵扣价

不同地域的积分抵扣价存在差异,具体如下。为帮助用户直观评估“一定积分能买多少 token”,平台基于 2026 年 6 月运营经验值进行综合单价及可抵扣 token 数测算,可参见“预估值”列。
说明:
预估值测算说明:
本测算结果仅作为企业预算规划的参考依据,不代表实际可使用 token 数量。实际积分消耗及可使用 token 数,将受真实业务场景中的缓存命中率、输入/输出 Token 比例、模型混合使用情况及实时定价规则影响,最终以实际调用结果为准,请注意实际积分消耗。
综合单价计算公式
综合单价 = (缓存命中率 × 命中缓存输入价 + (1 - 缓存命中率)× 未命中缓存输入价)× 输入占比 + 输出价 × 输出占比
其中:
缓存命中率:基于各模型历史运营数据计算,并已内置于综合单价测算中;
输入占比:20/21;
输出占比:1/21;
页面展示价格如存在四舍五入处理,可能导致测算结果与按公式计算结果存在轻微差异。
广州
新加坡
模型
条件
命中缓存输入价
(积分/百万 tokens)
未命中缓存输入价
(积分/百万 tokens)
输出价
(积分/百万 tokens)
预估值
综合单价预估
(积分/百万 tokens)
50 万积分预估可抵扣 token 数
(亿 tokens)
100 万积分预估可抵扣 token 数
(亿 tokens)
Auto 智能路由
-
50
324
1596
约 185
约 27.03
约 54.05
GLM-5.3
-
200
800
2800
约 387
约 12.92
约 25.84
GLM-5.2
-
200
800
2800
约 387
约 12.92
约 25.84
GLM-5
输入 tokens [0, 32k)
100
400
1800
约 272
约 18.38
约 36.76
输入 tokens 32k+
150
600
2200
约 385
约 12.99
约 25.97
GLM-5.1
输入 tokens [0, 32k)
130
600
2400
约 314
约 15.92
约 31.85
输入 tokens 32k+
200
800
2800
约 421
约 11.88
约 23.75
GLM-5-Turbo
输入 tokens [0, 32k)
120
500
2200
约 273
约 18.32
约 36.63
输入 tokens 32k+
180
700
2600
约 370
约 13.51
约 27.03
Kimi K2.7 Code
-
130
650
2700
约 282
约 17.73
约 35.46
Kimi K2.7 Code HighSpeed
-
260
1300
5400
约 822
约 6.08
约 12.17
Kimi-K2.5
即将下线
-
70
400
2100
约 230
约 21.74
约 43.48
Kimi-K2.6
-
110
650
2700
约 276
约 18.12
约 36.23
MiniMax-M2.7
-
42
210
840
约 99
约 50.51
约 101.01
MiniMax-M3
输入 tokens [0, 512k)
42
210
840
约 93
约 53.76
约 107.53
输入 tokens 512k+
84
420
1680
约 186
约 26.88
约 53.76
DeepSeek-V4-Flash
-
20
100
200
约 61
约 81.97
约 163.93
DeepSeek-V4-Pro
-
100
1200
2400
约 513
约 9.75
约 19.49
注意:
DeepSeek-V4 正式版 原厂直供 模型已上线。同时,为了更合理地配置资源、提升服务稳定性,我们跟随原厂同步调整模型定价策略,引入峰谷定价机制,空闲时段价格为高峰时段价格的一半,高峰时段为北京时间 9:00-12:00 和 14:00-18:00(其余为空闲时段)。新积分抵价将于北京时间 2026 年 8 月 17 日 00:00 开始生效。
峰谷时段判定规则:计费时段按请求发起时刻所处的时段判定。即在高峰时段发起的请求,全程按高峰价格计费;在空闲时段发起的请求,全程按空闲价格计费,不受请求实际完成时间影响。

模型
条件
命中缓存输入价
(积分/百万 tokens)
未命中缓存输入价
(积分/百万 tokens)
输出价
(积分/百万 tokens)
预估值
综合单价预估
(积分/百万 tokens)
50 万积分预估可抵扣 token 数
(亿 tokens)
100 万积分预估可抵扣 token 数
(亿 tokens)
DeepSeek-V4-Flash 0731 正式版 原厂直供
空闲时段
5
150
450
约 52
约 96.15
约 192.31
高峰时段
10
300
900
约 105
约 47.62
约 95.24
DeepSeek-V4-Pro 0813 正式版
原厂直供
空闲时段
15
450
1350
约 128
约 39.06
约 78.13
高峰时段
30
900
2700
约 257
约 19.46
约 38.91
模型
条件
命中缓存输入价
(积分/百万 tokens)
未命中缓存输入价
(积分/百万 tokens)
输出价
(积分/百万 tokens)
预估值
综合单价预估
(积分/百万 tokens)
50 万积分预估可抵扣 token 数
(亿 tokens)
100 万积分预估可抵扣 token 数
(亿 tokens)
Auto 模型
-
50.4
324
1596
约 185
约 27.03
约 54.05
GLM-5.3
-
187.1116
1007.524
3166.504
约 415
约 12.05
约 24.10
GLM-5.2
-
190.44
1025.4
3222.82
约 422
约 11.85
约 23.70
MiniMax-M3
输入 tokens [0, 512k)
42
210
840
约 93
约 53.76
约 107.53
输入 tokens 512k+
84
420
1680
约 186
约 26.88
约 53.76
DeepSeek-V4-Flash
-
20
100
200
约 61
约 81.97
约 163.93
DeepSeek-V4-Pro
-
100
1200
2400
约 513
约 9.75
约 19.49
Kimi K2.7 Code
-
130
650
2700
约 282
约 17.73
约 35.46
Kimi K2.7 Code HighSpeed
-
260
1300
5400
约 822
约 6.08
约 12.17
注意:
DeepSeek-V4 正式版 原厂直供 模型已上线。同时,为了更合理地配置资源、提升服务稳定性,我们跟随原厂同步调整模型定价策略,引入峰谷定价机制,空闲时段价格为高峰时段价格的一半,高峰时段为北京时间 9:00-12:00 和 14:00-18:00(其余为空闲时段)。新积分抵价于北京时间 2026 年 8 月 17 日 00:00 开始生效。
峰谷时段判定规则:计费时段按请求发起时刻所处的时段判定。即在高峰时段发起的请求,全程按高峰价格计费;在空闲时段发起的请求,全程按空闲价格计费,不受请求实际完成时间影响。

模型
条件
命中缓存输入价
(积分/百万 tokens)
未命中缓存输入价
(积分/百万 tokens)
输出价
(积分/百万 tokens)
预估值
综合单价预估
(积分/百万 tokens)
50 万积分预估可抵扣 token 数
(亿 tokens)
100 万积分预估可抵扣 token 数
(亿 tokens)
DeepSeek-V4-Flash 正式版 原厂直供
空闲时段
5
150
450
约 52
约 96.15
约 192.31
高峰时段
10
300
900
约 105
约 47.62
约 95.24
DeepSeek-V4-Pro 正式版
原厂直供
空闲时段
15
450
1350
约 128
约 39.06
约 78.13
高峰时段
30
900
2700
约 257
约 19.46
约 38.91

购买须知

类别
说明
购买说明
Token Plan 企业版套餐一经购买开通,即刻生效,请尽快创建 API Key 并开始使用。
额度说明
每月订阅额度仅限当月使用,未消耗额度不结转至次月。
续费说明
请在套餐过期前完成续费,否则,API Key 将失效,使用该 API Key 的工具/应用/服务将立即无法调用大模型服务。详情请参见 续费指南

配额与限制

配额

配额
说明
API Key 创建数量
每个套餐下可创建多个 API Key,每个套餐包每 1 万积分可创建 1 个 API Key。
API Key 配置修改次数
每个 API Key 每日最多可修改 10 次。

限制

Token Plan 企业版专业套餐不支持降配。
Token Plan 企业版专业套餐一经购买不支持退订。

更多操作

更多操作请参见 操作指南