帮你快速理解、总结文档立即下载

Token Plan 企业版专业套餐

最近更新时间:2026-08-31 21:42:04
本文档已由 AI 辅助审校
我的收藏
Token Plan 企业版专业套餐是面向企业及团队的大语言模型 API 按月预付费套餐,采用月度预付费模式,支持自定义月度预算和多 Key 配额分配,并通过积分制统一管理多模型调用额度,帮助企业更灵活地进行预算管控与团队用量分配。

快速开始

已经了解 Token Plan 企业版专业套餐的用户,可以参照 快速入门 指引快速开始。

套餐详情

套餐规格与定价

层级
说明
套餐规格
支持按月自定义购买积分额度,单次购买最低 5 万积分,最终价格及规则请以 控制台 为准。
刊例价
5 万积分售价为 500 元/月

购买须知

类别
说明
购买说明
Token Plan 企业版套餐一经购买开通,即刻生效,请尽快创建 API Key 并开始使用。
额度说明
在月度计费周期内未使用的积分,将在该计费周期结束时作废,且无法结转到后续周期、无法转让,也无法在任何后续周期内兑换。
续费说明
请在套餐过期前完成续费,否则,API Key 将失效,使用该 API Key 的工具/应用/服务将立即无法调用大模型服务。详情请参见 续费指南

可用模型

不同地域支持模型如下:
注意:
为持续优化模型服务能力与使用体验,平台套餐内提供的 AI 模型为动态更新的模型库,可能根据模型性能、服务稳定性、合规要求、授权状况及第三方模型供应情况等进行新增、替换、版本升级、可用范围调整或逐步下线。套餐所提供的是“可使用平台当期模型库中相应模型”的服务,而非对任一特定模型的持续、固定或永久提供作出承诺。用户在订阅时所见的模型仅代表当时的可用情况,实际可用模型、版本及调用范围以购买页、控制台展示及平台公告为准。对可能影响已订阅用户使用的模型下线或重大调整,平台将通过公告、站内信或控制台提示等合理方式提前告知。
广州
新加坡
Model Name
Model ID
备注
Auto
auto
-
GLM-5.3
glm-5.3
glm-5-3
-
GLM-5.2
glm-5.2
glm-5-2
-
GLM-5
glm-5
glm-5-0
-
GLM-5.1
glm-5.1
glm-5-1
-
GLM-5-Turbo
glm-5-turbo
-
Kimi K2.7 Code
kimi-k2.7-code
-
Kimi K2.7 Code HighSpeed
kimi-k2.7-code-highspeed
-
Kimi-K2.6
kimi-k2.6
kimi-k-2-6
-
MiniMax-M2.7
minimax-m2.7
minimax-m-2-7
-
MiniMax-M3
minimax-m3
minimax-m-3-0
-
DeepSeek-V4-Flash
deepseek-v4-flash
-
DeepSeek-V4-Pro
deepseek-v4-pro
-
DeepSeek-V4-Flash 0731 正式版
deepseek-v4-flash-0731
-
DeepSeek-V4-Pro 0813 正式版
deepseek-v4-pro-0813
-
DeepSeek-V4-Flash 正式版 原厂直供
deepseek-v4-flash-202605
deepseek/deepseek-v4-flash-0731
deepseek/deepseek-v4-flash
由 DeepSeek 直接提供的 DeepSeek V4 Flash 正式版模型服务,TokenHub 不对该服务提供 SLA 保障。使用该模型即视为您已知晓并同意遵守 DeepSeek 的服务协议,请您在使用前务必仔细阅读相关内容,如不接受上述内容,请立即停止使用。DeepSeek-V4-Flash 正式版专为高并发与低延迟设计的生产级利器,以 1M 上下文为全系标配,Agent 能力大幅增强,基准测试远超 V4-Pro-Preview。版本说明:DeepSeek-V4-Flash 正式版对应深度求索 DeepSeek-V4-Flash-0731 正式版,API 调用方式不变,model 调用参数设置为 deepseek-v4-flash-202605 即可使用最新版本。原本使用 DeepSeek-V4-Flash(model:deepseek-v4-flash-202605)的用户,平台将自动完成静默升级,无需任何操作即可体验新能力。
DeepSeek-V4-Pro 正式版 原厂直供
deepseek-v4-pro-202606
deepseek/deepseek-v4-pro-0813
deepseek/deepseek-v4-pro
由 DeepSeek 直接提供的 DeepSeek V4 Pro 正式版模型服务,TokenHub 不对该服务提供 SLA 保障。使用该模型即视为您已知晓并同意遵守 DeepSeek 的服务协议,请您在使用前务必仔细阅读相关内容,如不接受上述内容,请立即停止使用。版本说明:DeepSeek-V4-Pro 正式版对应深度求索 DeepSeek-V4-Pro-0813 正式版,API 调用方式不变,model 调用参数设置为 deepseek-v4-pro-202606 即可使用最新版本。原本使用 DeepSeek-V4-Pro(model:deepseek-v4-pro-202606)的用户,平台将自动完成静默升级,无需任何操作即可体验新能力。
DeepSeek-V4-Flash-Vision-Exp 原厂直供
deepseek/deepseek-v4-flash-vision-exp
由 DeepSeek 直接提供的 DeepSeek-V4-Flash-Vision-Exp模型服务,TokenHub 不对该服务提供 SLA 保障。使用该模型即视为您已知晓并同意遵守 DeepSeek 的服务协议,请您在使用前务必仔细阅读相关内容,如不接受上述内容,请立即停止使用。该模型在纯文本能力上与 V4-Flash 正式版持平,同时大幅补强了视觉理解能力,多模态 Agent 表现接近 Claude Opus-4.8。支持图片描述、OCR、图表分析等任务。
Model Name
Model ID
备注
Auto 模型
auto
-
GLM-5.3
glm-5.3
glm-5-3
-
GLM-5.2
glm-5.2
glm-5-2
-
MiniMax-M3
minimax-m3
minimax-m-3-0
-
Kimi K2.7 Code
kimi-k2.7-code
-
Kimi K2.7 Code HighSpeed
kimi-k2.7-code-highspeed
-
DeepSeek-V4-Flash
deepseek-v4-flash
-
DeepSeek-V4-Pro
deepseek-v4-pro
-
DeepSeek-V4-Flash 0731 正式版
deepseek-v4-flash-0731
-
DeepSeek-V4-Pro 0813 正式版
deepseek-v4-pro-0813
-
DeepSeek-V4-Flash 正式版 原厂直供
deepseek-v4-flash-202605
deepseek/deepseek-v4-flash-0731
deepseek/deepseek-v4-flash
由 DeepSeek 直接提供的 DeepSeek V4 Flash 正式版模型服务,TokenHub 不对该服务提供 SLA 保障。使用该模型即视为您已知晓并同意遵守 DeepSeek 的服务协议,请您在使用前务必仔细阅读相关内容,如不接受上述内容,请立即停止使用。DeepSeek-V4-Flash 正式版专为高并发与低延迟设计的生产级利器,以 1M 上下文为全系标配,Agent 能力大幅增强,基准测试远超 V4-Pro-Preview。版本说明:DeepSeek-V4-Flash 正式版对应深度求索 DeepSeek-V4-Flash-0731 正式版,API 调用方式不变,model 调用参数设置为 deepseek-v4-flash-202605 即可使用最新版本。原本使用 DeepSeek-V4-Flash(model:deepseek-v4-flash-202605)的用户,平台将自动完成静默升级,无需任何操作即可体验新能力。
DeepSeek-V4-Pro 正式版 原厂直供
deepseek-v4-pro-202606
deepseek/deepseek-v4-pro-0813
deepseek/deepseek-v4-pro
由 DeepSeek 直接提供的 DeepSeek-V4-Pro 正式版模型服务,TokenHub 不对该服务提供 SLA 保障。使用该模型即视为您已知晓并同意遵守 DeepSeek 的服务协议,请您在使用前务必仔细阅读相关内容,如不接受上述内容,请立即停止使用。版本说明:DeepSeek-V4-Pro 正式版对应深度求索 DeepSeek-V4-Pro-0813 正式版,API 调用方式不变,model 调用参数设置为 deepseek-v4-pro-202606 即可使用最新版本。原本使用 DeepSeek-V4-Pro(model:deepseek-v4-pro-202606)的用户,平台将自动完成静默升级,无需任何操作即可体验新能力。
DeepSeek-V4-Flash-Vision-Exp 原厂直供
deepseek/deepseek-v4-flash-vision-exp
由 DeepSeek 直接提供的 DeepSeek-V4-Flash-Vision-Exp模型服务,TokenHub 不对该服务提供 SLA 保障。使用该模型即视为您已知晓并同意遵守 DeepSeek 的服务协议,请您在使用前务必仔细阅读相关内容,如不接受上述内容,请立即停止使用。该模型在纯文本能力上与 V4-Flash 正式版持平,同时大幅补强了视觉理解能力,多模态 Agent 表现接近 Claude Opus-4.8。支持图片描述、OCR、图表分析等任务。

接入地址

针对不同的地域,平台提供了不同的接入地址,以便于为您提供稳定的接入。默认接入地址如下:
注意:
请根据服务开通的地域选择对应的接口地址,不支持跨地域、跨站点调用服务。
地域
接入地址
资源调度范围
广州
Base URL
兼容 OpenAI 接口协议工具:https://tokenhub.tencentmaas.com/plan/v3
兼容 Anthropic 接口协议工具:https://tokenhub.tencentmaas.com/plan/anthropic
完整 URL
兼容 OpenAI 接口协议工具:https://tokenhub.tencentmaas.com/plan/v3/chat/completions
兼容 Anthropic 接口协议工具:https://tokenhub.tencentmaas.com/plan/anthropic/v1/messages
中国大陆
新加坡
Base URL
兼容 OpenAI 接口协议工具:https://tokenhub-intl.tencentmaas.com/plan/v3
兼容 Anthropic 接口协议工具:https://tokenhub-intl.tencentmaas.com/plan/anthropic
完整 URL
兼容 OpenAI 接口协议工具:https://tokenhub-intl.tencentmaas.com/plan/v3/chat/completions
兼容 Anthropic 接口协议工具:https://tokenhub-intl.tencentmaas.com/plan/anthropic/v1/messages
全球

积分抵扣规则

积分是 Token Plan 企业版套餐的用量计费单位,用于量化模型资源的消耗。同一套餐下的所有 API Key 共享该套餐的积分池,按实际调用量实时扣减。

抵扣公式

单次请求的积分消耗 = (缓存命中输入 token 数 × 缓存命中输入价 + 未命中缓存输入 token 数 × 未命中缓存输入价 + 输出 token 数 × 输出价) / 1,000,000

积分抵扣价

不同地域的积分抵扣价存在差异,具体如下。为帮助用户直观评估“一定积分能买多少 token”,平台基于 2026 年 6 月运营经验值进行综合单价及可抵扣 token 数测算,可参见“预估值”列。
说明:
预估值测算说明:
本测算结果仅作为企业预算规划的参考依据,不代表实际可使用 token 数量。实际积分消耗及可使用 token 数,将受真实业务场景中的缓存命中率、输入/输出 Token 比例、模型混合使用情况及实时定价规则影响,最终以实际调用结果为准,请注意实际积分消耗。
综合单价计算公式
综合单价 = (缓存命中率 × 命中缓存输入价 + (1 - 缓存命中率)× 未命中缓存输入价)× 输入占比 + 输出价 × 输出占比
其中:
缓存命中率:基于各模型历史运营数据计算,并已内置于综合单价测算中;
输入占比:20/21;
输出占比:1/21;
页面展示价格如存在四舍五入处理,可能导致测算结果与按公式计算结果存在轻微差异。
广州
新加坡
模型
条件
命中缓存输入价
(积分/百万 tokens)
未命中缓存输入价
(积分/百万 tokens)
输出价
(积分/百万 tokens)
预估值
综合单价预估
(积分/百万 tokens)
50 万积分预估可抵扣 token 数
(亿 tokens)
100 万积分预估可抵扣 token 数
(亿 tokens)
Auto 智能路由
-
50
324
1596
约 185
约 27.03
约 54.05
GLM-5.3
-
200
800
2800
约 387
约 12.92
约 25.84
GLM-5.2
-
200
800
2800
约 387
约 12.92
约 25.84
GLM-5
输入 tokens [0, 32k)
100
400
1800
约 272
约 18.38
约 36.76
输入 tokens 32k+
150
600
2200
约 385
约 12.99
约 25.97
GLM-5.1
输入 tokens [0, 32k)
130
600
2400
约 314
约 15.92
约 31.85
输入 tokens 32k+
200
800
2800
约 421
约 11.88
约 23.75
GLM-5-Turbo
输入 tokens [0, 32k)
120
500
2200
约 273
约 18.32
约 36.63
输入 tokens 32k+
180
700
2600
约 370
约 13.51
约 27.03
Kimi K2.7 Code
-
130
650
2700
约 282
约 17.73
约 35.46
Kimi K2.7 Code HighSpeed
-
260
1300
5400
约 822
约 6.08
约 12.17
Kimi-K2.6
-
110
650
2700
约 276
约 18.12
约 36.23
MiniMax-M2.7
-
42
210
840
约 99
约 50.51
约 101.01
MiniMax-M3
输入 tokens [0, 512k)
42
210
840
约 93
约 53.76
约 107.53
输入 tokens 512k+
84
420
1680
约 186
约 26.88
约 53.76
DeepSeek-V4-Flash
-
20
100
200
约 61
约 81.97
约 163.93
DeepSeek-V4-Pro
-
100
1200
2400
约 513
约 9.75
约 19.49
注意:
DeepSeek V4【原厂直供】所有模型将跟随原厂调整峰谷计费规则:自北京时间 2026 年 8 月 29 日(周六)00:00 起工作日(周一至周五)继续执行原有峰谷计费(高峰时段为北京时间 9:00–12:00、14:00–18:00,其余为空闲时段);周末(周六、周日)全天不再区分峰谷时段,统一按空闲时段价格计费。
DeepSeek V4 正式版峰谷计费规则:高峰时段为北京时间周一至周日 9:00–12:00、14:00–18:00(其余为空闲时段)。
峰谷时段判定规则:单次请求的计费时段,以平台服务端接收到该请求的时间(北京时间)为准。请求接收时间处于高峰时段的,该次请求按高峰时段价格计费;处于空闲时段的,按空闲时段价格计费。请求的处理时长及返回时间不影响时段判定。

模型
条件
命中缓存输入价
(积分/百万 tokens)
未命中缓存输入价
(积分/百万 tokens)
输出价
(积分/百万 tokens)
预估值
综合单价预估
(积分/百万 tokens)
50 万积分预估可抵扣 token 数
(亿 tokens)
100 万积分预估可抵扣 token 数
(亿 tokens)
DeepSeek-V4-Flash 0731 正式版
空闲时段
5
150
450
约 52
约 96.15
约 192.31
高峰时段
10
300
900
约 105
约 47.62
约 95.24
DeepSeek-V4-Pro 0813 正式版
空闲时段
15
450
1350
约 128
约 39.06
约 78.13
高峰时段
30
900
2700
约 257
约 19.46
约 38.91
DeepSeek-V4-Flash 0731 正式版 原厂直供
空闲时段
5
150
450
约 52
约 96.15
约 192.31
高峰时段
10
300
900
约 105
约 47.62
约 95.24
DeepSeek-V4-Pro 0813 正式版
原厂直供
空闲时段
15
450
1350
约 128
约 39.06
约 78.13
高峰时段
30
900
2700
约 257
约 19.46
约 38.91
DeepSeek-V4-Flash-Vision-Exp 原厂直供
空闲时段
5
150
450
约 47
约 106.38
约 212.77
高峰时段
10
300
900
约 94
约 53.19
约 106.38
模型
条件
命中缓存输入价
(积分/百万 tokens)
未命中缓存输入价
(积分/百万 tokens)
输出价
(积分/百万 tokens)
预估值
综合单价预估
(积分/百万 tokens)
50 万积分预估可抵扣 token 数
(亿 tokens)
100 万积分预估可抵扣 token 数
(亿 tokens)
Auto 模型
-
50.4
324
1596
约 185
约 27.03
约 54.05
GLM-5.3
-
187.1116
1007.524
3166.504
约 415
约 12.05
约 24.10
GLM-5.2
-
190.44
1025.4
3222.82
约 422
约 11.85
约 23.70
MiniMax-M3
输入 tokens [0, 512k)
42
210
840
约 93
约 53.76
约 107.53
输入 tokens 512k+
84
420
1680
约 186
约 26.88
约 53.76
DeepSeek-V4-Flash
-
20
100
200
约 61
约 81.97
约 163.93
DeepSeek-V4-Pro
-
100
1200
2400
约 513
约 9.75
约 19.49
Kimi K2.7 Code
-
130
650
2700
约 282
约 17.73
约 35.46
Kimi K2.7 Code HighSpeed
-
260
1300
5400
约 822
约 6.08
约 12.17
注意:
DeepSeek V4【原厂直供】所有模型将跟随原厂调整峰谷计费规则:自北京时间 2026 年 8 月 29 日(周六)00:00 起工作日(周一至周五)继续执行原有峰谷计费(高峰时段为北京时间 9:00–12:00、14:00–18:00,其余为空闲时段);周末(周六、周日)全天不再区分峰谷时段,统一按空闲时段价格计费。
DeepSeek V4 正式版峰谷计费规则:高峰时段为北京时间周一至周日 9:00–12:00、14:00–18:00(其余为空闲时段)。
峰谷时段判定规则:单次请求的计费时段,以平台服务端接收到该请求的时间(北京时间)为准。请求接收时间处于高峰时段的,该次请求按高峰时段价格计费;处于空闲时段的,按空闲时段价格计费。请求的处理时长及返回时间不影响时段判定。

模型
条件
命中缓存输入价
(积分/百万 tokens)
未命中缓存输入价
(积分/百万 tokens)
输出价
(积分/百万 tokens)
预估值
综合单价预估
(积分/百万 tokens)
50 万积分预估可抵扣 token 数
(亿 tokens)
100 万积分预估可抵扣 token 数
(亿 tokens)
DeepSeek-V4-Flash 0731 正式版
空闲时段
5
150
450
约 52
约 96.15
约 192.31
高峰时段
10
300
900
约 105
约 47.62
约 95.24
DeepSeek-V4-Pro 0813 正式版
空闲时段
15
450
1350
约 128
约 39.06
约 78.13
高峰时段
30
900
2700
约 257
约 19.46
约 38.91
DeepSeek-V4-Flash 正式版 原厂直供
空闲时段
5
150
450
约 52
约 96.15
约 192.31
高峰时段
10
300
900
约 105
约 47.62
约 95.24
DeepSeek-V4-Pro 正式版
原厂直供
空闲时段
15
450
1350
约 128
约 39.06
约 78.13
高峰时段
30
900
2700
约 257
约 19.46
约 38.91
DeepSeek-V4-Flash-Vision-Exp 原厂直供
空闲时段
5
150
450
约 47
约 106.38
约 212.77
高峰时段
10
300
900
约 94
约 53.19
约 106.38

配额与限制

配额

配额
说明
API Key 创建数量
每个套餐下可创建多个 API Key,每个套餐包每 1 万积分可创建 1 个 API Key。
API Key 配置修改次数
每个 API Key 每日最多可修改 10 次。

限制

Token Plan 企业版专业套餐不支持降配。
Token Plan 企业版专业套餐一经购买不支持退订。

更多操作

更多操作请参见 操作指南