TokenHub(腾讯云大模型服务平台) 免费额度
新用户额度腾讯云统一大模型入口,混元与 DeepSeek/GLM/Kimi/MiniMax 等按模型分别领 100 万 Tokens 免费体验。
🌏 国内直连对话RAG图像视频语音🕐 最后核实 2026-09-06
1免费额度 & 限速(重点)
📦 额度登录 TokenHub「启用管理」按模型领取。2026-09-05 登录实测:免费体验可领资源共 46 项(28 语言 + 11 视觉/3D/视频 + 3 多模态 + 4 向量,按主账号维度每项限领一次),已领取资源普遍为每模型 100 万 Tokens、自领取起有效期 1 年(领取时间 2026-09-05,到期 2027-09-05)。图像/语音/部分第三方模型不参与免费领取。以控制台实时显示为准。
⚡ 限速按模型显示;2026-09-05 登录实测:已领取语言与多模态模型多为 TPM 1,000,000 / RPM 60,向量模型为 TPM 1,000,000 / RPM 300,个别模型未显示固定值。
🧠 能力腾讯云统一模型平台,覆盖腾讯混元及 DeepSeek、GLM、Kimi、MiniMax、MiMo 等,兼容 OpenAI / Anthropic 协议;支持文本、视觉、语音、多模态理解、向量、图像、视频与 3D。
🔁 节奏一次性 —— 新用户额度,用光即止,不会回来
🎁 免费模型清单(5)- 语言模型(免费):hy3、hy-role、hy-mt2-pro/plus/lite、glm-5/5.1/5.2/5-turbo、deepseek-v4-flash/pro、kimi-k3/k2.7/k2.6、minimax-m3/m2.7、mimo-v2.5-pro、hunyuan-role-latest 等 28 个
- 视觉/视频/3D(免费):hy-3d-3.0/3.1 及 component/motion/texture/uv 等 3D 系列、yt-video-humanactor(视频)共 11 项
- 多模态理解(免费):hy-vision-2.0-instruct、hunyuan-turbos-vision-video、hunyuan-t1-vision 共 3 个
- 向量模型(免费):kinfra-text-embedding-4b / 0.6b、kinfra-vl-embedding-2b / 8b 共 4 个
- ⚠️ 不支持免费:minimax-video、wand-vega 图像、tripo/hi3d 3D、minimax-speech/music 语音等仅按量计费
2够用吗?一句话判读
腾讯云当前统一入口,46 项免费资源按模型分开发放、总量大。适合一次配置后体验混元与多家主流模型,其中语言模型覆盖最全(28 个免费);注意仅语言/视觉/3D/多模态/向量部分模型免费,语音与图像不参与。
3不写代码,怎么把它的免费用起来
这一家提供的是 OpenAI 兼容接口——意思是它可以被直接填进现成的聊天工具,不需要你写任何一行代码。选一个你在用的工具,照着下面三步填就行。
4开发者视角:路径、代码、命令行验证默认折叠 —— 如果你不写代码,上面那一节就够了。这里给的是官方 SDK 用法与命令行自检。
🔑 路径腾讯云 TokenHub → 启用管理 → 领取免费资源 → 选择模型 → API Key 管理创建密钥
最小可运行代码
from openai import OpenAI
client = OpenAI(api_key="xxx", base_url="https://tokenhub.tencentmaas.com/v1")
r = client.chat.completions.create(model="hy3", messages=[{"role":"user","content":"你好"}])
print(r.choices[0].message.content)以上为最小可运行示例(OpenAI 兼容或官方 SDK)。多数客户端会自动补全 /chat/completions,接口地址不要手拼完整路径。
5避坑提醒
⚠️ 上线前必看- 免费资源按模型领取且每账号每模型限一次,先想清楚要长期用哪些再领
- 额度自领取时起算 1 年(实测 2026-09-05 领取 → 2027-09-05 到期),不要一次领一堆不用的
- 语音(minimax-speech/music 等)与图像(wand-vega 等)、部分视频/3D 模型不支持免费体验,只有按量计费
- 免费额度耗尽后,是否继续计费取决于该模型的按量计费启用状态
- ⚠️ tokenhub.cn 不是腾讯云官方入口;官方控制台位于 console.cloud.tencent.com/tokenhub/
🔍 数据时效说明 免费额度、限速随时会变(本页核实于 2026-09-06)。上线 / 量产前请以官方页面为准。
📄 核实出处 2026-09-06 登录腾讯云 TokenHub「启用管理」逐分类实测:免费体验可领资源 46 项(语言 28 + 视觉/3D/视频 11 + 多模态 3 + 向量 4,账目与页头 0/46 完全吻合);已领取资源普遍每模型 100 万 Tokens、有效期 1 年;语音与部分图像/视频/3D 模型标「不支持」免费、仅按量计费。 ·
官方页面 6最大的坑:能看到的模型 ≠ 免费的模型
⚠️ 126 vs 46
2026-09-13 实测 GET /v1/models 返回 126 个可见模型,但官方「启用管理」页的免费体验资源只有 46 项。
差出来的那 80 个是纯按量计费的——它们照样能被调通,但调一次扣一次钱。
这一点比别家危险得多。普通平台你只会看到免费模型;TokenHub 把付费模型混在同一个列表里,而且模型名看起来一样「官方」——deepseek-v4-pro 和 deepseek-v4-flash 只差一个词,一个收费一个免费。
安全做法先去「启用管理」把要用的免费资源领掉,然后只从已领取的清单里挑模型调用。别直接照着 /models 的返回结果写代码——那是这个平台唯一会让人静默花钱的地方。
7实测:一个 Key 试遍八家厂商
我用同一把 Key、同一个 base_url,把八家不同厂商的代表模型各调了一次,全部 200:混元的 hy3(1.36s)与 hunyuan-role-latest(0.65s)、翻译模型 hy-mt2-pro(1.11s)、智谱 glm-5(1.55s)、DeepSeek deepseek-v4-flash(1.33s)、月之暗面 kimi-k3(1.11s)、MiniMax minimax-m3(1.74s,思考型)、小米 mimo-v2.5-pro(1.71s)。
这才是它真正的价值接一次,等于接八家。想在同一个项目里横向比不同厂商的模型,用它省掉的对接成本比省下的 token 钱更值钱。
延迟参考八家都在 0.65–1.74 秒区间,没有出现某一家长时间卡住的情况。做实时对话够用。
⚠️ 但「调通」证明不了「免费」
账号里有赠额时,付费模型同样返回 200——这一点在本站硅基流动那篇里做过对照实验验证过。所以免费的判据只能是官方「启用管理」页的领取清单,不是「我调了一下能用」。
8三条不写在显眼处的规则
① 领取 ≠ 启用领了资源,模型还是没开通的状态。要在启用管理里把它打开,否则调用直接报未开通/无权限。这一步很多人会漏。
② 有效期各领各算,不是统一到期每个包从自己的领取日起算 1 年(实测 2026-09-05 领 → 2027-09-05 到期)。所以领得早的会先过期,而你以为它们一起到期。
③ 用完可能继续扣费免费额度耗尽后,是否继续计费取决于该模型的按量计费是否开启。不想被扣,就提前把不用的模型停掉。
这三条合起来给一个动作建议:别一次性把能领的都领了。每账号每模型只能领一次,领了就开始走那一年——先想清楚长期要用哪几个,再动手。
9这 46 项最划算的用法
算一下量每模型 100 万 Tokens,按一次问答约 1000 token 算,大约 1000 次。当日常主力几天就没了。
别当主力,当「试驾」它的最佳用途是横向对比和验证某个模型值不值得付费——同一套提示词喂给八家,看谁答得好,再决定给谁花钱。这才是这 46 项资源真正的性价比所在。
限速其实很宽松语言与多模态模型多为 TPM 1,000,000 / RPM 60,向量模型 RPM 300——比多数平台的免费档宽,做批量对比测试不会被限速卡住。
免费档不含什么语音(minimax-speech / music)与图像(wand-vega)以及部分视频 / 3D 模型不参与免费,只能按量计费,别默认「TokenHub 全都能白嫖」。
10报错对照表
| 现象 | 原因 | 怎么办 |
| 调通了,但在扣费 | 该模型不在 46 项免费清单里(126 个可见模型里的大多数) | 回「启用管理」核对领取状态,只调已领取的 |
| 模型未开通 / 无权限 | 只是领了资源但没启用模型 | 在启用管理里把模型打开(领取 ≠ 启用) |
| 免费额度提前失效 | 各包独立的 1 年有效期,早领的早到期 | 去启用管理逐个看包的到期日 |
| 额度莫名变少 / 持续扣费 | 额度耗尽后该模型仍开着按量计费 | 把不用的模型停掉 |
| 语音 / 图像模型要收费 | 这两类不参与免费体验 | 换语言或多模态模型;或接受按量计费 |
| 进了非官方站点 | 访问了 tokenhub.cn | 官方入口只有 console.cloud.tencent.com/tokenhub/ |