🧮 我的用量到底要花多少钱

AI 成本算账器,按月算给你看

填一个月的输入 / 输出 tokens,按价格库里已核验的官方单价,直接算出 9 家平台 65 个通用模型的月账单并排名 —— 先算账,再选型

📌 单价核验 2026-09-24 · 单位 元 / 百万 tokens(另有标注者除外) · 口径见页尾

① 填你的月用量

② 三个典型场景,谁最省(预置结果)

三档常见用量的静态算账结果 —— 不想填数字就先看这里。表格只列成本最低的 6 个付费模型,免费模型单列。

场景 A · 个人问答助手

每天几十轮对话、写作与翻译,输入偏多;月用量:输入 400 万 tokens / 输出 150 万 tokens,缓存命中率 20%。下表为成本最低的 6 个付费模型

名次模型输入
元/百万
输出
元/百万
月成本估算
1doubao-seed-2.0-mini
火山方舟(豆包 · 字节)
0.22¥3.80
2Hunyuan-a13b
腾讯混元
0.52¥5.00
3doubao-seed-2.1-lite
火山方舟(豆包 · 字节)
0.82.7¥6.74
4GLM-5.3-Flash
智谱 AI(GLM)
0.82.8¥6.94
5glm-5.3-flash(方舟托管)
火山方舟(豆包 · 字节)
0.82.8¥6.94
6GLM-5.3-Flash
百度千帆(文心)
0.82.8¥6.94

另有 2 个免费模型(GLM-4.7-Flash、Spark Lite)在本场景下成本为 ¥0

场景 B · 团队文档处理

每周批量处理长文档、翻译与摘要,几乎没有重复上下文;月用量:输入 2,000 万 tokens / 输出 600 万 tokens,缓存命中率 0%。下表为成本最低的 6 个付费模型

名次模型输入
元/百万
输出
元/百万
月成本估算
1doubao-seed-2.0-mini
火山方舟(豆包 · 字节)
0.22¥16.00
2Hunyuan-a13b
腾讯混元
0.52¥22.00
3DeepSeek-V4-Flash
七牛云 AI(模型广场)
12¥32.00
4DeepSeek-V4-Flash
腾讯云 TokenHub
12¥32.00
5doubao-seed-2.1-lite
火山方舟(豆包 · 字节)
0.82.7¥32.20
6GLM-5.3-Flash
智谱 AI(GLM)
0.82.8¥32.80

另有 2 个免费模型(GLM-4.7-Flash、Spark Lite)在本场景下成本为 ¥0

场景 C · Agent 重度使用

每轮重复发送大段上下文(缓存命中高),缓存价差距会放大;月用量:输入 8,000 万 tokens / 输出 800 万 tokens,缓存命中率 70%。下表为成本最低的 6 个付费模型

名次模型输入
元/百万
输出
元/百万
月成本估算
1doubao-seed-2.0-mini
火山方舟(豆包 · 字节)
0.22¥32.00
2doubao-seed-2.1-lite
火山方舟(豆包 · 字节)
0.82.7¥49.76
3GLM-5.3-Flash
智谱 AI(GLM)
0.82.8¥54.48
4glm-5.3-flash(方舟托管)
火山方舟(豆包 · 字节)
0.82.8¥54.48
5GLM-5.3-Flash
百度千帆(文心)
0.82.8¥54.48
6Hunyuan-a13b
腾讯混元
0.52¥56.00

另有 2 个免费模型(GLM-4.7-Flash、Spark Lite)在本场景下成本为 ¥0

④ 同款模型,换个平台差多少

不少模型是多家平台托管同一款(如 GLM、DeepSeek、Kimi 在智谱官方和各家云平台上都有)。价格并不总是相同 —— 下表按「输入+输出」综合价(元/百万 tokens,输入输出 1:1)对比:

模型平台数最高 / 最低各家价格(输入/输出)
deepseek-v4-flash4 家差 4.00 倍七牛云 AI 1/2 · 腾讯云 TokenHub 1/2 · 火山方舟 3/9 · 百度千帆 3/9
DeepSeek-V3.22 家差 1.25 倍七牛云 AI 1.008/3 · 腾讯云 TokenHub 2/3
GLM-5.32 家价格一致智谱 AI 8/28 · 百度千帆 8/28
GLM-5.3-Flash3 家价格一致智谱 AI 0.8/2.8 · 火山方舟 0.8/2.8 · 百度千帆 0.8/2.8
GLM-5.23 家价格一致智谱 AI 8/28 · 火山方舟 8/28 · 百度千帆 8/28
GLM-5.14 家价格一致智谱 AI 6/24 · 百度千帆 6/24 · 七牛云 AI 6/24 · 腾讯云 TokenHub 6/24
kimi-k2.64 家价格一致Kimi 开放平台 6.5/27 · 百度千帆 6.5/27 · 七牛云 AI 6.5/27 · 腾讯云 TokenHub 6.5/27
deepseek-v4-pro4 家价格一致火山方舟 9/27 · 百度千帆 9/27 · 七牛云 AI 12/24 · 腾讯云 TokenHub 12/24
Qwen3.5-397B-A17B2 家价格一致百度千帆 1.2/7.2 · 七牛云 AI 1.2/7.2
GLM-52 家价格一致七牛云 AI 4/18 · 腾讯云 TokenHub 4/18
MiniMax-M2.52 家价格一致七牛云 AI 2.1/8.4 · 腾讯云 TokenHub 2.1/8.4
MiniMax-M2.72 家价格一致七牛云 AI 2.1/8.4 · 腾讯云 TokenHub 2.1/8.4

读法:同一款模型,选对平台可能省掉大半成本;价格一致的说明上游有统一价格约束,此时选谁看稳定性、并发与生态。核验日期 2026-09-24。

③ 省钱的四招(账单上真能看出来的)

用满缓存:缓存命中价通常只有输入价的 10%–30%。Agent、长系统提示词场景把稳定不变的部分放前面,缓存命中率上去后账单可能差好几倍 —— 上面的滑块拉到 70% 再算一次就明白了;
看忙闲时段:部分平台有分时价(闲时约五折,如百度千帆 DeepSeek 系列 22:00–8:00、腾讯云 TokenHub 峰谷定价)。批量任务排到闲时跑;
控上下文长度:分段计费模型(价格标「起」的那些)输入越长单价越高,长上下文场景先确认自己落在哪一档;
同款比价:同一款模型换个平台可能就是几倍差价(见上表),选型前先比一遍。

算账口径(数字怎么来的)

① 单价全部来自 价格库(官方定价页逐条核验,核验日期 2026-09-24),本站不推算、不补数字
② 计算取标准在线推理价,不含 Batch 折扣、限时活动与免费额度;分段计费模型按首档单价估算,长上下文实际会更高;
③ 缓存命中率指输入中命中缓存的比例,未标缓存价的模型按输入价计算(即不打折,属保守估算);
9 个模型未参与排名:GLM-4.6V-Flash、GLM-4.6V-FlashX、GLM-OCR、GLM-TTS、ERNIE-4.5-Turbo-VL-32K、Tencent HY Vision 1.5 Instruct、Hunyuan-embedding、Spark Ultra、Spark Pro —— 它们按字符/图像等非 token 单位计费,或官方未分列输入输出价(见 价格库 明细);
⑤ 估算值用于选型比较,实际账单以各平台结算为准。

加我微信

想算哪家、哪个场景的成本?加我微信告诉我。

免费算力个人微信二维码
💡 个人微信号,添加时请备注「免费算力」。