七牛云 AI 推理 免费额度
新用户额度注册即领 300 万 Token 通用资源包(建 Key 自动激活),79 个模型一个 Key 全可调,企业认证再送 1200 万。
🌏 国内直连对话RAG代码Agent🕐 最后核实 2026-09-10
1免费额度 & 限速(重点)
📦 额度2026-09-10 控制台核实:300 万 Token 注册资源包已自动到账(AI推理大模型系列通用计费项/中国大陆/全时段),创建第一个 API Key 即激活;资源包用尽自动转按量计费;活动资源包为融合资源包,按各模型刊例价比例抵扣;不支持批量推理及文生图/视频/ASR/TTS 抵扣。
⚡ 限速官方未公示(Key 日/月限额默认无限)
🧠 能力OpenAI + Anthropic 双协议兼容;List Models 实测 79 个模型,一个 Key 全部可调;含 meituan/longcat-flash-lite 等三方托管模型;支持 MCP 与 Agent 工具接入。
🔁 节奏一次性 —— 新用户额度,用光即止,不会回来
🎁 免费模型清单(3)- 300 万 Token 注册资源包:全系列模型通用(DeepSeek-V4 系、GLM-5.3、Kimi-K3、Qwen3.8、混元 Hy4 等均可抵扣)
- 免费体验模型:z-ai/glm-4.5-air-free(9-10 实测上游 502 暂不可用)
- 企业认证加送 1200 万 Token
2够用吗?一句话判读
一个 Key 聚合 79 个国产主流模型,300 万 Token 白嫖额度通用不限模型,试模型/做原型最划算的平台之一;注意选小模型省额度。
3不写代码,怎么把它的免费用起来
这一家提供的是 OpenAI 兼容接口——意思是它可以被直接填进现成的聊天工具,不需要你写任何一行代码。选一个你在用的工具,照着下面三步填就行。
4开发者视角:路径、代码、命令行验证默认折叠 —— 如果你不写代码,上面那一节就够了。这里给的是官方 SDK 用法与命令行自检。
🔑 路径portal.qiniu.com/ai-inference/api-key → 创建 API Key(名称弹窗填写)
最小可运行代码
from openai import OpenAI
client = OpenAI(api_key="sk-xxx", base_url="https://api.qnaigc.com/v1")
r = client.chat.completions.create(model="deepseek/deepseek-v4-flash", messages=[{"role":"user","content":"你好"}])
print(r.choices[0].message.content)以上���最小可运行示例(OpenAI 兼容或官方 SDK)。多数客户端会自动补全 /chat/completions,接口地址不要手拼完整路径。
5避坑提醒
⚠️ 上线前必看- 模型 ID 多带组织前缀(如 deepseek/deepseek-v4-flash),与官方平台名称不同,以 /v1/models 返回为准
- z-ai/glm-4.5-air-free 实测上游 502,别把免费档当可用依赖
- 资源包不覆盖批量推理与文生图/视频/ASR/TTS
- 额度用尽自动按量计费,可设余量预警(财务中心→资源包管理)
- 邀好友立返 300 万 Token、好友激活再得 300 万,进阶任务最高百亿(s.qiniu.com 邀请链接)
🔍 数据时效说明 免费额度、限速随时会变(本页核实于 2026-09-10)。上线 / 量产前请以官方页面为准。
📄 核实出处 登录控制台实测:资源包管理页 300 万 Token 已到账;创建 Key 拿到明文(sk-8d…50afb)并写入密码库;List Models 返回 79 模型;deepseek/deepseek-v4-flash 实调 200(22 tokens 扣资源包);z-ai/glm-4.5-air-free 502×2 ·
官方页面 6一个 Key 管 79 个模型:额度通用,所以「选哪个模型」就是全部策略
注册即到账的 300 万 Token 不绑定模型——DeepSeek-V4 系、GLM-5.3、Kimi-K3、Qwen3.8 都能抵扣。这是它最大的优点,也是最容易被浪费的地方。
本质300 万 token 是个固定的池子,不同模型的消耗速率天差地别。你在选模型的那一刻,就决定了这 300 万能用多久。
实用策略先用小模型把流程跑通、把提示词调好,最后才用大模型跑关键结果。反过来做(一上来就用旗舰试)等于把额度烧在调试上。
另外模型 ID 多带组织前缀(如 deepseek/deepseek-v4-flash),和官方平台上的名字不一样——以 /v1/models 返回的为准,别照抄别家的模型名。
7标注「免费」的模型,不一定是能用的模型
实测免费体验模型 z-ai/glm-4.5-air-free 连续两次返回上游 502。
这条的普适价值
「免费」是关于价格的描述,「可用」是关于稳定性的描述——两者没关系。把免费档写进生产依赖之前,先连续调几次看它稳不稳。一个偶尔 502 的免费模型,比一个稳定的付费模型贵得多(你要花时间做重试和兜底)。
8资源包的三条边界,以及「用尽自动转按量」这个默认行为
① 不覆盖批量推理资源包只用于在线推理,批量推理不在抵扣范围。
② 不覆盖多模态生成文生图 / 视频 / ASR / TTS 都不能用资源包抵扣。
③ 按刊例价比例抵扣它是融合资源包,按各模型刊例价比例扣——不是「一个 token 换一个 token」。
⚠️ 最需要留意的一条
资源包用尽后会自动转按量计费——不会停下���提醒你。建议去财务中心 → 资源包管理设置余量预警,否则「白嫖」会在某个时刻无声变成账单。
9报错对照表
| 现象 | 原因 | 怎么办 |
| 404 / 模型不存在 | 模型 ID 少了组织前缀 | 以 /v1/models 返回为准 |
| 连不上 / 路径错误 | base_url 没带 /v1(官方 FAQ 点名的常见错误) | 填 https://api.qnaigc.com/v1,别填裸域名 |
| 免费体验模型 502 | 上游不可用 | 换模型;别把免费标注当可用依赖 |
| 额度突然开始扣钱 | 资源包用尽后自动转按量 | 财务中心设余量预警 |
| 批量任务不抵扣 | 资源包不含批量推理与多模态生成 | 批量按量计费,单独算预算 |