免费 API 库 › 七牛云 AI 推理

七牛云 AI 推理 免费额度

新用户额度
注册即领 300 万 Token 通用资源包(建 Key 自动激活),79 个模型一个 Key 全可调,企业认证再送 1200 万。
🌏 国内直连对话RAG代码Agent🕐 最后核实 2026-09-10
通过邀请链接注册七牛云 AI 推理 →
推广链接:注册后可能为本站带来推广收益,不影响你获得的官方服务与价格。

1免费额度 & 限速(重点)

📦 额度2026-09-10 控制台核实:300 万 Token 注册资源包已自动到账(AI推理大模型系列通用计费项/中国大陆/全时段),创建第一个 API Key 即激活;资源包用尽自动转按量计费;活动资源包为融合资源包,按各模型刊例价比例抵扣;不支持批量推理及文生图/视频/ASR/TTS 抵扣。
⚡ 限速官方未公示(Key 日/月限额默认无限)
🧠 能力OpenAI + Anthropic 双协议兼容;List Models 实测 79 个模型,一个 Key 全部可调;含 meituan/longcat-flash-lite 等三方托管模型;支持 MCP 与 Agent 工具接入。
🔁 节奏一次性 —— 新用户额度,用光即止,不会回来
🎁 免费模型清单(3)
  • 300 万 Token 注册资源包:全系列模型通用(DeepSeek-V4 系、GLM-5.3、Kimi-K3、Qwen3.8、混元 Hy4 等均可抵扣)
  • 免费体验模型:z-ai/glm-4.5-air-free(9-10 实测上游 502 暂不可用)
  • 企业认证加送 1200 万 Token

2够用吗?一句话判读

一个 Key 聚合 79 个国产主流模型,300 万 Token 白嫖额度通用不限模型,试模型/做原型最划算的平台之一;注意选小模型省额度。

3不写代码,怎么把它的免费用起来

这一家提供的是 OpenAI 兼容接口——意思是它可以被直接填进现成的聊天工具不需要你写任何一行代码。选一个你在用的工具,照着下面三步填就行。

4开发者视角:路径、代码、命令行验证默认折叠 —— 如果你不写代码,上面那一节就够了。这里给的是官方 SDK 用法与命令行自检。
🔑 路径portal.qiniu.com/ai-inference/api-key → 创建 API Key(名称弹窗填写)
最小可运行代码
from openai import OpenAI
client = OpenAI(api_key="sk-xxx", base_url="https://api.qnaigc.com/v1")
r = client.chat.completions.create(model="deepseek/deepseek-v4-flash", messages=[{"role":"user","content":"你好"}])
print(r.choices[0].message.content)
以上���最小可运行示例(OpenAI 兼容或官方 SDK)。多数客户端会自动补全 /chat/completions,接口地址不要手拼完整路径

5避坑提醒

⚠️ 上线前必看
  • 模型 ID 多带组织前缀(如 deepseek/deepseek-v4-flash),与官方平台名称不同,以 /v1/models 返回为准
  • z-ai/glm-4.5-air-free 实测上游 502,别把免费档当可用依赖
  • 资源包不覆盖批量推理与文生图/视频/ASR/TTS
  • 额度用尽自动按量计费,可设余量预警(财务中心→资源包管理)
  • 邀好友立返 300 万 Token、好友激活再得 300 万,进阶任务最高百亿(s.qiniu.com 邀请链接)
🔍 数据时效说明 免费额度、限速随时会变(本页核实于 2026-09-10)。上线 / 量产前请以官方页面为准。
📄 核实出处 登录控制台实测:资源包管理页 300 万 Token 已到账;创建 Key 拿到明文(sk-8d…50afb)并写入密码库;List Models 返回 79 模型;deepseek/deepseek-v4-flash 实调 200(22 tokens 扣资源包);z-ai/glm-4.5-air-free 502×2 · 官方页面

6一个 Key 管 79 个模型:额度通用,所以「选哪个模型」就是全部策略

注册即到账的 300 万 Token 不绑定模型——DeepSeek-V4 系、GLM-5.3、Kimi-K3、Qwen3.8 都能抵扣。这是它最大的优点,也是最容易被浪费的地方。

本质300 万 token 是个固定的池子,不同模型的消耗速率天差地别。你在选模型的那一刻,就决定了这 300 万能用多久。
实用策略先用小模型把流程跑通、把提示词调好,最后才用大模型跑关键结果。反过来做(一上来就用旗舰试)等于把额度烧在调试上。

另外模型 ID 多带组织前缀(如 deepseek/deepseek-v4-flash),和官方平台上的名字不一样——/v1/models 返回的为准,别照抄别家的模型名。

7标注「免费」的模型,不一定是能用的模型

实测免费体验模型 z-ai/glm-4.5-air-free 连续两次返回上游 502
这条的普适价值 「免费」是关于价格的描述,「可用」是关于稳定性的描述——两者没关系。把免费档写进生产依赖之前,先连续调几次看它稳不稳。一个偶尔 502 的免费模型,比一个稳定的付费模型贵得多(你要花时间做重试和兜底)。

8资源包的三条边界,以及「用尽自动转按量」这个默认行为

① 不覆盖批量推理资源包只用于在线推理,批量推理不在抵扣范围
② 不覆盖多模态生成文生图 / 视频 / ASR / TTS 都不能用资源包抵扣
③ 按刊例价比例抵扣它是融合资源包,按各模型刊例价比例扣——不是「一个 token 换一个 token」。
⚠️ 最需要留意的一条 资源包用尽后会自动转按量计费——不会停下���提醒你。建议去财务中心 → 资源包管理设置余量预警,否则「白嫖」会在某个时刻无声变成账单。

9报错对照表

现象原因怎么办
404 / 模型不存在模型 ID 少了组织前缀/v1/models 返回为准
连不上 / 路径错误base_url 没带 /v1(官方 FAQ 点名的常见错误)https://api.qnaigc.com/v1,别填裸域名
免费体验模型 502上游不可用换模型;别把免费标注当可用依赖
额度突然开始扣钱资源包用尽后自动转按量财务中心设余量预警
批量任务不抵扣资源包不含批量推理与多模态生成批量按量计费,单独算预算