智谱 AI(GLM 系列) 免费额度
永久免费国内免费模型最多的平台:主定价表 2 个模型真免费(另有老系列 6 个标免费)+ 新用户注册送 2000 万 tokens(分 3 个资源包,90 天有效)。
🌏 国内直连对话RAG图像视频🕐 最后核实 2026-09-07
1免费额度 & 限速(重点)
📦 额度① 主定价表 2 个模型标注「免费」(glm-4.7-flash 文本 / glm-4.6v-flash 多模态)、不限量调用,老系列另有 6 个标「免费」;② 新用户注册送资源包(登录控制台「资源包管理」实测):200 万通用 tokens(适用于所有按 tokens 计费的基础模型)+ 600 万 GLM-4.6V 专用 + 1200 万 GLM-4.5-Air 专用,合计 2000 万 tokens,90 天有效;另送 20 次图片/视频生成 + 100 次搜索调用,同样 90 天。 新用户经邀请链接注册可领 2000万 Tokens 大礼包。
⚡ 限速官方未公示;免费模型并发限制严格(社区实测约 1 并发),以控制台额度页为准
🧠 能力OpenAI 兼容;Embedding-3 向量;GLM-4-Long 支持 1M 上下文(付费);免费模型支持 Thinking 模式/Function Calling/流式输出。
🔁 节奏长期有效 —— 不用盯重置,但官方随时可能收紧
🎁 免费模型清单(4)- glm-4.7-flash(200K 上下文,文本,主定价表标注「免费」,全字段免费)
- glm-4.6v-flash(多模态:图片/视频/文件/文本,主定价表标注「免费」)
- 老系列另有 6 个标注「免费」:glm-4-flash-250414、glm-z1-flash、glm-4v-flash、glm-4.1v-thinking-flash、CogView-3-Flash(生图)、CogVideoX-Flash(生视频)
- 限时免费主力(已实测可用):GLM-5.3 / 5.3-Flash / 5.2 / 5.1、GLM-4.5-Air、GLM-4.6V-FlashX 共 6 个模型,2026-09-01 用 API Key 实调 glm-5.3、glm-4.5-air 均成功且不扣资源包额度——现在注册就能免费用旗舰模型;随时可能恢复收费(GLM-5.3 原价 8 元输入/28 元输出每百万 tokens),页面未标截止日期,仅 GLM-5.3-Flash 标「5折限时两周」
2够用吗?一句话判读
中文场景首选。GLM-5.3 等旗舰限时免费、实测可直接调(不扣赠额),白嫖体验旗舰首选;2 个主表免费模型(+老系列 6 个)适合长期低频使用;2000 万赠额分 3 个包、90 天到期,适合 3 个月内集中把量跑完(GLM-4.5-Air 的 1200 万是最大头)。
3不写代码,怎么把它的免费用起来
这一家提供的是 OpenAI 兼容接口——意思是它可以被直接填进现成的聊天工具,不需要你写任何一行代码。选一个你在用的工具,照着下面三步填就行。
4开发者视角:路径、代码、命令行验证默认折叠 —— 如果你不写代码,上面那一节就够了。这里给的是官方 SDK 用法与命令行自检。
🔑 路径open.bigmodel.cn → 注册(手机号/微信,免实名)→ 控制台「资源包管理」查看赠额 → API Keys 创建密钥
最小可运行代码
from openai import OpenAI
client = OpenAI(api_key="xxx", base_url="https://open.bigmodel.cn/api/paas/v4/")
r = client.chat.completions.create(model="glm-4.7-flash", messages=[{"role":"user","content":"你好"}])
print(r.choices[0].message.content)以上为最小可运行示例(OpenAI 兼容或官方 SDK)。多数客户端会自动补全 /chat/completions,接口地址不要手拼完整路径。
5避坑提醒
⚠️ 上线前必看- 新人 2000 万不是单个包:200 万通用 + 600 万 GLM-4.6V + 1200 万 GLM-4.5-Air,通用额度只有 200 万,大头绑定指定模型
- 资源包 90 天到期(注册日 + 3 个月),到期清零,别囤着不用
- 定价页「限时免费」≠「免费」:GLM-5.x 系列随时可能恢复收费,按永久档规划会翻车
- glm-4.5-flash 已下线,旧 ID 自动路由到 glm-4.7-flash,别再按旧 ID 规划
- 免费模型并发限制严格(社区实测约 1 并发),高并发需求需付费或换平台
🔍 数据时效说明 免费额度、限速随时会变(本页核实于 2026-09-07)。上线 / 量产前请以官方页面为准。
📄 核实出处 2026-09-07 复核:控制台资源包 5 个新用户包全部生效中(200万通用+600万GLM-4.6V+1200万GLM-4.5-Air+20次图/视频+100次搜索);定价页复核主表 2 个「免费」+ 老系列 6 个「免费」+ 限免 6 个均不变;邀请链接经控制台官方「复制邀请链接」按钮复核为同一 icode,无痕态实测新访客落地注册页并显示「新用户免费赠送专享 2000万 tokens体验包」(已登录态访问会弹回控制台,属正常)。(2026-09-01 首测:资源包到账数据 + glm-5.3 / glm-4.5-air API 实调成功) ·
官方页面 6实测:标「免费不限量」的反而调不通
我用同一把真实 Key 发同一类请求,测了三个模型,结果和直觉完全相反:
① 永久免费glm-4.7-flash(主定价表标「免费、不限量」)→ 连续重试 3 次,3 次都是 429,报错 {"code":"1305","message":"该模型当前访问量过大,请您稍后再试"}。
② 限时免费glm-5.3(限免的旗舰,原价 ¥8 入 / ¥28 出每百万 tokens)→ 一次就通,200。
③ 付费对照顺手拿一个明码收费的 glm-4.6 也调了一次 → 同样 200。
这组对照说明两件事
① 429 不是你的 Key、写法或权限问题——同一个 Key 调别的模型是通的;
② 「免费」和「能立刻用上」是两��事。标着永久免费的那个,恰恰是当下最挤的通道。
7为什么会这样:不限量 ≠ 不限并发
原因不难理解,但平台页面不会写出来:「不限量」指的是 token 总量不设上限,不是并发不设上限。
免费档并发槽位被大量用户共享,白天高峰期排队是常态。它便宜,所以挤。
限免旗舰按量计费的通道本身更宽,限免只是把价格暂时归零,没把通道收窄——所以反而更顺畅。
这条结论的实用价值
看到「免费 / 不限量」时,别默认它随时可用。要判断能不能当主力通道,必须真调一次,而且最好在高峰期调。只看定价页会得出错误的容量结论。
8三种用法,三条不同的路
个人低频自用免费档完全够。撞 429 就重试或错峰——它只是排队,不是不可用,连续硬重试反而更难排上,退让几秒再发。
要跑批量 / 高并发别把免费 flash 当主力通道。要么用赠额去调 glm-4.5-Air 或限免旗舰,要么干脆换别家——把免费档用在它擅长的低频场景,比硬扛划算。
要接 Agent免费模型是支持 Function Calling 和流式输出的,但并发受限时工具调用会频繁超时——这是最难受的失败方式(不是报错,是变慢然后再超时)。先小流量试,别一上来就挂生产。
要白嫖旗舰体验限免的 GLM-5.x 系列实测能直接调、且不扣赠额——但它是限时的,页面没标截止日期。可以当场体验,别按它做长期规划。
9报错对照表
| 现象 | 原因 | 怎么办 |
| 429 / code 1305「访问量过大」 | 免费模型并发槽位共享,高峰期排队 | 退让几秒再试,或错峰;不是 Key 有问题 |
| 想确认是不是 Key 的错 | — | 换限免的 glm-5.3 调一次:通了就说明 Key 没问题 |
| 401 / 鉴权失败 | Key 复制不全(智谱 Key 是 id.secret 两段式,容易只复制一半) | 整串重新复制,别漏掉小数点后半段 |
| 模型 ID 不认 / 404 | 用了已下线的旧 ID(如 glm-4.5-flash,现自动路由到 glm-4.7-flash) | 别按旧 ID 规划,以定价页在售 ID 为准 |
| 赠额看着很多,很快用完 | 2000 万里只有 200 万是通用的,其余绑死在指定模型上 | 把要长期跑的活压在通用包上(明细见核验卡片) |