免费 API 库 › 智谱 AI(GLM 系列)

智谱 AI(GLM 系列) 免费额度

永久免费
国内免费模型最多的平台:主定价表 2 个模型真免费(另有老系列 6 个标免费)+ 新用户注册送 2000 万 tokens(分 3 个资源包,90 天有效)。
🌏 国内直连对话RAG图像视频🕐 最后核实 2026-09-07
通过邀请注册链接 →

1免费额度 & 限速(重点)

📦 额度① 主定价表 2 个模型标注「免费」(glm-4.7-flash 文本 / glm-4.6v-flash 多模态)、不限量调用,老系列另有 6 个标「免费」;② 新用户注册送资源包(登录控制台「资源包管理」实测):200 万通用 tokens(适用于所有按 tokens 计费的基础模型)+ 600 万 GLM-4.6V 专用 + 1200 万 GLM-4.5-Air 专用,合计 2000 万 tokens,90 天有效;另送 20 次图片/视频生成 + 100 次搜索调用,同样 90 天。 新用户经邀请链接注册可领 2000万 Tokens 大礼包。
⚡ 限速官方未公示;免费模型并发限制严格(社区实测约 1 并发),以控制台额度页为准
🧠 能力OpenAI 兼容;Embedding-3 向量;GLM-4-Long 支持 1M 上下文(付费);免费模型支持 Thinking 模式/Function Calling/流式输出。
🔁 节奏长期有效 —— 不用盯重置,但官方随时可能收紧
🎁 免费模型清单(4)
  • glm-4.7-flash(200K 上下文,文本,主定价表标注「免费」,全字段免费)
  • glm-4.6v-flash(多模态:图片/视频/文件/文本,主定价表标注「免费」)
  • 老系列另有 6 个标注「免费」:glm-4-flash-250414、glm-z1-flash、glm-4v-flash、glm-4.1v-thinking-flash、CogView-3-Flash(生图)、CogVideoX-Flash(生视频)
  • 限时免费主力(已实测可用):GLM-5.3 / 5.3-Flash / 5.2 / 5.1、GLM-4.5-Air、GLM-4.6V-FlashX 共 6 个模型,2026-09-01 用 API Key 实调 glm-5.3、glm-4.5-air 均成功且不扣资源包额度——现在注册就能免费用旗舰模型;随时可能恢复收费(GLM-5.3 原价 8 元输入/28 元输出每百万 tokens),页面未标截止日期,仅 GLM-5.3-Flash 标「5折限时两周」

2够用吗?一句话判读

中文场景首选。GLM-5.3 等旗舰限时免费、实测可直接调(不扣赠额),白嫖体验旗舰首选;2 个主表免费模型(+老系列 6 个)适合长期低频使用;2000 万赠额分 3 个包、90 天到期,适合 3 个月内集中把量跑完(GLM-4.5-Air 的 1200 万是最大头)。

3不写代码,怎么把它的免费用起来

这一家提供的是 OpenAI 兼容接口——意思是它可以被直接填进现成的聊天工具不需要你写任何一行代码。选一个你在用的工具,照着下面三步填就行。

4开发者视角:路径、代码、命令行验证默认折叠 —— 如果你不写代码,上面那一节就够了。这里给的是官方 SDK 用法与命令行自检。
🔑 路径open.bigmodel.cn → 注册(手机号/微信,免实名)→ 控制台「资源包管理」查看赠额 → API Keys 创建密钥
最小可运行代码
from openai import OpenAI
client = OpenAI(api_key="xxx", base_url="https://open.bigmodel.cn/api/paas/v4/")
r = client.chat.completions.create(model="glm-4.7-flash", messages=[{"role":"user","content":"你好"}])
print(r.choices[0].message.content)
以上为最小可运行示例(OpenAI 兼容或官方 SDK)。多数客户端会自动补全 /chat/completions,接口地址不要手拼完整路径

5避坑提醒

⚠️ 上线前必看
  • 新人 2000 万不是单个包:200 万通用 + 600 万 GLM-4.6V + 1200 万 GLM-4.5-Air,通用额度只有 200 万,大头绑定指定模型
  • 资源包 90 天到期(注册日 + 3 个月),到期清零,别囤着不用
  • 定价页「限时免费」≠「免费」:GLM-5.x 系列随时可能恢复收费,按永久档规划会翻车
  • glm-4.5-flash 已下线,旧 ID 自动路由到 glm-4.7-flash,别再按旧 ID 规划
  • 免费模型并发限制严格(社区实测约 1 并发),高并发需求需付费或换平台
🔍 数据时效说明 免费额度、限速随时会变(本页核实于 2026-09-07)。上线 / 量产前请以官方页面为准。
📄 核实出处 2026-09-07 复核:控制台资源包 5 个新用户包全部生效中(200万通用+600万GLM-4.6V+1200万GLM-4.5-Air+20次图/视频+100次搜索);定价页复核主表 2 个「免费」+ 老系列 6 个「免费」+ 限免 6 个均不变;邀请链接经控制台官方「复制邀请链接」按钮复核为同一 icode,无痕态实测新访客落地注册页并显示「新用户免费赠送专享 2000万 tokens体验包」(已登录态访问会弹回控制台,属正常)。(2026-09-01 首测:资源包到账数据 + glm-5.3 / glm-4.5-air API 实调成功) · 官方页面

6实测:标「免费不限量」的反而调不通

我用同一把真实 Key 发同一类请求,测了三个模型,结果和直觉完全相反:

① 永久免费glm-4.7-flash(主定价表标「免费、不限量」)→ 连续重试 3 次,3 次都是 429,报错 {"code":"1305","message":"该模型当前访问量过大,请您稍后再试"}
② 限时免费glm-5.3(限免的旗舰,原价 ¥8 入 / ¥28 出每百万 tokens)→ 一次就通,200
③ 付费对照顺手拿一个明码收费的 glm-4.6 也调了一次 → 同样 200
这组对照说明两件事 ① 429 不是你的 Key、写法或权限问题——同一个 Key 调别的模型是通的;
「免费」和「能立刻用上」是两��事。标着永久免费的那个,恰恰是当下最挤的通道。

7为什么会这样:不限量 ≠ 不限并发

原因不难理解,但平台页面不会写出来:「不限量」指的是 token 总量不设上限,不是并发不设上限。

免费档并发槽位被大量用户共享,白天高峰期排队是常态。它便宜,所以挤。
限免旗舰按量计费的通道本身更宽,限免只是把价格暂时归零,没把通道收窄——所以反而更顺畅。
这条结论的实用价值 看到「免费 / 不限量」时,别默认它随时可用。要判断能不能当主力通道,必须真调一次,而且最好在高峰期调。只看定价页会得出错误的容量结论。

8三种用法,三条不同的路

个人低频自用免费档完全够。撞 429 就重试或错峰——它只是排队,不是不可用,连续硬重试反而更难排上,退让几秒再发
要跑批量 / 高并发别把免费 flash 当主力通道。要么用赠额去调 glm-4.5-Air 或限免旗舰,要么干脆换别家——把免费档用在它擅长的低频场景,比硬扛划算
要接 Agent免费模型是支持 Function Calling 和流式输出的,但并发受限时工具调用会频繁超时——这是最难受的失败方式(不是报错,是变慢然后再超时)。先小流量试,别一上来就挂生产。
要白嫖旗舰体验限免的 GLM-5.x 系列实测能直接调、且不扣赠额——但它是限时的,页面没标截止日期。可以当场体验,别按它做长期规划。

9报错对照表

现象原因怎么办
429 / code 1305「访问量过大」免费模型并发槽位共享,高峰期排队退让几秒再试,或错峰;不是 Key 有问题
想确认是不是 Key 的错换限免的 glm-5.3 调一次:通了就说明 Key 没问题
401 / 鉴权失败Key 复制不全(智谱 Key 是 id.secret 两段式,容易只复制一半)整串重新复制,别漏掉小数点后半段
模型 ID 不认 / 404用了已下线的旧 ID(如 glm-4.5-flash,现自动路由到 glm-4.7-flash别按旧 ID 规划,以定价页在售 ID 为准
赠额看着很多,很快用完2000 万里只有 200 万是通用的,其余绑死在指定模型上把要长期跑的活压在通用包上(明细见核验卡片)