填一个月的输入 / 输出 tokens,按价格库里已核验的官方单价,直接算出 9 家平台 65 个通用模型的月账单并排名 —— 先算账,再选型。
三档常见用量的静态算账结果 —— 不想填数字就先看这里。表格只列成本最低的 6 个付费模型,免费模型单列。
每天几十轮对话、写作与翻译,输入偏多;月用量:输入 400 万 tokens / 输出 150 万 tokens,缓存命中率 20%。下表为成本最低的 6 个付费模型:
| 名次 | 模型 | 输入 元/百万 | 输出 元/百万 | 月成本估算 |
|---|---|---|---|---|
| 1 | doubao-seed-2.0-mini 火山方舟(豆包 · 字节) | 0.2 | 2 | ¥3.80 |
| 2 | Hunyuan-a13b 腾讯混元 | 0.5 | 2 | ¥5.00 |
| 3 | doubao-seed-2.1-lite 火山方舟(豆包 · 字节) | 0.8 | 2.7 | ¥6.74 |
| 4 | GLM-5.3-Flash 智谱 AI(GLM) | 0.8 | 2.8 | ¥6.94 |
| 5 | glm-5.3-flash(方舟托管) 火山方舟(豆包 · 字节) | 0.8 | 2.8 | ¥6.94 |
| 6 | GLM-5.3-Flash 百度千帆(文心) | 0.8 | 2.8 | ¥6.94 |
另有 2 个免费模型(GLM-4.7-Flash、Spark Lite)在本场景下成本为 ¥0。
每周批量处理长文档、翻译与摘要,几乎没有重复上下文;月用量:输入 2,000 万 tokens / 输出 600 万 tokens,缓存命中率 0%。下表为成本最低的 6 个付费模型:
| 名次 | 模型 | 输入 元/百万 | 输出 元/百万 | 月成本估算 |
|---|---|---|---|---|
| 1 | doubao-seed-2.0-mini 火山方舟(豆包 · 字节) | 0.2 | 2 | ¥16.00 |
| 2 | Hunyuan-a13b 腾讯混元 | 0.5 | 2 | ¥22.00 |
| 3 | DeepSeek-V4-Flash 七牛云 AI(模型广场) | 1 | 2 | ¥32.00 |
| 4 | DeepSeek-V4-Flash 腾讯云 TokenHub | 1 | 2 | ¥32.00 |
| 5 | doubao-seed-2.1-lite 火山方舟(豆包 · 字节) | 0.8 | 2.7 | ¥32.20 |
| 6 | GLM-5.3-Flash 智谱 AI(GLM) | 0.8 | 2.8 | ¥32.80 |
另有 2 个免费模型(GLM-4.7-Flash、Spark Lite)在本场景下成本为 ¥0。
每轮重复发送大段上下文(缓存命中高),缓存价差距会放大;月用量:输入 8,000 万 tokens / 输出 800 万 tokens,缓存命中率 70%。下表为成本最低的 6 个付费模型:
| 名次 | 模型 | 输入 元/百万 | 输出 元/百万 | 月成本估算 |
|---|---|---|---|---|
| 1 | doubao-seed-2.0-mini 火山方舟(豆包 · 字节) | 0.2 | 2 | ¥32.00 |
| 2 | doubao-seed-2.1-lite 火山方舟(豆包 · 字节) | 0.8 | 2.7 | ¥49.76 |
| 3 | GLM-5.3-Flash 智谱 AI(GLM) | 0.8 | 2.8 | ¥54.48 |
| 4 | glm-5.3-flash(方舟托管) 火山方舟(豆包 · 字节) | 0.8 | 2.8 | ¥54.48 |
| 5 | GLM-5.3-Flash 百度千帆(文心) | 0.8 | 2.8 | ¥54.48 |
| 6 | Hunyuan-a13b 腾讯混元 | 0.5 | 2 | ¥56.00 |
另有 2 个免费模型(GLM-4.7-Flash、Spark Lite)在本场景下成本为 ¥0。
不少模型是多家平台托管同一款(如 GLM、DeepSeek、Kimi 在智谱官方和各家云平台上都有)。价格并不总是相同 —— 下表按「输入+输出」综合价(元/百万 tokens,输入输出 1:1)对比:
| 模型 | 平台数 | 最高 / 最低 | 各家价格(输入/输出) |
|---|---|---|---|
| deepseek-v4-flash | 4 家 | 差 4.00 倍 | 七牛云 AI 1/2 · 腾讯云 TokenHub 1/2 · 火山方舟 3/9 · 百度千帆 3/9 |
| DeepSeek-V3.2 | 2 家 | 差 1.25 倍 | 七牛云 AI 1.008/3 · 腾讯云 TokenHub 2/3 |
| GLM-5.3 | 2 家 | 价格一致 | 智谱 AI 8/28 · 百度千帆 8/28 |
| GLM-5.3-Flash | 3 家 | 价格一致 | 智谱 AI 0.8/2.8 · 火山方舟 0.8/2.8 · 百度千帆 0.8/2.8 |
| GLM-5.2 | 3 家 | 价格一致 | 智谱 AI 8/28 · 火山方舟 8/28 · 百度千帆 8/28 |
| GLM-5.1 | 4 家 | 价格一致 | 智谱 AI 6/24 · 百度千帆 6/24 · 七牛云 AI 6/24 · 腾讯云 TokenHub 6/24 |
| kimi-k2.6 | 4 家 | 价格一致 | Kimi 开放平台 6.5/27 · 百度千帆 6.5/27 · 七牛云 AI 6.5/27 · 腾讯云 TokenHub 6.5/27 |
| deepseek-v4-pro | 4 家 | 价格一致 | 火山方舟 9/27 · 百度千帆 9/27 · 七牛云 AI 12/24 · 腾讯云 TokenHub 12/24 |
| Qwen3.5-397B-A17B | 2 家 | 价格一致 | 百度千帆 1.2/7.2 · 七牛云 AI 1.2/7.2 |
| GLM-5 | 2 家 | 价格一致 | 七牛云 AI 4/18 · 腾讯云 TokenHub 4/18 |
| MiniMax-M2.5 | 2 家 | 价格一致 | 七牛云 AI 2.1/8.4 · 腾讯云 TokenHub 2.1/8.4 |
| MiniMax-M2.7 | 2 家 | 价格一致 | 七牛云 AI 2.1/8.4 · 腾讯云 TokenHub 2.1/8.4 |
读法:同一款模型,选对平台可能省掉大半成本;价格一致的说明上游有统一价格约束,此时选谁看稳定性、并发与生态。核验日期 2026-09-24。
① 用满缓存:缓存命中价通常只有输入价的 10%–30%。Agent、长系统提示词场景把稳定不变的部分放前面,缓存命中率上去后账单可能差好几倍 —— 上面的滑块拉到 70% 再算一次就明白了;
② 看忙闲时段:部分平台有分时价(闲时约五折,如百度千帆 DeepSeek 系列 22:00–8:00、腾讯云 TokenHub 峰谷定价)。批量任务排到闲时跑;
③ 控上下文长度:分段计费模型(价格标「起」的那些)输入越长单价越高,长上下文场景先确认自己落在哪一档;
④ 同款比价:同一款模型换个平台可能就是几倍差价(见上表),选型前先比一遍。
① 单价全部来自 价格库(官方定价页逐条核验,核验日期 2026-09-24),本站不推算、不补数字;
② 计算取标准在线推理价,不含 Batch 折扣、限时活动与免费额度;分段计费模型按首档单价估算,长上下文实际会更高;
③ 缓存命中率指输入中命中缓存的比例,未标缓存价的模型按输入价计算(即不打折,属保守估算);
④ 9 个模型未参与排名:GLM-4.6V-Flash、GLM-4.6V-FlashX、GLM-OCR、GLM-TTS、ERNIE-4.5-Turbo-VL-32K、Tencent HY Vision 1.5 Instruct、Hunyuan-embedding、Spark Ultra、Spark Pro —— 它们按字符/图像等非 token 单位计费,或官方未分列输入输出价(见 价格库 明细);
⑤ 估算值用于选型比较,实际账单以各平台结算为准。
想算哪家、哪个场景的成本?加我微信告诉我。