主流平台的输入 / 缓存命中 / 输出单价,全部来自官方定价页并标注核验日期。做预算、做选型、算成本 —— 先看这里的数字,再看别处的说法。
能力最强 / 综合均衡档;价格为官方定价页标准在线推理价。
| 模型 | 上下文 | 输入 元/百万 tokens | 缓存命中 | 输出 | 备注 |
|---|---|---|---|---|---|
| GLM-5.3 智谱 AI(GLM) | 1M | 8 | 2 | 28 | |
| GLM-5.3-Flash 智谱 AI(GLM) | 1M | 0.8 | 0.23 | 2.8 | 限时五折:输入 0.4 / 缓存命中 0.115 / 输出 1.4 |
| GLM-5.2 智谱 AI(GLM) | 1M | 8 | 2 | 28 | |
| GLM-5.1 智谱 AI(GLM) | 1M | 6 起 | 1.3 起 | 24 起 | |
| kimi-k3 Kimi 开放平台(月之暗面) | 1,048,576 | 20 | 2 | 100 | 缓存写入 TTL 5min ¥20 / 1h ¥40 |
| kimi-k2.6 Kimi 开放平台(月之暗面) | 262,144 | 6.5 | 1.1 | 27 | |
| doubao-seed-evolving 火山方舟(豆包 · 字节) | 1M+ | 6 | 1.2 | 30 | |
| doubao-seed-2.1-pro 火山方舟(豆包 · 字节) | 1M+ | 6 | 1.2 | 30 | |
| doubao-seed-2.1-turbo 火山方舟(豆包 · 字节) | 256K | 3 | 0.6 | 15 | |
| doubao-seed-2.0-pro 火山方舟(豆包 · 字节) | 256K | 3.2 起 | 0.64 起 | 16 起 | |
| deepseek-v4-pro 火山方舟(豆包 · 字节) | — | 9 | 0.3 | 27 | |
| glm-5.2(方舟托管) 火山方舟(豆包 · 字节) | — | 8 | 2 | 28 | |
| qwen3.8-max 阿里云百炼(千问) | 1M | 12 | — | 36 | 含 100 万 Token 免费额度(90 天) |
| qwen3.8-max-prime 阿里云百炼(千问) | 1M | 24 | — | 72 | 优速模式,无免费额度 |
| qwen3.7-max 阿里云百炼(千问) | 1M | 12 | — | 36 | |
| qwen3.6-max-preview 阿里云百炼(千问) | 256K | 9 起 | — | 54 起 | |
| qwen3-max 阿里云百炼(千问) | 256K | 2.5 起 | — | 10 起 | |
| qwen-max 阿里云百炼(千问) | 32K | 2.4 | — | 9.6 | |
| ERNIE-5.1 百度千帆(文心) | 128K | 4 起 | — | 18 起 | |
| ERNIE-5.0 百度千帆(文心) | 128K | 6 起 | — | 24 起 | |
| ERNIE-4.5-Turbo-VL-32K 百度千帆(文心) | 32K | 3 | 0.75 | 9 | 视觉理解 |
| GLM-5.3 百度千帆(文心) | 200K | 8 | 2 | 28 | 国庆价 4.8 / 16.8(至 10-07) |
| GLM-5.2 百度千帆(文心) | 200K | 8 | 2 | 28 | |
| GLM-5.1 百度千帆(文心) | 200K | 6 起 | — | 24 起 | |
| Kimi-K2.6(千帆托管) 百度千帆(文心) | 256K | 6.5 | 1.1 | 27 | |
| DeepSeek-V4-Pro-0813 百度千帆(文心) | — | 9 | 0.9 | 27 | |
| Qwen3.5-397B-A17B 百度千帆(文心) | 256K | 1.2 起 | — | 7.2 起 | |
| Hunyuan-role-latest 腾讯混元 | — | 2.4 | — | 9.6 | |
| Tencent HY Vision 1.5 Instruct 腾讯混元 | — | 3 | — | 9 | 视觉 |
| DeepSeek-V4-Pro 七牛云 AI(模型广场) | 1M | 12 | — | 24 | |
| GLM-5 七牛云 AI(模型广场) | — | 4 | — | 18 | |
| GLM-5.1 七牛云 AI(模型广场) | — | 6 | — | 24 | |
| Kimi-K2.6 七牛云 AI(模型广场) | 256K | 6.5 | — | 27 | |
| Qwen3.5-397B-A17B 七牛云 AI(模型广场) | 256K | 1.2 | — | 7.2 | |
| MiniMax-M2.5-Highspeed 七牛云 AI(模型广场) | — | 4.2 | — | 16.8 | 高 TPS 版本 |
| DeepSeek-V4-Pro 腾讯云 TokenHub | — | 12 | 1 | 24 | |
| DeepSeek-V3.1 腾讯云 TokenHub | — | 4 | — | 12 | |
| GLM-5 腾讯云 TokenHub | — | 4 起 | 1 起 | 18 起 | |
| GLM-5.1 腾讯云 TokenHub | — | 6 起 | 1.3 起 | 24 起 | |
| Kimi-K2.6 腾讯云 TokenHub | — | 6.5 | 1.1 | 27 | |
| Kimi-K2.5 腾讯云 TokenHub | — | 4 | 0.7 | 21 | |
| Spark Pro 讯飞星火(Spark) | 128K | 5 | — | — | 官方页面标注 5 元/百万 tokens,未标明输入/输出分项 |
高性价比档与代码专用模型 —— 日常高频调用优先看这一档。
| 模型 | 上下文 | 输入 元/百万 tokens | 缓存命中 | 输出 | 备注 |
|---|---|---|---|---|---|
| GLM-4.6V-FlashX 智谱 AI(GLM) | 128K | 0.15 起 | — | 1.5 起 | |
| GLM-OCR 智谱 AI(GLM) | 32K | 0.2 | — | 0.2 | 专业 OCR 模型,按百万 tokens 计 |
| kimi-k2.7-code Kimi 开放平台(月之暗面) | 262,144 | 6.5 | 1.3 | 27 | |
| kimi-k2.7-code-highspeed Kimi 开放平台(月之暗面) | 262,144 | 13 | 2.6 | 54 | 高速版,价格为标准版约 2 倍 |
| doubao-seed-2.1-lite 火山方舟(豆包 · 字节) | 1M+ | 0.8 | 0.16 | 2.7 | |
| doubao-seed-2.0-mini 火山方舟(豆包 · 字节) | 256K | 0.2 起 | — | 2 起 | |
| doubao-seed-2.0-code 火山方舟(豆包 · 字节) | 256K | 3.2 起 | — | 16 起 | |
| deepseek-v4-flash 火山方舟(豆包 · 字节) | — | 3 | 0.1 | 9 | |
| deepseek-v4-1-flash 火山方舟(豆包 · 字节) | — | 1 起 | 0.02 起 | 4 起 | 按时段定价 |
| glm-5.3-flash(方舟托管) 火山方舟(豆包 · 字节) | — | 0.8 | 0.23 | 2.8 | |
| ERNIE-4.5-Turbo-32K 百度千帆(文心) | 32K | 0.8 | 0.2 | 3.2 | |
| GLM-5.3-Flash 百度千帆(文心) | 200K | 0.8 | 0.23 | 2.8 | |
| DeepSeek-V4-Flash-0731 百度千帆(文心) | — | 3 起 | — | 9 起 | |
| DeepSeek-V4.1-Flash 百度千帆(文心) | — | 2 起 | — | 8 起 | |
| Hunyuan-a13b 腾讯混元 | — | 0.5 | — | 2 | |
| Hunyuan-translation 腾讯混元 | — | 1.2 | — | 3.6 | 翻译专用 |
| Hunyuan-translation-lite 腾讯混元 | — | 1 | — | 3 | 翻译专用 |
| DeepSeek-V4-Flash 七牛云 AI(模型广场) | 1M | 1 | — | 2 | |
| DeepSeek-V3.2 七牛云 AI(模型广场) | — | 1.008 | — | 3 | 输入为批量推理价;官方标注「即将退役」 |
| Qwen3.6-27B 七牛云 AI(模型广场) | 262K | 2.304 | — | 23.04 | |
| MiniMax-M2.5 七牛云 AI(模型广场) | — | 2.1 | — | 8.4 | |
| MiniMax-M2.7 七牛云 AI(模型广场) | — | 2.1 | — | 8.4 | |
| DeepSeek-V4-Flash 腾讯云 TokenHub | — | 1 | — | 2 | |
| DeepSeek-V3.2 腾讯云 TokenHub | — | 2 | — | 3 | |
| MiniMax-M2.7 腾讯云 TokenHub | — | 2.1 | 0.42 | 8.4 | |
| MiniMax-M2.5 腾讯云 TokenHub | — | 2.1 | 0.21 | 8.4 | |
| Spark Ultra 讯飞星火(Spark) | — | 0.8 | — | — | 官方页面标注 0.8 元/百万 tokens,未标明输入/输出分项 |
输入、输出、缓存全免费;更多免费档(含新用户赠额)见 免费额度库。
| 模型 | 上下文 | 输入 元/百万 tokens | 缓存命中 | 输出 | 备注 |
|---|---|---|---|---|---|
| GLM-4.7-Flash 智谱 AI(GLM) | 200K | 免费 | 免费 | 免费 | 输入/输出/缓存全免费(官方定价页标注) |
| GLM-4.6V-Flash 智谱 AI(GLM) | 128K | 免费 | 免费 | 免费 | 多模态;输入/输出/缓存全免费 |
| Spark Lite 讯飞星火(Spark) | 8K | 免费 | — | 免费 | 官方定位免费模型;另有不限量调用包(需控制台手动领取) |
① 单位统一为元/百万 tokens,与各家官方口径一致;
② 标「起」的是分段计费模型(按输入长度分档,长度越长单价越高),表内为首档价格,分档明细在各家平台页与官方定价页;
③ 缓存命中价通常只有输入价的 10%–30% —— Agent 场景重复发送大段上下文时,这一列的差距会显著放大总成本;
④ 视频/语音/OCR 等非文本模型按各自单位计费(如元/万字符、元/秒),不在此表混排;
⑤ 部分平台另有批量推理 / 低优先级推理价格(约标准价五折),表中为在线标准价。
已核验(9 家):智谱 AI(GLM)、Kimi 开放平台(月之暗面)、火山方舟(豆包 · 字节)、阿里云百炼(千问)、百度千帆(文心)、腾讯混元、七牛云 AI(模型广场)、腾讯云 TokenHub、讯飞星火(Spark)。
采集中:商汤(官方定价页路径待确认)、书生 InternLM、硅基流动(定价页需登录)、StreamLake —— 未完成核验的绝不先填数字,这是本站的规矩(见 方法论)。
核验方式:官方定价页逐条比对,核验日期标注在页面顶部;平台调价后本页会更新,以官方页面为准。
想追哪家的价格?加我微信告诉我。