先给结论。截至 2026 年 6 月,主流国产模型的官方牌价(每百万 token,输入 / 输出,美元)是:
| 模型 | 输入 / 输出(美元 / 百万 token) | 缓存输入 | 最适合 |
|---|---|---|---|
| GLM-5.2(智谱) | $1.40 / $4.40 | $0.26 | 最强开源权重模型 |
| DeepSeek V4-Pro | $0.435 / $0.87 | — | 最佳性价比 |
| DeepSeek V4-Flash | $0.14 / $0.28 | ~$0.014 | 大批量跑量 |
| Kimi K2.6(月之暗面) | $0.95 / $4.00 | $0.16 | 长上下文 agent |
| MiniMax M2.5 | ~$0.30 / $1.20 | 自动 | 预算型通用 |
对照闭源前沿:Claude Fable 5 是 $10 / $50,Opus 4.8 是 $5 / $25,GPT-5.5 是 $5 / $30。差距不是一点半点:同样一百万输出 token,Fable 5 收 $50,DeepSeek V4-Pro 收 $0.87,差 57 倍。
这篇接下来讲清楚:每个价位买到的是什么、什么时候便宜的真够用、以及在海外怎么把钱付出去。
这些价格买到了什么
脱离能力谈价格没有意义,所以先看第三方数字。Artificial Analysis 智能指数 v4.1 上,闭源三强是 60(Claude Fable 5)、56(Opus 4.8)、55(GPT-5.5),GLM-5.2 拿 51——综合第四、开源第一。随后是 44 分的 MiniMax-M3 和 DeepSeek V4-Pro、43 分的 Kimi K2.6。
把价格表和分数表放在一起,结论自己会说话:全世界第四聪明的模型,输出 token 只收最聪明那个约 9% 的钱。
单看编程:
- GLM-5.2:SWE-bench Pro 62.1(跨多文件 GitHub issue),Design Arena 第一,多个长程编程跑分压过 GPT-5.5。详见 GLM-5.2 深度拆解。
- DeepSeek V4-Pro:LiveCodeBench 93.5——全球所有模型里最高,闭源开源都算上——外加 Codeforces 评分 3206。
- Kimi K2.6:Terminal-Bench 2.0 拿 66.7,这一组里最强的工具调用 / MCP 分数,256K 上下文。
真正影响账单的成本结构
比起表面单价,有三件事对真实账单影响更大:
提示缓存。 GLM-5.2 缓存输入收 $0.26,未缓存 $1.40,约五分之一;Kimi K2.6 更狠:缓存 $0.16 对未缓存 $0.95。如果你的 agent 每轮都重发一大段稳定的 system prompt,缓存就是"账单吓人"和"账单无聊"的分界线。机制详见提示缓存讲解。
输出重还是输入重。 DeepSeek V4-Pro 的 $0.87 输出价让它在生成密集型工作(写初稿、吐代码、长答案)上独一档地便宜。GLM-5.2 和 Kimi 的输出价在 $4.00–4.40——仍是闭源的零头,但国产阵营内部也有 5 倍的差距。
路由。 最省的方案从来不是单一模型:大批量分类、抽取给 $0.14 的 V4-Flash,正经活默认 GLM-5.2 或 V4-Pro,极少数值得的任务再上闭源前沿。有 OpenAI 兼容网关,路由器就是三行代码。
海外怎么付钱
上面是各家大陆官网牌价,而海外开发者的墙恰恰在这:直接注册通常要中国大陆手机号,付款走支付宝 / 微信。现实的路有三条:
- 自己部署开源权重。 GLM-5.2 以 MIT 许可放在 Hugging Face(zai-org/GLM-5.2)。权重免费,但你要付 GPU 和运维时间——上了一定规模才划算。
- 用带部分国产模型的西方聚合商。 覆盖面和版本新旧参差。
- 用专为这件事做的网关。 Turiloop 是一个 OpenAI 兼容的 API 网关,提供当代国产模型——GLM-5.2、DeepSeek V4、Kimi、MiniMax——和精选前沿模型,按量计费、国际卡支付、不需要中国手机号。你只改一个
base_url,OpenAI SDK 代码原样能跑。各模型实时价格见模型页。
常见问题
2026 年最便宜的能用 LLM API 是哪个? DeepSeek V4-Flash,约 $0.14 / $0.28 每百万 token,缓存命中约 $0.014。需要更强推理时,$0.435 / $0.87 的 DeepSeek V4-Pro 是市面最佳性价比。见 Flash 什么时候够用。
GLM-5.2 的 API 多少钱? 智谱官方牌价:输入每百万 token $1.40、输出 $4.40,缓存输入 $0.26。约是 GPT-5.5 价格的六分之一,而它在多个编程跑分上赢了 GPT-5.5。
国产模型真比 OpenAI、Anthropic 便宜吗? 是,牌价差 5 到 50 倍。Claude Fable 5 每百万输出 token 收 $50,GLM-5.2 收 $4.40,DeepSeek V4-Pro 收 $0.87。质量差距存在,但远小于价格差距——GLM-5.2 在 Artificial Analysis 指数上离全球第一只差 9 分。
没有中国手机号能用这些模型吗? 能。要么自己部署开源权重,要么用 Turiloop 这样的 OpenAI 兼容网关——上游账号它来管,你用国际卡按量付费。
*以上为 2026 年 6 月 29 日各厂商官方牌价快照,价格变动频繁——本页当参照,以厂商官网为准。*