全部文章

2026 国产大模型 API 价格全景:GLM-5.2、DeepSeek、Kimi、MiniMax 一篇看懂

· 定价· GLM· DeepSeek· Kimi· 选型

先给结论。截至 2026 年 6 月,主流国产模型的官方牌价(每百万 token,输入 / 输出,美元)是:

模型输入 / 输出(美元 / 百万 token)缓存输入最适合
GLM-5.2(智谱)$1.40 / $4.40$0.26最强开源权重模型
DeepSeek V4-Pro$0.435 / $0.87最佳性价比
DeepSeek V4-Flash$0.14 / $0.28~$0.014大批量跑量
Kimi K2.6(月之暗面)$0.95 / $4.00$0.16长上下文 agent
MiniMax M2.5~$0.30 / $1.20自动预算型通用

对照闭源前沿:Claude Fable 5 是 $10 / $50,Opus 4.8 是 $5 / $25,GPT-5.5 是 $5 / $30。差距不是一点半点:同样一百万输出 token,Fable 5 收 $50,DeepSeek V4-Pro 收 $0.87,差 57 倍。

这篇接下来讲清楚:每个价位买到的是什么、什么时候便宜的真够用、以及在海外怎么把钱付出去。

这些价格买到了什么

脱离能力谈价格没有意义,所以先看第三方数字。Artificial Analysis 智能指数 v4.1 上,闭源三强是 60(Claude Fable 5)、56(Opus 4.8)、55(GPT-5.5),GLM-5.2 拿 51——综合第四、开源第一。随后是 44 分的 MiniMax-M3 和 DeepSeek V4-Pro、43 分的 Kimi K2.6。

把价格表和分数表放在一起,结论自己会说话:全世界第四聪明的模型,输出 token 只收最聪明那个约 9% 的钱。

单看编程:

  • GLM-5.2:SWE-bench Pro 62.1(跨多文件 GitHub issue),Design Arena 第一,多个长程编程跑分压过 GPT-5.5。详见 GLM-5.2 深度拆解
  • DeepSeek V4-Pro:LiveCodeBench 93.5——全球所有模型里最高,闭源开源都算上——外加 Codeforces 评分 3206。
  • Kimi K2.6:Terminal-Bench 2.0 拿 66.7,这一组里最强的工具调用 / MCP 分数,256K 上下文。

真正影响账单的成本结构

比起表面单价,有三件事对真实账单影响更大:

提示缓存。 GLM-5.2 缓存输入收 $0.26,未缓存 $1.40,约五分之一;Kimi K2.6 更狠:缓存 $0.16 对未缓存 $0.95。如果你的 agent 每轮都重发一大段稳定的 system prompt,缓存就是"账单吓人"和"账单无聊"的分界线。机制详见提示缓存讲解

输出重还是输入重。 DeepSeek V4-Pro 的 $0.87 输出价让它在生成密集型工作(写初稿、吐代码、长答案)上独一档地便宜。GLM-5.2 和 Kimi 的输出价在 $4.00–4.40——仍是闭源的零头,但国产阵营内部也有 5 倍的差距。

路由。 最省的方案从来不是单一模型:大批量分类、抽取给 $0.14 的 V4-Flash,正经活默认 GLM-5.2 或 V4-Pro,极少数值得的任务再上闭源前沿。有 OpenAI 兼容网关,路由器就是三行代码

海外怎么付钱

上面是各家大陆官网牌价,而海外开发者的墙恰恰在这:直接注册通常要中国大陆手机号,付款走支付宝 / 微信。现实的路有三条:

  1. 自己部署开源权重。 GLM-5.2 以 MIT 许可放在 Hugging Face(zai-org/GLM-5.2)。权重免费,但你要付 GPU 和运维时间——上了一定规模才划算。
  2. 用带部分国产模型的西方聚合商。 覆盖面和版本新旧参差。
  3. 用专为这件事做的网关。 Turiloop 是一个 OpenAI 兼容的 API 网关,提供当代国产模型——GLM-5.2、DeepSeek V4、Kimi、MiniMax——和精选前沿模型,按量计费、国际卡支付、不需要中国手机号。你只改一个 base_url,OpenAI SDK 代码原样能跑。各模型实时价格见模型页

常见问题

2026 年最便宜的能用 LLM API 是哪个? DeepSeek V4-Flash,约 $0.14 / $0.28 每百万 token,缓存命中约 $0.014。需要更强推理时,$0.435 / $0.87 的 DeepSeek V4-Pro 是市面最佳性价比。见 Flash 什么时候够用

GLM-5.2 的 API 多少钱? 智谱官方牌价:输入每百万 token $1.40、输出 $4.40,缓存输入 $0.26。约是 GPT-5.5 价格的六分之一,而它在多个编程跑分上赢了 GPT-5.5。

国产模型真比 OpenAI、Anthropic 便宜吗? 是,牌价差 5 到 50 倍。Claude Fable 5 每百万输出 token 收 $50,GLM-5.2 收 $4.40,DeepSeek V4-Pro 收 $0.87。质量差距存在,但远小于价格差距——GLM-5.2 在 Artificial Analysis 指数上离全球第一只差 9 分。

没有中国手机号能用这些模型吗? 能。要么自己部署开源权重,要么用 Turiloop 这样的 OpenAI 兼容网关——上游账号它来管,你用国际卡按量付费。

*以上为 2026 年 6 月 29 日各厂商官方牌价快照,价格变动频繁——本页当参照,以厂商官网为准。*