截至 2026 年 6 月,DeepSeek 官方 API 牌价(每百万 token)是:
- DeepSeek V4-Pro——输入 $0.435 / 输出 $0.87。这是长期价,不是限时促销。
- DeepSeek V4-Flash——输入 $0.14 / 输出 $0.28,缓存命中约 $0.014。
给个参照:GPT-5.5 收 $5 / $30,Claude Opus 4.8 收 $5 / $25。V4-Pro 的输出 token 价格约是 GPT-5.5 的 3%。就这一个事实,已经解释了为什么 DeepSeek 成了在乎成本的团队的默认首选。
不过牌价只是半个故事。下面讲清楚真正决定 DeepSeek 账单的东西,以及身在海外这钱到底怎么付。
每一档买到的是什么
V4-Pro(1.6 万亿总参、490 亿激活)是旗舰:LiveCodeBench 93.5——全球所有模型最高分——Codeforces 评分 3206,Terminal-Bench 2.0 67.9%,GPQA Diamond 90.1%。论纯算法编程,任何价位都没有对手。它相对的短板是跨多文件的仓库级工作:GLM-5.2 在 SWE-bench Pro 上以 62.1 压过 V4-Pro 的 55.4——两者的取舍见 2026 国产模型指南。
V4-Flash(2840 亿 / 130 亿激活)用能力换了一个约等于零的价格:分类、抽取、摘要、初稿、样板代码。完整论证在 V4-Flash 专文。
决定真实账单的三个数字
缓存命中率。 Flash 缓存输入约 $0.014,比未缓存的 $0.14 便宜 10 倍。如果你的请求共享一段长而稳定的前缀——system prompt、few-shot 示例、RAG 指令——把它们放在最前面,大部分输入 token 就近乎免费。机制见提示缓存讲解。
输出占比。 DeepSeek 的输出价低得反常(Pro 只要 $0.87),所以生成密集型工作——长回答、吐代码、RAG 应答——是它让闭源账单最难堪的地方。
路由纪律。 账单最低的团队都是默认 Flash、只在难提示上升级 Pro。九一开的 Flash/Pro 分流,通常比全跑前沿模型低一个数量级。路由器就几行代码——见接入实战。
算一笔具体账
一个客服机器人,每月 1000 万输入 + 200 万输出 token:
- 用 GPT-5.5:10 × $5 + 2 × $30 = 每月 $110。
- 用 V4-Flash、缓存命中 70%:(3 × $0.14 + 7 × $0.014) + 2 × $0.28 = 每月约 $1.08。
同一个量级的流量,成本差两个数量级。常规客服回答的质量,在多数团队的评测里分不出差别——但别信任何人的评测,跑你自己的。
海外怎么付钱
DeepSeek 官方平台对大陆支付方式最友好,而这恰恰是海外团队卡住的地方。现实的路:
- 直接注册——部分地区可行,但账号和支付摩擦看地区。
- 自己部署——DeepSeek 权重开源;前提是你本来就有规模化的 GPU 基础设施。
- OpenAI 兼容网关。 Turiloop 是一个 OpenAI 兼容的 API 网关,提供 DeepSeek V4-Pro 和 V4-Flash——连同 GLM-5.2、Kimi、MiniMax——按量计费、国际卡支付、不需要中国手机号。你的 OpenAI SDK 改一行
base_url就能跑;各模型实时价格见模型页。想看完整的访问路径,读海外如何调用 DeepSeek API。
常见问题
2026 年 DeepSeek API 多少钱? 官方牌价:V4-Pro 输入 $0.435 / 输出 $0.87 每百万 token;V4-Flash $0.14 / $0.28,缓存输入约 $0.014。截至 2026 年 6 月这是长期价。
DeepSeek 比 GPT-5.5 便宜多少? 悬殊。GPT-5.5 每百万输出 token 收 $30,V4-Pro 收 $0.87——约差 34 倍;输入差 11 倍($5 对 $0.435)。
写代码 DeepSeek 够替代 GPT 吗? 算法类、自包含的编程,V4-Pro 在 LiveCodeBench 上(93.5)比任何闭源模型都高。跨多文件的仓库级 issue,GLM-5.2 或闭源前沿更高。多数团队的做法是路由:跑量给 Flash,难代码给 Pro,例外情况再上更强的。
能用普通信用卡付 DeepSeek 吗? 走网关可以——Turiloop 收国际卡、按量计费,不需要中国手机号或支付宝。
*以上为 2026 年 6 月 29 日 DeepSeek 官方牌价;最新数字以厂商价格页为准。*