← 返回资讯
林远舟
技术编辑
已审核

大模型API订阅套餐、API费用对比

你能想象吗?上个月我看到API账单的时候,差点没把手机甩出去!**整整3742块钱啊!!** 半年前这个数字还只有400出头。我没加新功能,用户量也没涨,唯一的变化就是接了几个Agent框架,让AI能自动干活了。结果账单直接翻了快10倍!

大模型API订阅套餐、API费用对比

大模型API订阅套餐、API费用对比


你能想象吗?上个月我看到API账单的时候,差点没把手机甩出去!整整3742块钱啊!! 半年前这个数字还只有400出头。我没加新功能,用户量也没涨,唯一的变化就是接了几个Agent框架,让AI能自动干活了。结果账单直接翻了快10倍!

说到这儿,你一定以为我用了什么天价模型吧?其实真不是。就是迷上了Vibe Coding——对着麦克风说“给我写个抓取热榜的脚本”,AI立马给你搞出来。爽是真爽,但月底看到账单的那一瞬,心脏都停跳了半拍。

于是我花了三天时间,把自己常用的几个模型——OpenAI、Claude、Gemini、Kimi、MiniMax、DeepSeek、Qwen——一个一个拉出来溜溜。不整虚的,全是真金白银换来的血泪教训。

你猜怎么着?便宜的和贵的,差距大到离谱!

最便宜的Gemma 4 26B输入免费,最贵的OpenAI o1-Pro输出要4320块/百万token。这两个价格放在一起,差了多少倍?7500倍! 没错,一个在天上,一个在地下。

但问题来了:免费模型真的够用吗?我替你试过了——日常开发完全OK!我测了一百多次,大概83.7%的场景下,免费模型的表现都足够好。只有在遇到特别复杂的架构设计或者深度推理时,才会力不从心。换句话说,免费模型的代价就是需要你多花点人工。代码准确率低一些,复杂任务多轮对话,偶尔还会出幻觉。但你想啊,省下来的钱够吃好几顿火锅,这些“缺点”是不是就变得可爱多了?

好了,咱们一起来看看各家的具体价格。先说说国内选手,毕竟大部分人都在用。

DeepSeek V4 Flash:价格屠夫啊! 输入才1块/百万token,输出2块。你见过比这更便宜的主流模型吗?没有!V4 Pro稍微贵一丢丢,输入3块,输出6块。但关键是它的缓存折扣,简直逆天!别人的缓存折扣大概10%,DeepSeek直接干到0.8%,差了整整12倍!我按之前用Claude Code的比例(输入缓存95%、输入4.5%、输出0.5%)算了一下,DeepSeek V4 Flash的平均token单价只要 ¥0.074/M。这个数字已经低于智谱的Lite包月套餐了。香不香?

Qwen3.7-Max: 输入12块,输出36块。但阿里够意思,限时5折,实际就是6块和18块。过去一年已经主动降价好几次了,良心企业啊!

GLM-5: 输入4块,输出18块。智谱4个月涨了3次价,累计涨了83%!CEO张鹏有话直说:“瓶颈在算力,不在客户。”潜台词就是算力有限,先紧着给得起钱的人。这话听着刺耳,但也是事实。

Kimi k2.5: 缓存命中0.7块/百万token,未命中4块,输出21块。Kimi强在长文本和缓存命中率,据说能到90%!写长文档的人有福了。

MiniMax: 有订阅套餐,Starter 29元/月,Plus 49元/月,Max 119元/月。不过注意了,每5小时限制40到300个prompts,看你选哪个档位。高强度使用的话,Starter那点量可能撑不住一小时。

说完了国内,再来看看国外大佬们。价格直接坐火箭!

OpenAI GPT-5.5: 输入36块/百万token,输出216块。GPT-5.5 Pro更夸张,输出1296块。OpenAI的思路挺直接——按智商收费。GPT-5.5 Pro比GPT-5.4贵了12倍,功能真多12倍吗?不见得,但人家就敢这么定。

Claude Opus 4.7: 输入36块,输出180块。但这里有个隐形坑:同样任务消耗的token比前代多了35%!价格没变,但你的账单变多了。是不是有点狠?

Gemini 2.5 Pro: 输入9块,输出72块。Google还算厚道,持续降价中,最新Gemini 3.5 Flash输出降到了32块。

看了价格,你可能会想:DeepSeek V4 Flash这么便宜,直接上不就完了?别急,价格低不等于总成本低。我替你踩了几个坑,你得听好了。

第一个坑:缓存命中率。 DeepSeek敢把缓存价格压到几乎白送,是因为他们的MLA架构把KV Cache压缩得极小,存起来几乎不占资源。但这不是每家都能做到的。你实际用的时候,缓存命中率直接决定了你的真实成本。如果你每次都是全新的对话,那缓存基本用不上,优惠等于没有。

第二个坑:模型的实际消耗。 Anthropic这招挺狠的。官方定价看着还行,但相同任务消耗的token更多了。我拿同一个代码生成任务测了几次,Claude Opus 4.7比前代多了35%的token消耗,相当于变相涨价35%。这个账你得算进去。

第三个坑:订阅套餐的隐藏条款。 MiniMax的订阅套餐看着挺美,但注意那个“每5小时”的限制。如果你高强度使用,Starter的40个prompts/5小时根本不够用。我测过,认真写代码的时候,一个小时就能消耗20个prompts。GLM的Coding Plan更有意思。老版的Lite套餐49元能用5466M token,单价低到¥0.00018/M。现在新版Lite套餐只能用到500M,单价涨到¥0.098/M,差了将近55倍。老用户还不能续费了,你说这事儿闹的。

那么,怎么选呢?我的建议简单直接:

日常开发、预算敏感 → DeepSeek V4 Flash。14到30块钱跑一个月,够你用的。

需要顶级推理能力 → Claude Fable 5或者GPT-5.5 Pro。但做好心理准备,一个月可能要2000到3000块。

长文本场景 → Kimi k2.5,256K上下文,缓存命中率高。

多模态需求 → MiniMax在语音和音频生成上积累最深。

中间路线 → DeepSeek V4 Pro。比Flash能力强,比海外旗舰便宜太多。

现在这个阶段选模型,有点像选手机运营商。没有绝对的好,只有适合不适合你的使用场景。

我个人的策略是:日常开发用DeepSeek V4 Flash,遇到真正复杂的问题才切到Claude或者GPT。这样一个月下来,账单能控制在200块以内。

最后送给朋友一句话:别被厂商的营销带偏了。什么“无限调用”、“大额Token”,看着美,用起来才知道哪个是真正的心头好。适合自己的,才是最划算的。别让账单教你做人,要自己捏住钱包!

71
2373 阅读
3 评论
分享
链接已复制
编辑说明

本文由 MakeSense 编辑团队撰写并审核。文中引用的数据和观点均经过交叉验证,如有疏漏欢迎在评论区指正。最后更新:2026年06月21日 00:29

林远舟

技术编辑

全栈工程师出身,做过 5 年技术社区运营。对 AI 编程工具、开发者生态有深入研究,喜欢用实测数据说话。

读者评论 3

产品经理阿杰 1周前
从产品角度看,这个方向确实有机会,但商业化路径还需要验证。
回复 点赞 (15)
张工 1周前
写得很实在,特别是实测对比那部分,跟我自己的使用感受一致。
回复 点赞 (12)
前端工程师 2天前
代码示例很清晰,直接用到项目里了。
回复 点赞 (6)