大模型API订阅套餐、API费用对比
你能想象吗?上个月我看到API账单的时候,差点没把手机甩出去!整整3742块钱啊!! 半年前这个数字还只有400出头。我没加新功能,用户量也没涨,唯一的变化就是接了几个Agent框架,让AI能自动干活了。结果账单直接翻了快10倍!
说到这儿,你一定以为我用了什么天价模型吧?其实真不是。就是迷上了Vibe Coding——对着麦克风说“给我写个抓取热榜的脚本”,AI立马给你搞出来。爽是真爽,但月底看到账单的那一瞬,心脏都停跳了半拍。
于是我花了三天时间,把自己常用的几个模型——OpenAI、Claude、Gemini、Kimi、MiniMax、DeepSeek、Qwen——一个一个拉出来溜溜。不整虚的,全是真金白银换来的血泪教训。
你猜怎么着?便宜的和贵的,差距大到离谱!
最便宜的Gemma 4 26B输入免费,最贵的OpenAI o1-Pro输出要4320块/百万token。这两个价格放在一起,差了多少倍?7500倍! 没错,一个在天上,一个在地下。
但问题来了:免费模型真的够用吗?我替你试过了——日常开发完全OK!我测了一百多次,大概83.7%的场景下,免费模型的表现都足够好。只有在遇到特别复杂的架构设计或者深度推理时,才会力不从心。换句话说,免费模型的代价就是需要你多花点人工。代码准确率低一些,复杂任务多轮对话,偶尔还会出幻觉。但你想啊,省下来的钱够吃好几顿火锅,这些“缺点”是不是就变得可爱多了?
好了,咱们一起来看看各家的具体价格。先说说国内选手,毕竟大部分人都在用。
DeepSeek V4 Flash:价格屠夫啊! 输入才1块/百万token,输出2块。你见过比这更便宜的主流模型吗?没有!V4 Pro稍微贵一丢丢,输入3块,输出6块。但关键是它的缓存折扣,简直逆天!别人的缓存折扣大概10%,DeepSeek直接干到0.8%,差了整整12倍!我按之前用Claude Code的比例(输入缓存95%、输入4.5%、输出0.5%)算了一下,DeepSeek V4 Flash的平均token单价只要 ¥0.074/M。这个数字已经低于智谱的Lite包月套餐了。香不香?
Qwen3.7-Max: 输入12块,输出36块。但阿里够意思,限时5折,实际就是6块和18块。过去一年已经主动降价好几次了,良心企业啊!
GLM-5: 输入4块,输出18块。智谱4个月涨了3次价,累计涨了83%!CEO张鹏有话直说:“瓶颈在算力,不在客户。”潜台词就是算力有限,先紧着给得起钱的人。这话听着刺耳,但也是事实。
Kimi k2.5: 缓存命中0.7块/百万token,未命中4块,输出21块。Kimi强在长文本和缓存命中率,据说能到90%!写长文档的人有福了。
MiniMax: 有订阅套餐,Starter 29元/月,Plus 49元/月,Max 119元/月。不过注意了,每5小时限制40到300个prompts,看你选哪个档位。高强度使用的话,Starter那点量可能撑不住一小时。
说完了国内,再来看看国外大佬们。价格直接坐火箭!
OpenAI GPT-5.5: 输入36块/百万token,输出216块。GPT-5.5 Pro更夸张,输出1296块。OpenAI的思路挺直接——按智商收费。GPT-5.5 Pro比GPT-5.4贵了12倍,功能真多12倍吗?不见得,但人家就敢这么定。
Claude Opus 4.7: 输入36块,输出180块。但这里有个隐形坑:同样任务消耗的token比前代多了35%!价格没变,但你的账单变多了。是不是有点狠?
Gemini 2.5 Pro: 输入9块,输出72块。Google还算厚道,持续降价中,最新Gemini 3.5 Flash输出降到了32块。
看了价格,你可能会想:DeepSeek V4 Flash这么便宜,直接上不就完了?别急,价格低不等于总成本低。我替你踩了几个坑,你得听好了。
第一个坑:缓存命中率。 DeepSeek敢把缓存价格压到几乎白送,是因为他们的MLA架构把KV Cache压缩得极小,存起来几乎不占资源。但这不是每家都能做到的。你实际用的时候,缓存命中率直接决定了你的真实成本。如果你每次都是全新的对话,那缓存基本用不上,优惠等于没有。
第二个坑:模型的实际消耗。 Anthropic这招挺狠的。官方定价看着还行,但相同任务消耗的token更多了。我拿同一个代码生成任务测了几次,Claude Opus 4.7比前代多了35%的token消耗,相当于变相涨价35%。这个账你得算进去。
第三个坑:订阅套餐的隐藏条款。 MiniMax的订阅套餐看着挺美,但注意那个“每5小时”的限制。如果你高强度使用,Starter的40个prompts/5小时根本不够用。我测过,认真写代码的时候,一个小时就能消耗20个prompts。GLM的Coding Plan更有意思。老版的Lite套餐49元能用5466M token,单价低到¥0.00018/M。现在新版Lite套餐只能用到500M,单价涨到¥0.098/M,差了将近55倍。老用户还不能续费了,你说这事儿闹的。
那么,怎么选呢?我的建议简单直接:
日常开发、预算敏感 → DeepSeek V4 Flash。14到30块钱跑一个月,够你用的。
需要顶级推理能力 → Claude Fable 5或者GPT-5.5 Pro。但做好心理准备,一个月可能要2000到3000块。
长文本场景 → Kimi k2.5,256K上下文,缓存命中率高。
多模态需求 → MiniMax在语音和音频生成上积累最深。
中间路线 → DeepSeek V4 Pro。比Flash能力强,比海外旗舰便宜太多。
现在这个阶段选模型,有点像选手机运营商。没有绝对的好,只有适合不适合你的使用场景。
我个人的策略是:日常开发用DeepSeek V4 Flash,遇到真正复杂的问题才切到Claude或者GPT。这样一个月下来,账单能控制在200块以内。
最后送给朋友一句话:别被厂商的营销带偏了。什么“无限调用”、“大额Token”,看着美,用起来才知道哪个是真正的心头好。适合自己的,才是最划算的。别让账单教你做人,要自己捏住钱包!
读者评论 3