← 返回资讯
苏晴
资深编辑
已审核

Claude写代码很强,但查个价格能全编错

上周三晚上,我躺床上刷手机,微信弹出来一条消息。

Claude写代码很强,但查个价格能全编错

Claude写代码很强,但查个价格能全编错


上周三晚上,我躺床上刷手机,微信弹出来一条消息。

朋友说:“我受不了了。”

他说他现在的浏览器跟联合国似的——ChatGPT开着写邮件,Claude挂着改文案,Gemini在那看图,Grok刷热搜。四个网页,四个会员,每个月扣钱扣得他肉疼。

然后他问我:到底留哪个?

我回了一句:你先告诉我,你是干嘛的。

他说做跨境电商。每天产品描述、客户邮件、竞品分析,偶尔写点推广文案。

我说那你根本不需要四个。

真的。

这事儿让我想起去年十月的自己。那会儿我一口气订了五个模型,GPT、Claude、Gemini、Grok、还有个国产的。打开手机一看,好家伙,AI全家桶。觉得自己特专业,像个数字时代的军火商。

月底看账单。

差点没背过气去。

快赶上我房租了。

翻车了。

后来花了两周,把所有模型按真实工作流重新跑了一遍。该留的留,该砍的砍。到现在这个组合用了快一年,挺舒服。

说到这儿,你可能会问:那到底留了谁?

别急。我一个一个跟你说。


先说ChatGPT。

我现在的主力就是它。不是因为它最强——虽然它确实挺强——而是因为它最稳。

稳到什么程度?日常写作、翻译、资料整理基本没出过让我想摔键盘的错。你想想,一个工具用了一年,没让你崩溃过,这已经很难得了。

但有个毛病,一直没改。

不说人话。

真的。你让它写个产品介绍,它给你整出“本产品采用先进工艺打造,为您带来极致体验”。我说你能不能说人话?它说好的,然后换成“本产品运用前沿技术,为您呈现卓越感受”。

……行吧。

所以我现在的做法是,ChatGPT出初稿,扔给Claude润色。Claude的中文表达比GPT自然得多,至少读起来像人写的——不是那种“尊贵的顾客您好”的塑料感。

但Claude也有问题。

而且是大问题。


Opus 4那会儿,代码能力确实遥遥领先。我们圈子里那会儿都说,写代码不用Claude就是跟自己过不去。

到了后续版本开始“流口水”。

这是我们圈子里的黑话,意思是模型开始胡说八道。你问它东,它答西,还答得特别自信,跟真事儿似的。

再往后更离谱。

中文能力倒是上来了,但信息检索差得令人发指。你问它一个简单的事实性问题,它给你编得有鼻子有眼——时间、地点、人物、数据,全给你整得明明白白。

全是假的。

上个月我让它查一个竞品的价格区间,它列了三个数字。我差点写进报告里。还好多了个心眼自己去搜了一下——

全错。

绝了。

而且Claude是真的贵。Pro版20刀一个月,免费配额两分钟烧完。我有个朋友没充钱用Sonnet,他说每次用都像在跟时间赛跑,一用一个不吱声。

你品品,花20刀买个会说瞎话的助手。

咋整?


Gemini呢?

说实话,感情很复杂。

Gemini Pro那会儿,能力优秀,世界知识全面,多模态也强。图片上传基本不限制,日用聊天特别舒服。那段时间我天天用,觉得谷歌终于支棱起来了。

然后谷歌开始砍。

Flash版本被砍成大傻子,Flash-Lite被砍成二傻子。最新的Flash版本,据说是最近更新的,已经沦为弱智——这词不是我说的,上好几个人同时在用。

加减乘除都算不明白。

你想想,一个AI,算不清加减乘除。

一个能做微积分的AI,算不清37+58。

这事儿细想挺魔幻的。

但它有个好处:免费版给得很大方。Flash-Lite敞开了用,图片基本不限制。所以我现在只用它做一件事——生图。它的画图能力意外地好,比豆包强,而且没什么版权限制,想画啥画啥。

社媒娱乐用它,正经工作别找它。

记住了。


Grok……

唉。

我订了一个月,10刀。

这是我今年最亏的一笔订阅费。

除了写东西尺度略宽松——还不是为所欲为——别的几乎一无是处。信息检索弱于GPT,文字撰写极其生硬,模型幻觉强烈。你让它理解一个简单的需求,它能给你曲解到外太空。

马斯克吹得天花乱坠,什么实时联网、X数据独家。实际用起来,它搜出来的东西我拿谷歌一搜也有,还更准。

10刀。

买杯奶茶不香吗?

下个月肯定不续了。


最后说DeepSeek。

这是让我最意外的一个。

去年V3版本的时候,说实话,不太行。爱说胡话,废话连篇,能力差距明显。当时我的评价是:除了免费没啥优点。

但今年V4出来以后——

质变了。

现在的DeepSeek,就是一个缩小版的GPT。汉语逻辑理解和文字编写水平,是所有模型里最好的——包括国外的。这点我反复对比过,中文任务上,DeepSeek的语感最自然,最懂中国人说话的方式。

讲真,有些表达Claude做不到,GPT做不到,就它能。

而且便宜。API价格大概是GPT的十分之一,10块钱的额度能用很久。我开通API后用Cherry Studio连了一下,性能和限制都比网页版好不少。

巴适。

缺点也明显:依然没有多模态能力。不能生图,不能识图。如果你需要这些,还是得靠别的。

但话说回来——10块钱,要啥自行车?


所以回到开头那个问题:到底该留哪一个?

如果你跟我那个做跨境电商的朋友一样,只想留一个主力,我推荐ChatGPT。它不一定每项都第一,但综合最稳,出错最少。

预算敏感,或者主要做中文内容——DeepSeek V4完全够用,甚至在某些方面更好。

写代码的话,Claude Opus 4——注意是老版本,不是新的——依然是很多程序员的首选。但你要能接受它的价格和偶尔的“流口水”。

重度依赖谷歌生态,Gemini免费版值得留着。做做轻量任务、生个图,别让它干重活。

至于Grok……

算了。


不过说了这么多,我突然想到一件事。

我上面这些话,可能下个月就过时了。

这行变得太快。上周还好好的模型,这周可能就被砍了。去年还遥遥领先的,今年可能就泯然众人。我写这篇文章的时候是2026年6月,你读到的时候,版本号大概又变了。

所以比起告诉你“用哪个”,我其实更想说的是——

别迷信任何一个模型。

它们都是工具,不是信仰。今天觉得好用的,明天可能翻车。今天看不上的,下个版本可能逆袭。

保持切换的能力,比选对一个模型更重要。

你觉得呢?

工具会过时,但选择的能力不会。

158
7938 阅读
4 评论
分享
链接已复制
编辑说明

本文由 MakeSense 编辑团队撰写并审核。文中引用的数据和观点均经过交叉验证,如有疏漏欢迎在评论区指正。最后更新:2026年06月27日 11:47

苏晴

资深编辑

科技媒体从业 8 年,曾就职于多家科技媒体。关注 AI 创业和投资赛道,采访过 50+ 位行业从业者。

读者评论 4

A
AI研究员 3天前
观点有道理,不过我觉得还需要考虑算力成本的问题。
回复 点赞 (11)
M
创业者Mark 6天前
正在做相关方向,这篇文章给了我不少启发。
回复 点赞 (7)
老李 1周前
有个小问题想请教,文中提到的那个方案在大规模场景下性能怎么样?
回复 点赞 (5)
运营小陈 1周前
转发到团队群了,大家都觉得有参考价值。
回复 点赞 (4)