Claude写代码很强,但查个价格能全编错
上周三晚上,我躺床上刷手机,微信弹出来一条消息。
朋友说:“我受不了了。”
他说他现在的浏览器跟联合国似的——ChatGPT开着写邮件,Claude挂着改文案,Gemini在那看图,Grok刷热搜。四个网页,四个会员,每个月扣钱扣得他肉疼。
然后他问我:到底留哪个?
我回了一句:你先告诉我,你是干嘛的。
他说做跨境电商。每天产品描述、客户邮件、竞品分析,偶尔写点推广文案。
我说那你根本不需要四个。
真的。
这事儿让我想起去年十月的自己。那会儿我一口气订了五个模型,GPT、Claude、Gemini、Grok、还有个国产的。打开手机一看,好家伙,AI全家桶。觉得自己特专业,像个数字时代的军火商。
月底看账单。
差点没背过气去。
快赶上我房租了。
翻车了。
后来花了两周,把所有模型按真实工作流重新跑了一遍。该留的留,该砍的砍。到现在这个组合用了快一年,挺舒服。
说到这儿,你可能会问:那到底留了谁?
别急。我一个一个跟你说。
先说ChatGPT。
我现在的主力就是它。不是因为它最强——虽然它确实挺强——而是因为它最稳。
稳到什么程度?日常写作、翻译、资料整理基本没出过让我想摔键盘的错。你想想,一个工具用了一年,没让你崩溃过,这已经很难得了。
但有个毛病,一直没改。
不说人话。
真的。你让它写个产品介绍,它给你整出“本产品采用先进工艺打造,为您带来极致体验”。我说你能不能说人话?它说好的,然后换成“本产品运用前沿技术,为您呈现卓越感受”。
……行吧。
所以我现在的做法是,ChatGPT出初稿,扔给Claude润色。Claude的中文表达比GPT自然得多,至少读起来像人写的——不是那种“尊贵的顾客您好”的塑料感。
但Claude也有问题。
而且是大问题。
Opus 4那会儿,代码能力确实遥遥领先。我们圈子里那会儿都说,写代码不用Claude就是跟自己过不去。
到了后续版本开始“流口水”。
这是我们圈子里的黑话,意思是模型开始胡说八道。你问它东,它答西,还答得特别自信,跟真事儿似的。
再往后更离谱。
中文能力倒是上来了,但信息检索差得令人发指。你问它一个简单的事实性问题,它给你编得有鼻子有眼——时间、地点、人物、数据,全给你整得明明白白。
全是假的。
上个月我让它查一个竞品的价格区间,它列了三个数字。我差点写进报告里。还好多了个心眼自己去搜了一下——
全错。
绝了。
而且Claude是真的贵。Pro版20刀一个月,免费配额两分钟烧完。我有个朋友没充钱用Sonnet,他说每次用都像在跟时间赛跑,一用一个不吱声。
你品品,花20刀买个会说瞎话的助手。
咋整?
Gemini呢?
说实话,感情很复杂。
Gemini Pro那会儿,能力优秀,世界知识全面,多模态也强。图片上传基本不限制,日用聊天特别舒服。那段时间我天天用,觉得谷歌终于支棱起来了。
然后谷歌开始砍。
Flash版本被砍成大傻子,Flash-Lite被砍成二傻子。最新的Flash版本,据说是最近更新的,已经沦为弱智——这词不是我说的,上好几个人同时在用。
加减乘除都算不明白。
你想想,一个AI,算不清加减乘除。
一个能做微积分的AI,算不清37+58。
这事儿细想挺魔幻的。
但它有个好处:免费版给得很大方。Flash-Lite敞开了用,图片基本不限制。所以我现在只用它做一件事——生图。它的画图能力意外地好,比豆包强,而且没什么版权限制,想画啥画啥。
社媒娱乐用它,正经工作别找它。
记住了。
Grok……
唉。
我订了一个月,10刀。
这是我今年最亏的一笔订阅费。
除了写东西尺度略宽松——还不是为所欲为——别的几乎一无是处。信息检索弱于GPT,文字撰写极其生硬,模型幻觉强烈。你让它理解一个简单的需求,它能给你曲解到外太空。
马斯克吹得天花乱坠,什么实时联网、X数据独家。实际用起来,它搜出来的东西我拿谷歌一搜也有,还更准。
10刀。
买杯奶茶不香吗?
下个月肯定不续了。
最后说DeepSeek。
这是让我最意外的一个。
去年V3版本的时候,说实话,不太行。爱说胡话,废话连篇,能力差距明显。当时我的评价是:除了免费没啥优点。
但今年V4出来以后——
质变了。
现在的DeepSeek,就是一个缩小版的GPT。汉语逻辑理解和文字编写水平,是所有模型里最好的——包括国外的。这点我反复对比过,中文任务上,DeepSeek的语感最自然,最懂中国人说话的方式。
讲真,有些表达Claude做不到,GPT做不到,就它能。
而且便宜。API价格大概是GPT的十分之一,10块钱的额度能用很久。我开通API后用Cherry Studio连了一下,性能和限制都比网页版好不少。
巴适。
缺点也明显:依然没有多模态能力。不能生图,不能识图。如果你需要这些,还是得靠别的。
但话说回来——10块钱,要啥自行车?
所以回到开头那个问题:到底该留哪一个?
如果你跟我那个做跨境电商的朋友一样,只想留一个主力,我推荐ChatGPT。它不一定每项都第一,但综合最稳,出错最少。
预算敏感,或者主要做中文内容——DeepSeek V4完全够用,甚至在某些方面更好。
写代码的话,Claude Opus 4——注意是老版本,不是新的——依然是很多程序员的首选。但你要能接受它的价格和偶尔的“流口水”。
重度依赖谷歌生态,Gemini免费版值得留着。做做轻量任务、生个图,别让它干重活。
至于Grok……
算了。
不过说了这么多,我突然想到一件事。
我上面这些话,可能下个月就过时了。
这行变得太快。上周还好好的模型,这周可能就被砍了。去年还遥遥领先的,今年可能就泯然众人。我写这篇文章的时候是2026年6月,你读到的时候,版本号大概又变了。
所以比起告诉你“用哪个”,我其实更想说的是——
别迷信任何一个模型。
它们都是工具,不是信仰。今天觉得好用的,明天可能翻车。今天看不上的,下个版本可能逆袭。
保持切换的能力,比选对一个模型更重要。
你觉得呢?
工具会过时,但选择的能力不会。
读者评论 4