我同时用5个AI一整年,它们根本不是同一种东西
上周三,朋友在微信上问我一个问题。
“你现在到底用哪个 AI 最多?”
我愣了一下,打开手机准备截图。五个图标——ChatGPT、Claude、Gemini、DeepSeek、Grok——整整齐齐躺在一个叫“AI工具”的文件夹里。我自己都笑了。
没用哪个最多。
全都在用。
这事儿其实挺反直觉的。
2026 年了,讨论“谁最好”已经没意义。就像你问我轿车、SUV、皮卡哪个最好——得看你今天要干嘛,对吧?我这一年多踩坑踩出来的结论就一句话:它们根本不是同一种东西。
只是恰好都能聊天而已。
一个一个说。讲人话。
ChatGPT:最稳的那个,但最近有点烦
GPT 系列我用得最久。从 2022 年底到现在,换了三四代,整体感觉一个字:稳。
写作、编程、翻译、搜资料,几乎没有明显短板。图片生成和视频生成也都进了第一梯队——不是最强,但都在前两名。5.5 版本代码能力还行。
但是。
最近 Plus 套餐降智严重。5.5 的 codex 额度大幅缩减,网页版对话几轮后会自动降级模型——你都不知道它在背后偷偷换了。上传四五张图片就触发限额。
穷疯了吗 CloseAI?
还有那个破网页,老一卡一卡的。200 刀一个月的 Pro 版解锁满血 o3,说实话那个价格我咬着牙买了,但每次续费都肉疼。讲真,如果预算只够订阅一个,ChatGPT 仍然是最稳妥的选择——综合素质最均衡,没有之一。
但它的核心问题是:不说人话。
GPT 的回答严谨、全面,就是透着一股教科书味儿。圆滑,逢迎,四平八稳。所以我现在的习惯——不对,应该叫肌肉记忆——是让它做初稿,然后扔给 Claude 或者 Gemini 润色。
这个流程已经刻进 DNA 了。
Claude:代码和写作的神,但越来越挑食
Claude 曾经是我写代码的首选。
Opus 4.6 时期,代码能力遥遥领先,甩开其他模型半条街。然后 4.7 开始流口水。4.8 更是蒸蒸日上。
什么意思?
就是模型开始犯低级错误。尤其在需要精准理解的场景,信息检索能力非常差,远不如 GPT。会把一个简单的需求极度画蛇添足,最后耗费 20 分钟得出一个——越努力越偏离需求的结果。
真的。
但 Claude 在创意写作和深度讨论上依然是神。它的文字有层次感,情感表达自然,不像 GPT 那样端着。中文文字处理能力现在也上来了,和 DeepSeek 各有千秋。
贵是真贵。Max 订阅不便宜,免费版 Sonnet 两分钟烧完配额。一用一个不吱声。
我充钱了,你没充钱,难怪你塞车——这话虽然刻薄,但差不多是这个意思。如果你不写代码,免费版 4.6 够用了。
Gemini:生态无敌,但别让它算加减乘除
Gemini 是我最近半年用得越来越多的一个。
为什么?因为它跟谷歌生态深度绑定。我工作流大量依赖 Google Docs、Gmail、YouTube,Gemini 在这些场景里的便利性——别的模型没法比。多模态能力也是第一梯队,图像理解准确率 95.8%,视频分析支持最长 3 小时连续帧理解。上传图片基本不限制,日用聊天非常舒服。
绝了。
但是这个“但是”很重要——3.5 Flash 被砍成了大傻子,3.1 Flash-Lite 被砍成了二傻子。
用这俩干重活?
纯纯全自动闯祸机。
连加减乘除都算不明白。还有一件事让我很不爽:谷歌会用你的对话做训练数据。你不同意?行,那你就没有聊天记录。严重阉割,纯纯的美国豆包,还不会语音。
所以我现在是这么用的:重活给 3.1 Pro,日常聊天用 Flash-Lite(反正免费),正经方案绝对不能让 Flash 碰。
这个分配策略,是我踩了三次坑之后总结出来的。
DeepSeek:国产之光,但别吹太狠
DeepSeek 是 2025-2026 年最大的黑马。
这没得黑。
V4 问世以后质变了,现在就是个小 GPT。在数学、代码、逻辑推理上跟 GPT-5 持平甚至部分超越。汉语逻辑理解和文字编写水平——所有模型里断层第一。
而且免费。API 价格极低,约为 GPT 的 1/10,10 块钱的额度能用很久。巴适得很。
但别被吹得太上头。
早期版本爱说胡话废话,能力吊差,基本不能上桌吃饭。现在 V4 好多了,但依然没有多模态能力,不能生图。遇到复杂任务还是会露怯。
我的结论是:如果你没有科学上网条件,只想要一个大模型,DeepSeek 完全够用。开通 API 后用 Cherry Studio 连一下,性能更优,限制更少。文字需求不贵,日常使用绰绰有余。
细想一下,国内那些卖中转站的,从 3.5 Sonnet 时代就吹编程和写作,现在又吹 Gemini,就为了骗你付费。国内外模型存在差距,但已经特别小了——没必要为很小的差距付几十倍的费用。
你品。
Grok:买亏了,下个月不续了
说到 Grok,我只能叹气。
10 刀一个月的 SuperGrok lite,唯一让我觉得有用的,是它的搜索功能——能直接调用 X(推特)的实时数据,搜热点和实时信息确实好用。写 H 方面尺度略宽松,虽然也不是为所欲为。
除此以外一无是处。
信息检索能力弱于 GPT,文字撰写极其生硬,模型幻觉强烈,很难正常理解需求。大概是马斯克的光环加成吧——我当时一时冲动就订阅了。
翻车了。
下个月肯定不续。如果你对实时信息特别敏感,可以用免费版扯扯淡。API 没意义,别浪费时间。
说到底,组合使用才是正解
我现在的日常配置是这样的:
- 主力机:ChatGPT(综合任务、翻译初稿)
- 润色:Claude(创意写作、代码、表达优化)
- 谷歌生态:Gemini 3.1 Pro(文档、视频、日常聊天)
- 中文 & 性价比:DeepSeek(国内任务、API 调用)
- 实时搜索:Grok 免费版(偶尔用)
它们不是竞争关系,是互补关系。
这个观点,绝大多数 AI 教程不会告诉你——因为他们只想卖你某一个产品的课。
我还没想明白的是:为什么每个模型都要砍免费版?GPT 降智、Claude 限额度、Gemini 砍成傻子、Grok 本来就不行。
好像是商量好的。
算了,商业公司嘛,可以理解。但我还是不爽。
2026 年了,AI 工具泛滥,但真正能搞清楚怎么用的没几个。如果你也遇到“不知道该订阅哪个”的问题,可以试试我的方法:先明确你 80% 的时间在干什么,然后只订阅那个场景最强的模型。剩下的,用免费版凑合。
别像我一样,五个全订。
希望这篇文章能帮你省点钱——毕竟我踩过的坑,已经够多了。
读者评论 3