← 返回资讯
林远舟
技术编辑
已审核

我同时用5个AI一整年,它们根本不是同一种东西

我愣了一下,打开手机准备截图。五个图标——ChatGPT、Claude、Gemini、DeepSeek、Grok——整整齐齐躺在一个叫“AI工具”的文件夹里。我自己都笑了。

我同时用5个AI一整年,它们根本不是同一种东西

我同时用5个AI一整年,它们根本不是同一种东西


上周三,朋友在微信上问我一个问题。

“你现在到底用哪个 AI 最多?”

我愣了一下,打开手机准备截图。五个图标——ChatGPT、Claude、Gemini、DeepSeek、Grok——整整齐齐躺在一个叫“AI工具”的文件夹里。我自己都笑了。

没用哪个最多。

全都在用。


这事儿其实挺反直觉的。

2026 年了,讨论“谁最好”已经没意义。就像你问我轿车、SUV、皮卡哪个最好——得看你今天要干嘛,对吧?我这一年多踩坑踩出来的结论就一句话:它们根本不是同一种东西。

只是恰好都能聊天而已。

一个一个说。讲人话。


ChatGPT:最稳的那个,但最近有点烦

GPT 系列我用得最久。从 2022 年底到现在,换了三四代,整体感觉一个字:稳。

写作、编程、翻译、搜资料,几乎没有明显短板。图片生成和视频生成也都进了第一梯队——不是最强,但都在前两名。5.5 版本代码能力还行。

但是。

最近 Plus 套餐降智严重。5.5 的 codex 额度大幅缩减,网页版对话几轮后会自动降级模型——你都不知道它在背后偷偷换了。上传四五张图片就触发限额。

穷疯了吗 CloseAI?

还有那个破网页,老一卡一卡的。200 刀一个月的 Pro 版解锁满血 o3,说实话那个价格我咬着牙买了,但每次续费都肉疼。讲真,如果预算只够订阅一个,ChatGPT 仍然是最稳妥的选择——综合素质最均衡,没有之一。

但它的核心问题是:不说人话。

GPT 的回答严谨、全面,就是透着一股教科书味儿。圆滑,逢迎,四平八稳。所以我现在的习惯——不对,应该叫肌肉记忆——是让它做初稿,然后扔给 Claude 或者 Gemini 润色。

这个流程已经刻进 DNA 了。


Claude:代码和写作的神,但越来越挑食

Claude 曾经是我写代码的首选。

Opus 4.6 时期,代码能力遥遥领先,甩开其他模型半条街。然后 4.7 开始流口水。4.8 更是蒸蒸日上。

什么意思?

就是模型开始犯低级错误。尤其在需要精准理解的场景,信息检索能力非常差,远不如 GPT。会把一个简单的需求极度画蛇添足,最后耗费 20 分钟得出一个——越努力越偏离需求的结果。

真的。

但 Claude 在创意写作和深度讨论上依然是神。它的文字有层次感,情感表达自然,不像 GPT 那样端着。中文文字处理能力现在也上来了,和 DeepSeek 各有千秋。

贵是真贵。Max 订阅不便宜,免费版 Sonnet 两分钟烧完配额。一用一个不吱声。

我充钱了,你没充钱,难怪你塞车——这话虽然刻薄,但差不多是这个意思。如果你不写代码,免费版 4.6 够用了。


Gemini:生态无敌,但别让它算加减乘除

Gemini 是我最近半年用得越来越多的一个。

为什么?因为它跟谷歌生态深度绑定。我工作流大量依赖 Google Docs、Gmail、YouTube,Gemini 在这些场景里的便利性——别的模型没法比。多模态能力也是第一梯队,图像理解准确率 95.8%,视频分析支持最长 3 小时连续帧理解。上传图片基本不限制,日用聊天非常舒服。

绝了。

但是这个“但是”很重要——3.5 Flash 被砍成了大傻子,3.1 Flash-Lite 被砍成了二傻子。

用这俩干重活?

纯纯全自动闯祸机。

连加减乘除都算不明白。还有一件事让我很不爽:谷歌会用你的对话做训练数据。你不同意?行,那你就没有聊天记录。严重阉割,纯纯的美国豆包,还不会语音。

所以我现在是这么用的:重活给 3.1 Pro,日常聊天用 Flash-Lite(反正免费),正经方案绝对不能让 Flash 碰。

这个分配策略,是我踩了三次坑之后总结出来的。


DeepSeek:国产之光,但别吹太狠

DeepSeek 是 2025-2026 年最大的黑马。

这没得黑。

V4 问世以后质变了,现在就是个小 GPT。在数学、代码、逻辑推理上跟 GPT-5 持平甚至部分超越。汉语逻辑理解和文字编写水平——所有模型里断层第一。

而且免费。API 价格极低,约为 GPT 的 1/10,10 块钱的额度能用很久。巴适得很。

但别被吹得太上头。

早期版本爱说胡话废话,能力吊差,基本不能上桌吃饭。现在 V4 好多了,但依然没有多模态能力,不能生图。遇到复杂任务还是会露怯。

我的结论是:如果你没有科学上网条件,只想要一个大模型,DeepSeek 完全够用。开通 API 后用 Cherry Studio 连一下,性能更优,限制更少。文字需求不贵,日常使用绰绰有余。

细想一下,国内那些卖中转站的,从 3.5 Sonnet 时代就吹编程和写作,现在又吹 Gemini,就为了骗你付费。国内外模型存在差距,但已经特别小了——没必要为很小的差距付几十倍的费用。

你品。


Grok:买亏了,下个月不续了

说到 Grok,我只能叹气。

10 刀一个月的 SuperGrok lite,唯一让我觉得有用的,是它的搜索功能——能直接调用 X(推特)的实时数据,搜热点和实时信息确实好用。写 H 方面尺度略宽松,虽然也不是为所欲为。

除此以外一无是处。

信息检索能力弱于 GPT,文字撰写极其生硬,模型幻觉强烈,很难正常理解需求。大概是马斯克的光环加成吧——我当时一时冲动就订阅了。

翻车了。

下个月肯定不续。如果你对实时信息特别敏感,可以用免费版扯扯淡。API 没意义,别浪费时间。


说到底,组合使用才是正解

我现在的日常配置是这样的:

它们不是竞争关系,是互补关系。

这个观点,绝大多数 AI 教程不会告诉你——因为他们只想卖你某一个产品的课。

我还没想明白的是:为什么每个模型都要砍免费版?GPT 降智、Claude 限额度、Gemini 砍成傻子、Grok 本来就不行。

好像是商量好的。

算了,商业公司嘛,可以理解。但我还是不爽。


2026 年了,AI 工具泛滥,但真正能搞清楚怎么用的没几个。如果你也遇到“不知道该订阅哪个”的问题,可以试试我的方法:先明确你 80% 的时间在干什么,然后只订阅那个场景最强的模型。剩下的,用免费版凑合。

别像我一样,五个全订。

希望这篇文章能帮你省点钱——毕竟我踩过的坑,已经够多了。

130
4357 阅读
3 评论
分享
链接已复制
编辑说明

本文由 MakeSense 编辑团队撰写并审核。文中引用的数据和观点均经过交叉验证,如有疏漏欢迎在评论区指正。最后更新:2026年06月27日 12:18

林远舟

技术编辑

全栈工程师出身,做过 5 年技术社区运营。对 AI 编程工具、开发者生态有深入研究,喜欢用实测数据说话。

读者评论 3

前端工程师 1周前
代码示例很清晰,直接用到项目里了。
回复 点赞 (6)
技术小白 昨天
作为非技术人员也看懂了,感谢作者的通俗讲解。
回复 点赞 (3)
Dev小王 4天前
终于有人把这个说清楚了,收藏了。
回复 点赞 (8)