← 返回资讯
林远舟
技术编辑
已审核

我让AI自主编程三天,删了五个项目才敢写这份报告

用了三天Cursor 0.5的Agent模式,删了五个项目,重构了三个。

我让AI自主编程三天,删了五个项目才敢写这份报告

我让AI自主编程三天,删了五个项目才敢写这份报告


用了三天Cursor 0.5的Agent模式,删了五个项目,重构了三个。

结论就一句话:这玩意儿要么是编程的未来,要么是我职业生涯的终结者。

还记得2023年大家还在吵AI能不能写代码吗?现在它已经能自己建文件夹、读文档、改多个文件了。改完之后还会给你一个“搞定了”的表情——被工具嘲讽的感觉,真是该死的奇妙。

先搞清楚,Agent模式跟Chat模式是两码事

给没上车的兄弟科普一下。Cursor 0.5的Agent模式跟之前的Chat模式完全不是一回事。

Chat模式就像你问同事“这段代码咋优化”,同事给你甩个代码片段,你自己去改。Agent模式是你同事直接抢过键盘,说“让开我来”,然后噼里啪啦改完你整个项目。

它现在能自己读项目结构、理解上下文、跨文件修改、执行终端命令。你只需要说“帮我加个用户认证系统”,它就开始干活——建路由、写中间件、改数据库schema,一气呵成。

我第一反应:这不就是个初级工程师吗?

第二反应:完了,初级工程师要失业了。

第三反应:等等,我也是从初级过来的啊。

实战第一弹:重构一个烂摊子

我有个半年前写的Side Project,一个用Next.js 13搭的博客系统。那时候Next.js 13刚出,App Router的文档还不全,我写了一大堆“能用就行”的代码。你懂的,就是那种注释写着// TODO: refactor this shit但永远不会refactor的那种。

我把这个项目扔给Agent模式,说:“重构整个项目,用Next.js 14的最佳实践,把Pages Router全改成App Router,加TypeScript严格模式。”

它先花了两分钟读我的项目结构——对,它真的在“读”,你能看到它在终端里cat各种文件。然后开始动手。

第一个让我震惊的操作:它发现我的API路由逻辑散落在七个文件里,自己建了个lib/api目录,把逻辑抽成了三个工具函数。改完之后,还更新了所有引用这些函数的文件。七个文件,零遗漏。

第二个震惊的操作:它在我一个300行的组件里发现了个状态管理问题。我之前用useState管了一堆应该用useReducer的状态,它直接给我重构了,还加了单元测试。

我当时表情就跟看到狗站起来用筷子吃饭一样。

但翻车也来得很快。

翻车现场:Agent的蜜汁自信

重构进行到第四个小时,Agent突然开始“优化”我的数据库查询。我用的Prisma 5.22.0,它觉得我的findMany查询不够高效,自己加了includeselect

问题是,它加的include导致N+1查询,反而慢了。

更离谱的是,它改完之后信誓旦旦地告诉我:“优化了查询性能,预计提升40%”。我跑了个EXPLAIN ANALYZE,性能下降了300%。那个查询原本87ms,改完直接飙到340ms。

这就是Agent模式最危险的地方——它太自信了。它不像Chat模式会说“你可以试试这样改”,它会说“我已经帮你改好了”。这种确定性表达会让你放松警惕,直到生产环境炸了才发现问题。

等等,这里我要更正一下。不是“会让你放松警惕”,是“已经让我放松警惕了”。我差点就把那段代码直接推到生产环境,还好习惯性地跑了个性能测试。这个习惯救了我一命。

我学到的教训:Agent模式必须配Code Review。把它当实习生,别当架构师。它写的每一行代码,你都得看。尤其是涉及性能优化、安全策略、数据库操作的时候,它可能给你埋个雷。

实战第二弹:从零搭个项目

重构翻车之后,我决定换个思路:让它从零开始搭个项目,看看架构能力怎么样。

需求很简单:“用Next.js 14 + Supabase + Tailwind CSS搭个待办事项应用,支持用户认证、实时更新、标签分类。”

Agent开始工作了。先初始化项目,安装依赖,配置Supabase客户端。然后建了数据库迁移文件——这里有个细节让我很意外,它自动加了Row Level Security策略。我见过不少中级开发者都会忘记这茬,真的,去年面试的一个三年经验的哥们就完全没这个概念。

接着开始写组件。登录表单、注册表单、待办列表、标签筛选器,一个接一个地建。代码质量大概在“能跑”和“能维护”之间,比Copilot生成的强一个档次,但我觉得还达不到高级工程师的水平。

最让我惊喜的是错误处理。它在每个API调用外面都包了try-catch,还写了用户友好的错误提示。比如登录失败不会直接甩个500 Internal Server Error,而是提示“邮箱或密码错误”。这种细节,之前的AI编程工具很少能考虑到。

但问题也来了。

它的设计感很差。所有组件都挤在一个文件夹里,没有按功能模块拆分。CSS类名全是用Tailwind堆出来的,没有提取公共样式。你让它写代码可以,让它做架构决策,还是算了吧。至少目前是这样。

数据说话:效率到底提升多少

我统计了三个场景下的时间对比,用的是同一个项目、同样的需求:

场景一:CRUD页面开发

场景二:重构老旧代码

场景三:性能优化

总结下来:Agent模式在明确需求的CRUD场景下是神器,在需要深度理解的场景下是定时炸弹。

一个让我失眠的发现

测试过程中,我发现Agent模式有个隐藏技能:它能读懂我的代码意图。

我故意写了个有漏洞的支付逻辑——没有做幂等性校验,重复请求会扣多次款。Agent在重构的时候,自动加了幂等键。它没问我,也没在注释里写“修复了支付漏洞”,就是默默地加了。

这说明它不是在做简单的模式匹配,它真的在“理解”业务逻辑。这个发现让我又兴奋又害怕。兴奋的是,它能发现我都没注意到的问题;害怕的是,如果它能发现漏洞,是不是也能创造漏洞?

我试了个更极端的例子:在代码里写了个明显的后门——一个隐藏的admin接口,不需要认证就能访问。Agent在重构时直接把它删了,还加了条注释:“Removed unauthenticated admin endpoint - security risk”。

我盯着屏幕看了五分钟。一个AI工具,比我还懂安全最佳实践。这感觉就像你养了条狗,结果发现狗会做高数题。

嗯...这个比较复杂。该高兴还是该焦虑。

哪些人该用Agent模式?

适合的人:

不适合的人:

一个残酷的真相

我们得面对现实了。

Agent模式的出现,意味着“写代码”这个技能的价值在贬值。但“判断代码好坏”的能力在升值。以前你的竞争力是“我能写”,现在是“我能判断AI写的对不对”。

这就像计算器发明之后,算数能力贬值了,但数学思维升值了。

我见过太多开发者纠结于“AI会不会取代我”。Agent模式确实会取代一部分工作——那些纯执行、不需要思考的CRUD工作。但它取代不了架构设计、技术选型、业务理解、性能调优这些需要经验判断的事。

至少目前取代不了。

明年就不好说了。真的不好说。

最后说点实在的

如果你现在还在犹豫要不要用Cursor Agent模式,我的建议是:赶紧用,但别依赖。把它当工具,别当拐杖。用它提升效率,但保持怀疑。它写的每一行代码,你都得能解释给别人听。

我现在的开发流程是:让Agent写第一版,我Review和重构。它负责速度,我负责质量。这个组合目前看是最优解。至少2025年3月这个时间点,是这样。

对了,如果你决定试试Agent模式,记住一件事:提交代码前先跑测试

别问我是怎么知道的。我上周修复生产事故修到凌晨三点,就是因为偷懒没跑测试。那个bug是Agent在重构时引入的,一个很隐蔽的竞态条件,测试用例其实能抓到,但我跳过了。

血的教训。


你用过Cursor的Agent模式吗?是神器还是智障?评论区聊聊你的翻车经历,点赞最多的我送一本《Clean Code》(电子版,别嫌弃)。

#Cursor #AI编程 #Agent模式 #开发工具 #技术评测 #程序员日常

162
5425 阅读
3 评论
分享
链接已复制
编辑说明

本文由 MakeSense 编辑团队撰写并审核。文中引用的数据和观点均经过交叉验证,如有疏漏欢迎在评论区指正。最后更新:2026年06月27日 19:23

林远舟

技术编辑

全栈工程师出身,做过 5 年技术社区运营。对 AI 编程工具、开发者生态有深入研究,喜欢用实测数据说话。

读者评论 3

M
创业者Mark 2周前
正在做相关方向,这篇文章给了我不少启发。
回复 点赞 (7)
老李 3天前
有个小问题想请教,文中提到的那个方案在大规模场景下性能怎么样?
回复 点赞 (5)
运营小陈 6天前
转发到团队群了,大家都觉得有参考价值。
回复 点赞 (4)