← 返回资讯
苏晴
资深编辑
已审核

ICLR 2026 Efficient Agent 阅读笔记 -

你知道古代打仗,最怕什么吗?不是敌人太强,是每次开战都得重新练兵。

ICLR 2026 Efficient Agent 阅读笔记 -

ICLR 2026 Efficient Agent 阅读笔记 -

你知道古代打仗,最怕什么吗?不是敌人太强,是每次开战都得重新练兵。

将领带兵,打完一场,部队解散。下一场,新兵蛋子从头教。粮草、排兵、经验,全浪费了。

这叫“每战从零开始”。

现在,AI智能体也掉进同一个坑里了。

我们一直以为,让AI变聪明,就是让它学得更多、算得更快。但ICLR 2025一篇论文,戳破了一个反直觉的真相:智能体的问题,不是“不够聪明”,而是“太会忘”。

你看,一个模型接到新任务,得重新理解上下文、重新规划步骤。思维链动辄几千上万个token。数学题、代码题,确实答对了,但消耗的算力,够你翻几本书了。RAG系统也是,检索粗了质量差,细了延迟崩。

这就好比一个厨师,每次做菜都要翻菜谱、问菜名、查火候。累不累啊?

这篇论文给出的解法,特别像部队里的“特种兵制度”——Stateful Persistent Specialist,有状态、永久存储的专家。

你猜怎么着?它不再让模型每次从零搭建解决方案,而是提前训练一批深度专业化的“专家模块”。这些专家是“有状态”的,干完一次活,经验不丢;“永久”的,下次还能直接用。

比如编程任务,系统不用从头思考,直接唤醒一个内置了完整代码模式的编程专家。它不会贪婪地瞎调用工具,也不会无效探索。

换句话说:让专业的人干专业的事,别让天才每次都当学徒。

这个框架的精髓,是两条腿走路:

离线阶段——分析海量任务,找出哪些能力值得变成“常设专家”。像知识蒸馏,把通用能力拆成可复用模块。

在线阶段——新任务来了,一个轻量级路由策略,像项目经理一样,快速匹配最优专家组合,微调团队协作方式。

它不是孤岛。和A²FM路由、GraphPlanner这些方法联手,还能进一步减少冗余。学术界正在形成一个共识:智能体的未来,不是造一个全能超人,而是建一个模块化专业团队。

更妙的是,它从多个维度掀了效率革命:

当然,追问也不少。

专家怎么发现?自动聚类还是人工定义?遇到全新领域,是快速适应还是重训?Stateful专家怎么防止遗忘旧知识?

落地更难。离线培养专家需要大规模算力,在线路由需要低延迟调度。C端产品、高并发场景,扛不扛得住?

但至少,一条清晰的路已经出来了。

**

228
5722 阅读
4 评论
分享
链接已复制
编辑说明

本文由 MakeSense 编辑团队撰写并审核。文中引用的数据和观点均经过交叉验证,如有疏漏欢迎在评论区指正。最后更新:2026年06月20日 11:37

苏晴

资深编辑

科技媒体从业 8 年,曾就职于多家科技媒体。关注 AI 创业和投资赛道,采访过 50+ 位行业从业者。

读者评论 4

老李 1周前
有个小问题想请教,文中提到的那个方案在大规模场景下性能怎么样?
回复 点赞 (5)
运营小陈 2周前
转发到团队群了,大家都觉得有参考价值。
回复 点赞 (4)
数据分析师 3天前
数据引用很扎实,建议补充一下近三个月的最新数据。
回复 点赞 (9)
产品经理阿杰 6天前
从产品角度看,这个方向确实有机会,但商业化路径还需要验证。
回复 点赞 (15)