Kaka Web3Kaka Web3
产品内容日历下载
EN
KAKA WEB3快讯

谷歌让Agent学会「做梦」:复盘过去试错,下一轮自己少走弯路

律动 BlockBeats·2026-09-17 11:27 GMT+8
动察 Beating AI 快讯,谷歌研究团队发布 Dream-RSI,让 AI Agent 做完一轮任务后,把过去的成功和失败拿来「做梦」。系统会保存每次尝试和结果,再利用这些旧记录推演不同做法,比如先试哪条路、什么时候放弃、要不要同时多试几个方案。因为结果以前已经跑过,这些推演不用重新执行任务。 系统会从中选出表现更好的做法,直接用到下一轮。新一轮又会留下更多成功和失败,再拿来「做梦」、继续改策略。这样一轮接一轮,就是论文所谓的「递归自我改进」。目前底层模型本身不会变化,真正被改进的是 Agent「下一步怎么做」的方法。 论文在算法、数学优化和 GPU kernel 等 8 个任务上测试了这套方法。以 Gemini 3.1 Pro 的一个算法任务为例,相比固定做法,Agent 调用从 550 次降到 317
动察 Beating AI 快讯,谷歌研究团队发布 Dream-RSI,让 AI Agent 做完一轮任务后,把过去的成功和失败拿来「做梦」。系统会保存每次尝试和结果,再利用这些旧记录推演不同做法,比如先试哪条路、什么时候放弃、要不要同时多试几个方案。因为结果以前已经跑过,这些推演不用重新执行任务。 系统会从中选出表现更好的做法,直接用到下一轮。新一轮又会留下更多成功和失败,再拿来「做梦」、继续改策略。这样一轮接一轮,就是论文所谓的「递归自我改进」。目前底层模型本身不会变化,真正被改进的是 Agent「下一步怎么做」的方法。 论文在算法、数学优化和 GPU kernel 等 8 个任务上测试了这套方法。以 Gemini 3.1 Pro 的一个算法任务为例,相比固定做法,Agent 调用从 550 次降到 317 次,同时最终找到的程序运行得更快。
查看原始来源 更多内容
来自 Kaka Web3 的公开内容。市场与数字资产信息不构成投资建议。