跳到正文
原文
Yangyi(@Yangyixxxx)· Yangyi (@yangyi)·· 22 天前AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

谷歌 DeepMind 推出 Dream-RSI,用重放机制减少智能体调用最多 162 倍

谷歌刚刚演示了一个用于AI发现的递归自我改进循环。 谷歌/DeepMind的研究人员推出了Dream-RSI,这是一个让AI智能体通过重放其过去的发现尝试来改进它探索问题方式的系统,以低成本测试数千...

AI 导读

谷歌/DeepMind 研究人员推出 Dream-RSI,让 AI 智能体通过重放过去的发现尝试来改进探索问题的方式,以低成本测试数千种替代策略,并在下一轮部署更优策略。该系统在算法设计、数学优化和 GPU 内核工程中保持或提升发现质量的同时大幅降低搜索成本,一种场景下将智能体调用次数最多减少 162 倍。其改进的是探索策略,而非底层模型权重。

来源:Yangyi(@Yangyixxxx) · x.com