模型精选78°

谷歌推出Dream-RSI系统,用AI自我改进探索策略

谷歌刚刚演示了一个用于AI发现的递归自我改进循环。 谷歌/DeepMind的研究人员推出了Dream-RSI,这是一个让AI智能体通过重放其过去的发现尝试来改进它探索问题方式的系统,以低成本测试数千...

精选理由

谷歌搞了个叫Dream-RSI的系统,能让AI自己通过重放过去的尝试来改进探索策略,在算法和工程上省事又高效。

谷歌/DeepMind推出了Dream-RSI系统,让AI智能体通过重放过去的发现尝试来改进探索问题的方式。该系统在算法设计、数学优化和GPU内核工程中,以低成本测试数千种替代策略,将智能体调用次数最多减少了162倍,同时保持或提升发现质量。

原文 · Yangyi

谷歌刚刚演示了一个用于AI发现的递归自我改进循环。 谷歌/DeepMind的研究人员推出了Dream-RSI,这是一个让AI智能体通过重放其过去的发现尝试来改进它探索问题方式的系统,以低成本测试数千...

谷歌刚刚演示了一个用于AI发现的递归自我改进循环。 谷歌/DeepMind的研究人员推出了Dream-RSI,这是一个让AI智能体通过重放其过去的发现尝试来改进它探索问题方式的系统,以低成本测试数千种替代策略,然后在下一轮部署更优策略。 在算法设计、数学优化和GPU内核工程中,它在保持或提升发现质量的同时大幅降低了搜索成本,在一种场景下将智能体调用次数最多减少了162倍。 重要的是,它改进的是探索策略,而不是底层模型权重。 💬 1 🔄 0 ❤️ 1 👀 689 📊 1 ⚡