DeepMind再登Nature:AI Agent造出了最强RL算法! DeepMind再登Nature:AI Agent造出了最强RL算法! 关键词: Ai新闻,DiscoRL,模型训练,DeepMind,AI算法 当AI开始「自己学会学习」,人类的角色正在被重写。DeepMind最新研究DiscoRL,让智能体在多环境交互中自主发现强化学习规则——无需人类设计算法。它在Atari基准中击败MuZero,在从未见过的游戏中依旧稳定高效。 来自主题: AI技术研报 9000 点击 2025-10-28 14:56