AI资讯新闻榜单内容搜索-DiscoRL

# 热门搜索 #

大模型

人工智能

openai

融资

chatGPT

搜索: DiscoRL

DeepMind再登Nature：AI Agent造出了最强RL算法！

当AI开始「自己学会学习」，人类的角色正在被重写。DeepMind最新研究DiscoRL，让智能体在多环境交互中自主发现强化学习规则——无需人类设计算法。它在Atari基准中击败MuZero，在从未见过的游戏中依旧稳定高效。

来自主题: AI技术研报

10511 点击 2025-10-28 14:56