AI资讯新闻榜单内容搜索-AR

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: AR
47.6%,阿里Qoder拿到了比跑分更硬的成绩

47.6%,阿里Qoder拿到了比跑分更硬的成绩

47.6%,阿里Qoder拿到了比跑分更硬的成绩

对 AI Coding 来说,有人用,比任何 Benchmark 都管用,而有人持续付费,又比有人用更管用。

来自主题: AI资讯
5873 点击    2026-07-16 14:45
翁荔长文谈Harness自进化:Agent越用越强,评测难点怎么破?

翁荔长文谈Harness自进化:Agent越用越强,评测难点怎么破?

翁荔长文谈Harness自进化:Agent越用越强,评测难点怎么破?

近日,翁荔发布长文 《Harness Engineering for Self-Improvement》,系统梳理了 harness engineering 在 AI 自我改进中的作用。

来自主题: AI技术研报
8895 点击    2026-07-16 10:31
大模型RL训练为何会「越训越窄」?ACL Outstanding Paper从token-level熵变揭示RLVR训练机制

大模型RL训练为何会「越训越窄」?ACL Outstanding Paper从token-level熵变揭示RLVR训练机制

大模型RL训练为何会「越训越窄」?ACL Outstanding Paper从token-level熵变揭示RLVR训练机制

基于可验证奖励的强化学习(Reinforcement Learning with Verifiable Rewards,RLVR)正在成为大模型后训练的关键技术。数学题能判对错,代码能跑测试,可验证奖励让大模型可以通过强化学习持续提升推理能力。

来自主题: AI技术研报
10344 点击    2026-07-16 10:10
世界模型迎来「真考场」:WorldArena 2.0 Challenge正式启动

世界模型迎来「真考场」:WorldArena 2.0 Challenge正式启动

世界模型迎来「真考场」:WorldArena 2.0 Challenge正式启动

WorldArena 1.0 的核心意义,在于将世界模型评测从 “好不好看” 推进到 “是否真的有用”。它不再只关注视频观感,而是把物理一致性、可控性、3D 准确性和具身任务功能性纳入统一评测框架,使许多看似流畅的生成结果第一次在机器人具身任务中接受检验。

来自主题: AI技术研报
9367 点击    2026-07-16 10:10
速递|开源Agent初创Nous Research,拟融资7500万美元,估值15亿美元,产品Hermes推出付费云托管版本

速递|开源Agent初创Nous Research,拟融资7500万美元,估值15亿美元,产品Hermes推出付费云托管版本

速递|开源Agent初创Nous Research,拟融资7500万美元,估值15亿美元,产品Hermes推出付费云托管版本

据三位知情人士透露,开源 Hermes Agent 背后的初创公司 Nous Research 正在敲定由 Robot Ventures 领投的新一轮融资,USV 及其他知名投资者也有重要参与,估值为 15 亿美元。知情人士称,该公司至少筹集 7500 万美元,并吸引了大量投资者的高度关注。

来自主题: AI资讯
9233 点击    2026-07-15 15:52
首次,统一建模视角下的扩散语言模型后门威胁

首次,统一建模视角下的扩散语言模型后门威胁

首次,统一建模视角下的扩散语言模型后门威胁

扩散语言模型(DLM)正逐渐成为自回归(Autoregressive, AR)语言模型之外一种新兴的建模范式。

来自主题: AI技术研报
8757 点击    2026-07-15 14:35
腾讯悄悄做了个 Ardot:一句话,直接生成可编辑 UI

腾讯悄悄做了个 Ardot:一句话,直接生成可编辑 UI

腾讯悄悄做了个 Ardot:一句话,直接生成可编辑 UI

几乎所有 AI 设计工具都卡在同一个地方:它们很会生成,但不太会交付。

来自主题: AI资讯
7689 点击    2026-07-15 10:28
年近70,强化学习之父Sutton创业了!

年近70,强化学习之父Sutton创业了!

年近70,强化学习之父Sutton创业了!

年近 70 岁的图灵奖得主、强化学习之父理查德・萨顿(Richard Sutton),宣布创业了。本周一,Richard Sutton 宣布与 Khurram Javed 共同创立新公司 Oak Lab,要打破当前深度学习方式,用全新的理念构建 AGI。

来自主题: AI资讯
8368 点击    2026-07-14 16:15
Yann LeCun连续转发并高度认可的VISReg,到底强在哪?

Yann LeCun连续转发并高度认可的VISReg,到底强在哪?

Yann LeCun连续转发并高度认可的VISReg,到底强在哪?

近日,自监督学习新工作 VISReg(Variance-Invariance-Sketching Regularization)获图灵奖得主 Yann LeCun 连续转发并给予高度认可 —— 他在转发时评价道「VICReg begat SIGReg which begat VISReg」(VICReg 孕育了 SIGReg,SIGReg 又孕育了 VISReg),

来自主题: AI技术研报
9655 点击    2026-07-14 15:28