AI资讯新闻榜单内容搜索-不

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 不
揭开多智能体决策的隐形不公,结果指标相同也未必可靠 | EMNLP'26

揭开多智能体决策的隐形不公,结果指标相同也未必可靠 | EMNLP'26

揭开多智能体决策的隐形不公,结果指标相同也未必可靠 | EMNLP'26

当多个大语言模型(LLM)组成「招聘委员会」,共同筛选简历、讨论候选人、打分并投票时,我们通常会用最终录用率来判断系统是否公平。

来自主题: AI技术研报
8303 点击    2026-09-09 14:51
2 万亿美元的 Anthropic 值不值得买?

2 万亿美元的 Anthropic 值不值得买?

2 万亿美元的 Anthropic 值不值得买?

今年 4 月,有买家给 Anthropic 开出约 6000 亿美元的估值,到了 8 月,部分投资人预计,Anthropic 上市时的估值可能达到 2 万亿美元甚至更高。事实上,要支撑这样的估值,Anthropic 需要在未来几年持续保持高速增长,但 OpenAI 的追赶给这一预期再次增加了不确定性。

来自主题: AI资讯
5801 点击    2026-09-09 11:43
Arm造了颗AGI CPU,火山引擎首批智能体沙箱先上车

Arm造了颗AGI CPU,火山引擎首批智能体沙箱先上车

Arm造了颗AGI CPU,火山引擎首批智能体沙箱先上车

以后手机GPU渲染游戏画面,不用再吭哧吭哧把每个像素都算出来了。

来自主题: AI资讯
7694 点击    2026-09-09 11:27
刚刚,OpenAI 宣布攻克千禧年难题,清华姚班传奇陈立杰:不可思议的时代

刚刚,OpenAI 宣布攻克千禧年难题,清华姚班传奇陈立杰:不可思议的时代

刚刚,OpenAI 宣布攻克千禧年难题,清华姚班传奇陈立杰:不可思议的时代

OpenAI宣布其内部多智能体系统完成千禧年大奖难题之一纳维尔斯托克斯方程存在性与光滑性问题的解答并公开论文及Lean形式化证明,研究员陈立杰称这是"不可思议的时代",但成果引发与纽约大学流体力学专家Tristan Buckmaster之间关于研究优先权与过程透明度的争议。

来自主题: AI资讯
9745 点击    2026-09-09 10:30
叠纸准备“开卖”AI硬件产品,米哈游也要做陪伴机器人

叠纸准备“开卖”AI硬件产品,米哈游也要做陪伴机器人

叠纸准备“开卖”AI硬件产品,米哈游也要做陪伴机器人

↑↑↑点击蓝字|关注我们 follow us AING硬迹 两家以虚拟内容见长的头部公司,押注“AI陪伴硬件”。 近日,游戏圈最耐人寻味的信号不是来自某款新游的预告片,而是来自两家公司的招聘页面和商标

来自主题: AI资讯
7846 点击    2026-09-08 17:59
Agent长时工作如何不跑偏?WorkSwarm用「永续会话」给出解法

Agent长时工作如何不跑偏?WorkSwarm用「永续会话」给出解法

Agent长时工作如何不跑偏?WorkSwarm用「永续会话」给出解法

让 Agent 完成一个任务并不难。它会整理材料、修改文件、检查结果,再交付答案。

来自主题: AI技术研报
5326 点击    2026-09-08 15:28
EMNLP 2026 Main|预测越像真实环境,Agent反而做得更差?我们把世界模型的训练目标从"状态一致"换成了"行为一致"

EMNLP 2026 Main|预测越像真实环境,Agent反而做得更差?我们把世界模型的训练目标从"状态一致"换成了"行为一致"

EMNLP 2026 Main|预测越像真实环境,Agent反而做得更差?我们把世界模型的训练目标从"状态一致"换成了"行为一致"

一句话概括:文本世界模型都在比 "生成文本像不像真实环境",但我们发现文本更接近真实环境的预测反而可能让智能体错得更离谱。把训练目标从 "状态一致" 换成 "行为一致" 后,16 组实验配置下世界模型的轨迹级一致性几乎全面提升,弱智能体离线评测的假阳性率从 42.5% 降到 9.5%。

来自主题: AI技术研报
5936 点击    2026-09-08 15:06