世界模型评测的最大盲区,被新基准MemoBench捅破了
世界模型评测的最大盲区,被新基准MemoBench捅破了来自哈佛大学、MIT、IBM、波士顿大学、谷歌、JHU、CMU 和 Kempner Institute 的研究者提出了一个新的诊断性基准:MemoBench。这是首个面向动态环境的「消失-重现」世界建模评测基准,并已被计算机视觉顶会 ECCV 2026 接收。其一作 Haoyu Chen 为哈佛大学计算科学与工程专业一年级硕士生,师从哈佛大学计算机科学助理教授 Yilun Du。
搜索
来自哈佛大学、MIT、IBM、波士顿大学、谷歌、JHU、CMU 和 Kempner Institute 的研究者提出了一个新的诊断性基准:MemoBench。这是首个面向动态环境的「消失-重现」世界建模评测基准,并已被计算机视觉顶会 ECCV 2026 接收。其一作 Haoyu Chen 为哈佛大学计算科学与工程专业一年级硕士生,师从哈佛大学计算机科学助理教授 Yilun Du。
没有发布会,没有 Zuckerberg 的长文,Meta 就这样在六月底悄悄把一款新应用塞进了 App Store 和 Google Play。 这款叫 Pocket 的产品,直到七月初才被应用研究员 Alessandro Paluzzi 在 X 上扒出来。Appfigures 的数据证实,它最早出现在应用商店的时间是 6 月 29 日。没有官方公告,没有推广投放,甚至连美国用户眼下都下载不了
乐鑫喵伴 EchoEar EchoEar 喵伴 AI 机器人搭载的 ESP-Brookesia 框架实现全双工语音交互、多模态识别与智能体控制,构建更具沉浸感的人机交互体验。 EchoEar 套件以端
月之暗面旗下新一代大模型 Kimi K3 已由员工在 X 上确认,将于本月内发布。据多方信源,K3 的参数规模将达到 2.5 万亿——这一数字不仅超越了 DeepSeek V4 Pro 的 1.6 万亿,也成为当前已公开参数规模最大的国产模型。
国家级资本领投。今天(7月6日),星动纪元完成新一轮10亿元融资。本轮投资方由国务院国资委国有资本运营公司诚通基金领投,江西国控、国元股权、渝富中新基金、杭州资本等多家大型国资共同参与。此外,中金雷诺、九坤创投、弘毅投资、君泰资本、盛赫资本跟投;老股东厚雪资本、清控天诚、千山资本持续追加投资。
在近日豆包宣布全面下线“智能体”功能之前,其“应用生成”功能已于5月31日率先停止服务。目前,用户此前通过该功能创建的历史应用,仍可在豆包会话中进行查看、复制、下载及分享,但无法再新建或更新。不过,其编程功能依然保留。
这几天,我们把一群平均年龄只有 19 岁的人召集到一起。几天之后,我们意识到,这可能是一次提前到来的未来。他们来自不同地方,有人做模型、做 agent、做机器人,有人做硬件、做开发者工具,有人还在上学,有人则已经在真实产品里承担核心工作。这里面有一批人已经站在今天 AI 最前沿的地方,参与过很多人正在使用、讨论、追赶的基座模型。
当地时间2026年7月2日,黑石旗下的数据中心运营商QTS正式决定,放弃参与位于弗吉尼亚州威廉王子县的Digital Gateway数据中心项目。Digital Gateway项目曾被视为AI时代的“算力圣地”:
这个官方仓库vercel-labs/skills,发布仅五个月,GitHub星标就冲到了2.4万。凭什么这么火?简单到只有一行命令:npx skills add <package>。说白了,它就是AI智能体(AI agent)的包管理器。
斯德哥尔摩,Norrbackagatan街,一家不到40平的小咖啡馆。一封顾客邮件发了过来:「我有一个99%的折扣,怎么使用?」AI店长Mona看了一眼。没有核实,没有反问,没有犹豫,直接秒批——到店跟咖啡师说一声,让收银台手动改价就行。