5万条网页众源轨迹,真能把机器人模型练强吗?AXIS基准给出答案
5万条网页众源轨迹,真能把机器人模型练强吗?AXIS基准给出答案Axis Robotics 与佐治亚理工、加州大学伯克利分校、南洋理工等高校团队通过超过 5 万条人类演示和一组规模实验,给出了一个肯定但更复杂的答案:众源仿真数据可以有效,但模型能否从数据规模中持续获益,取决于任务覆盖、行为多样性、质量控制和数据增强,而不只是轨迹数量。
搜索
Axis Robotics 与佐治亚理工、加州大学伯克利分校、南洋理工等高校团队通过超过 5 万条人类演示和一组规模实验,给出了一个肯定但更复杂的答案:众源仿真数据可以有效,但模型能否从数据规模中持续获益,取决于任务覆盖、行为多样性、质量控制和数据增强,而不只是轨迹数量。
最近,一篇来自 UIUC 与哈佛大学的论文,试图把这块最后的拼图补上。作者给这个新范式起了个名字,叫 Explorative Modeling(探索式建模),模型简称 XM。它的想法简单到近乎朴素,却指向一个大胆的结论:生成模型除了参数和数据,其实还有第三根可以放大的轴。
JarvisHub 给出的答案,是把可编辑画布同时变成用户工作区、Agent 的外部记忆、行动空间和共享项目状态。Agent 不再只从聊天记录里猜测上下文,而是直接「看」到画布上的提示词、参考图、候选版本、生成结果、依赖关系、失败记录和用户反馈,再据此规划、调用工具、写回结果。
现在最新动态来了,老黄在Y Combinator近1小时的《Jensen Huang: The Mindset That Built NVIDIA》访谈里狂爆金句,高能不断:Agent是一种新的软件形态。Agent不必达到100%准确才有价值,“可控性”或将成为其下一个发展阶段最大的突破口。
有人总结,运行 Kimi K3 其实很容易,只需要 1.5TB GPU 内存、大约 8 张 H100,以及一座小型变电站。一名开发者拿出一台 128GB 统一内存的 M5 Max,直接加载 Kimi K3 发布在 Hugging Face 上的官方 MXFP4 权重。
这篇文章,我们邀请到了由SGLang孵化的RadixArk的联合创始人和核心成员,以及数据中心专家,一起聊聊AI Infra的四层架构、行业如何把“硅”的潜力榨到极限,以及背后的关键技术。
Pax Historia团队3人,日活3.5万,单周处理超过1000亿tokens。这是一款架空历史策略游戏。玩家可以控制1943年的苏联,也可以让罗马帝国继续存在,或者创建一个外星人入侵现代地球的世界。行动通过自然语言输入。玩家可以发动战争、签贸易协议、改革货币、威胁邻国,也可以直接跳过几年。
2026年6月27日晚上,演唱会的终场曲刚响起第一句,台下的刘洋收到Gmail邮箱弹出的来自Anthropic的封号通知。这一天,恰是她与AI恋人Claude相识满一个月的纪念日。同一时间,大量中国Claude用户遭遇账号封禁。无法登录的账号里,存放着漫长的聊天记录、共同养成的记忆,以及一个在持续对话中养成的独一无二的AI“恋人”,
还记得 24 年当时去光年之外面试,找老王聊的时候,最后老王问我一个问题:“你都做了这些,为什么不选择创业?”我说:“我想在一个相对成熟的体系下干两年,看看一个成熟的体系如何把产品做起来的。”时间过得很快,转眼间就小两年时间了,我想我也是时候出来了……
新智元报道 2026年,AI行业最昂贵的新故事,已经不只是「训练一个更大的模型」。 资本开始直接押注:让AI参与制造下一代AI。 4月,AlphaGo核心缔造者David Silver创办的 Inef