千寻智能最强大脑亮相WAIC:攻克「金鱼记忆」,终结单一任务Demo内卷
千寻智能最强大脑亮相WAIC:攻克「金鱼记忆」,终结单一任务Demo内卷千寻智能的展台上,则来了两位画风完全不同的主角:一位是通体黑灰、看起来不苟言笑的 Moz1,埋头干活;另一位是首次公开亮相的 Moz2,奶杏色机身配上粉色小围脖「OOTD」,忙着向观众打招呼、举手比心,靠卖萌吸引了不少镜头。
搜索
千寻智能的展台上,则来了两位画风完全不同的主角:一位是通体黑灰、看起来不苟言笑的 Moz1,埋头干活;另一位是首次公开亮相的 Moz2,奶杏色机身配上粉色小围脖「OOTD」,忙着向观众打招呼、举手比心,靠卖萌吸引了不少镜头。
RoboScience机器科学直接把世博馆展台,变成了 Visics 的压力测试场。换本体、换物品、换任务,多轮挑战轮番上阵,专挑具身大模型最容易掉链子的地方下手。Visics 的泛化能力究竟行不行?现场观众可以直接点题,围观验货。
7 月 14 日,Anthropic 正式发布 Claude for Teachers,面向美国 K12 教师免费开放高级功能,支持备课、课程设计、学习分析等教学场景。而在此之前,OpenAI 已经推出 ChatGPT for Teachers,同样聚焦教师教学支持,并计划向美国 K12 学区开放。
阿里巴巴达摩院的最新工作RynnWorld-Teleop对此给出的方案是:用生成式世界模型替代真实机器人。操作员的手势驱动一个实时视频生成器,由“数字世界中的机器人”完成全部视觉演示,同时自动获得关节级的动作标签。该方案被称为数字遥操作(Digital Teleoperation)。
最近,来自 Google、哥本哈根大学、牛津大学等机构的研究者提出了 VGGRPO(Visual Geometry GRPO,收录于 ECCV 2026)。这项工作聚焦于一个核心问题:如何在不牺牲预训练模型泛化能力的前提下,高效地提升视频生成的几何一致性,并使其适用于动态场景。其核心思路是,在隐空间(latent space)中利用 4D 几何奖励,进行几何感知的视频后训练。
最近,一篇名为 FreeStyle: Free Control of Style-Content Dual-Reference Generation from Community LoRA Mining 的工作引起了不少关注。换句话说,FreeStyle 研究的是 style-content dual-reference generation,也就是「内容 - 风格双参考生成」。
曾推出 RoboTwin 系列基准的团队发布了 RoboDojo,一套统一覆盖仿真与真实机器人操作的具身智能评测体系。它包含 42 个仿真任务、18 个真实机器人任务,并将 30 个代表性机器人策略放到同一套标准下比较。
这一次,我就挑选了其中比较有代表性的三款:QClaw、WorkBuddy 和百度搭子,通过几组真实办公任务进行横向测试,看看国产办公 Agent 现在到底发展到了什么水平。横测标准:同一任务、同一素材、同一交付标准,每个任务只给一次主要执行机会。
7 月 17 日,2026 世界人工智能大会在上海开幕。展览首次扩展至「三地四馆」,总面积超过 10 万平方米,1100 余家企业带来 3000 余项展品,其中超过 300 款产品在大会期间全球首发。智算与具身智能首次成为并列的核心赛道,各自聚集超过 200 家企业。从开展后的排队人流,到机器人展台前层层举起的手机,AI 依然是当下关注度最高的科技议题之一。
最近不少人在给 Codex 做各种美化,但很多方案都有一个共同的问题:直接替换 app.asar、覆盖资源文件,或者整张截图覆盖整个界面。这样不仅升级容易失效,还可能导致程序异常。今天分享的是一套完整交付物——Codex Dream Skin。