不再止步于自然语言!PhiZero让世界模型学会「物理语言」
不再止步于自然语言!PhiZero让世界模型学会「物理语言」从物理视频生成到运动迁移,再到可控世界建模。
搜索
从物理视频生成到运动迁移,再到可控世界建模。
机器人撬开啤酒瓶盖,啤酒泡沫涌起,酒液从画面右下角流入杯中。
视频世界模型跑久了,往往面临三个问题: 画面发灰发糊或者过曝过饱和、场景悄悄换了地方、显存先撑不住。
过去三年,AI 内容生成行业经历了几轮密集的技术迭代。从文生图到文生视频,从几秒的短片到分钟级的长视频,每一轮升级都让生成内容的质量和时长向前推进一步。
太卷了!过去两年,视频生成模型把画面参数几乎卷了个遍。
近日,清华大学智能产业研究院(AIR)与加州大学伯克利分校(BAIR)团队合作提出了一种全新的预测范式 ODEWorld,其建立在连续的“物理时间流”(Physical-Time Flow, PT-Flow)之上。与传统方法直接预测下一帧是什么不同,ODEWorld 试图学习的是:世界究竟怎样从当前状态连续地变化到未来状态。
独家获悉,具身智能公司LatentVerse已完成数亿元人民币种子轮融资,第一轮投资方包括高瓴创投、清流资本、智元、星动纪元及英诺天使等基金。LatentVerse选择的是第三条路线:不做VLA也不做如今大热的WAM,而是把VLM和世界模型统一在同一个架构里。
8 月 10 日,戴盟机器人正式发布全球首个触觉锚定世界模型 Daimon-TWM(Tactile-grounded World Model),以原生触觉贯穿物理认知、推演决策和瞬时反应全阶段。这个 “物理交互脑” 不仅能理解正在发生的物理接触,还能预测下一步交互会发生什么,并根据瞬息万变的反馈及时修正动作。
世界模型是物理原生智能(Physics-native Intelligence,Phi)重要的组成环节。
让机器人把一只虾夹起来,再放进锅里。