从「看见」到「补全」:哈佛、MIT与港科大Stream3D打通流式3D重建与生成
从「看见」到「补全」:哈佛、MIT与港科大Stream3D打通流式3D重建与生成如何从一段视频中获得完整、稳定的 3D 物体?过去,这个问题大致沿着两条路线发展。
搜索
如何从一段视频中获得完整、稳定的 3D 物体?过去,这个问题大致沿着两条路线发展。
当 VLA、WAM、RL、TAMP、MPC 等机器人控制策略在各自擅长的任务中大放异彩,如何刻画其能力边界,并在正确的时机为不同子任务匹配最合适的策略,正逐渐成为机器人完成复杂长时序任务的关键。
OpenAI内部最新推理模型,一口气发布了十项惊人的数学进展。
WAIC之后,具身智能行业进入了一段微妙的冷静期。
近年来,视觉 — 语言 — 动作模型(Vision-Language-Action Model,VLA)正逐渐成为通用机器人控制的重要技术路线,但当这些模型真正进入高频闭环执行时,一个矛盾越来越突出:模型越来越大、语义能力越来越强,动作更新却未必足够快。
8 月 3 日,在 AGI Playground 2026 大会上,Genspark 创始人&CEO 景鲲在现场发布了一款新产品 GenOffice。这是一个面向 Windows 和 Mac 的本地 Office 客户端。开源、免费、无广告,保留用户熟悉的文档编辑能力,同时把 AI 引入 Word、PPT 等高频办公场景。
8 月 3 日,阿里巴巴正式发布新一代基座大模型 Qwen3.8,总参数量 2.4 万亿,在编程(Coding)和专业办公(Cowork)方面能力大幅提升。今日放榜的权威三方榜单 Arena 中,阿里 Qwen 模型仅次于 Anthropic 的 Claude 系列,整体性能处于全球大模型第一梯队。。
Jay 发自 凹非寺 量子位 | 公众号 QbitAI 啥,谷歌真比OpenAI还早一年搞出了ChatGPT? 不是谷歌事后找补了,这次是OpenAI自己人,Codex负责人Tibo刚佐证的消息: 那
又一家AI初创公司加入了这场狂飙突进的独角兽俱乐部:Simile。据该初创公司透露,就在结束隐身状态、宣布完成由Index Ventures领投的1亿美元A轮融资仅仅五个月后,公司已完成2亿美元B轮融资,估值达到20亿美元。
AI浏览器正为用户完成跨网站的重复工作。