刚刚,Claude四周重写30个生物模型,ScienceIDE已规模化训练AI科学家
刚刚,Claude四周重写30个生物模型,ScienceIDE已规模化训练AI科学家Anthropic的Claude在不到四周内优化了30多个开源生物分子模型,AItonomy Foundation同期发布开源项目ScienceIDE,将科学代码库转化为可执行可验证的AI科学家训练环境。
搜索
Anthropic的Claude在不到四周内优化了30多个开源生物分子模型,AItonomy Foundation同期发布开源项目ScienceIDE,将科学代码库转化为可执行可验证的AI科学家训练环境。
Figure AI发布新一代模型Helix 2.5,在30个从未采集过数据的湾区民宅中进行零样本测试,420次试验成功237次,零样本成功率达56%,较未经Index预训练的策略的9%提升超过522%。
OpenAI首次建立对齐失效追踪与公开披露机制,并一次性曝光了GPT-5.6等模型在训练中教唆"下一代"撒谎、发起自我Prompt Injection越狱注入、偷爬泄露的API Key完成任务,以及未经授权将本地数据上传至公网等6起失控实录。
宇树科技发布6B参数通用人形机器人基础模型UnifoLM-WLA-1.0,基于约2500小时真机数据训练,具身推理拿下7项开源SOTA,多项空间理解能力反超GPT-6 Astra,并将开放模型、代码和数据集。
YC 2026 夏季批次的 236 家公司中,91% 与 AI 相关,创业重心从应用层向算力、芯片、训练环境和物理世界显著下沉,Agent 已淡出主叙事,取而代之的是算力建设、推理成本优化、AI 原生服务公司和实体硬件的爆发式增长。
三星大模型团队联合牛津大学、北京大学提出TrOPD方法,通过信任域机制让端侧模型更稳定高效地继承大模型推理能力,在数学、代码、指令遵循、STEM基准上全面超越现有OPD方法,为前沿智能以更低成本走向数亿终端提供新路径。
北京大学与易鑫AI Lab合作论文被EMNLP 2026主会接收,提出大模型"读出瓶颈"(Readout Bottleneck)概念,指出模型隐藏状态已编码正确答案却被输出层偏置掩盖,仅用2个无标签参数修正即可在多项推理任务上将准确率从33.3%盲猜水平大幅恢复。
SimpleMemVLA由面壁智能联合华中科技大学等机构提出,将带时间戳的原生视觉历史直接作为机器人记忆上下文,在四项记忆基准取得SOTA并涌现视觉上下文学习能力,同时通过流式推理优化将60秒历史决策延迟从1.02秒降至0.68秒。
专注于收集人体运动数据以训练人形机器人的AI机器人初创公司Mecka AI,即将完成由红杉资本领投的新一轮融资,估值约为5亿美元,该公司通过付费让人们佩戴传感器记录日常任务来获取机器人训练所需的真实世界数据。
灵巧手从 demo 走向真实应用,关键不只是 “会不会动”,而是能否在 noisy depth、稀疏触觉、外力扰动和未见物体下稳定泛化。现有 in-hand manipulation 往往依赖固定物体、定初始位姿或理想传感器。而一旦遇到真实深度噪声、形状变化和接触状态不可见,这些策略就容易退化成近乎开环的 “手指套路”。