陶哲轩深夜力挺!抢在OpenAI发布前夜,Caltech物理AI攻克百年难题
陶哲轩深夜力挺!抢在OpenAI发布前夜,Caltech物理AI攻克百年难题Caltech的Anima Anandkumar团队利用物理信息神经网络(PINN)和自研优化器,在三维无强迫欧拉方程自由空间中求得奇点候选解,缩放指数收敛至约0.5,但最终证明仍待完成。
搜索
Caltech的Anima Anandkumar团队利用物理信息神经网络(PINN)和自研优化器,在三维无强迫欧拉方程自由空间中求得奇点候选解,缩放指数收敛至约0.5,但最终证明仍待完成。
哈佛物理学家Matthew Schwartz用Claude和开源工具BootLoops处理可验证的科研任务,90天产出横跨18个学科的36篇论文初稿,并主张由人挑题、追问和验收,让AI发挥辅助而非替代科学家的作用。
文章指出,AI常生成美女,是因为模型倾向生成接近数据分布中心的平均脸,而人类更偏爱平均脸,训练数据偏置、用户点击、奖励模型与商业激励进一步强化了这一反馈循环。
CScale完成1.45亿美元C轮融资,由Valor与Atreides联合领投,两家9月已四次联合领投AI融资,显示跨市场基金正成为AI数据中心互连项目的重要领投方,并使相关估值更受Astera Labs、Credo等美股表现影响。
腾讯推出永久免费的AI接待工具Knocket,支持网站、联系页和移动应用接入,上传FAQ及文档后可让AI依据知识库回复访客,并在需要时转接人工。
VA-Bench测试12个主要多模态模型发现,Qwen3.8-max、Opus-5和GPT-5.6-sol虽在目标识别与定位上达100%、操作语义理解达99.6%—100%,完整任务成功率却仅为53.93%、52.86%和51.55%,暴露大模型从空间理解到执行与修正的断层。
Physical Intelligence联合创始人Sergey Levine指出,机器人尚未进入稳定缩放阶段,应以先验知识、有效决策循环和多样化数据提升泛化与可靠性,并在找到真正可规模化的技术后扩大投入。
大模型竞技场Arena让Claude Opus 5.5与GPT-6 Astra各自练棋200局,前者估算评分从约1500升至1760,后者从第29盘的1810降至1400,显示AI仅靠记录与复盘提升能力的表现并不一致。
来自上海创智学院、复旦大学、伦敦国王学院与牛津大学等机构的研究团队推出SocioVerse2,将大模型社会模拟扩展为可干预、可迭代、可回溯的开源社会科学研究框架。
Harvey联合创始人Gabe Pereyra表示,AI应用公司不必与大模型公司比拼资金和算力,可借助真实任务评测、领域专家、开源模型和外部研究团队建立持续学习能力。