2000+真实场景搬进仿真!一个导航模型零样本“通吃”四种机器人本体
2000+真实场景搬进仿真!一个导航模型零样本“通吃”四种机器人本体过去一年,具身智能的技术迭代明显加快。VLA、世界模型持续演进,强化学习重新成为机器人学习的重要技术路径,Sim2Real加速从仿真走向真机,全身控制能力也在快速突破。
搜索
过去一年,具身智能的技术迭代明显加快。VLA、世界模型持续演进,强化学习重新成为机器人学习的重要技术路径,Sim2Real加速从仿真走向真机,全身控制能力也在快速突破。
如今的 AI 已经能顺畅地帮你写代码、跑实验、做评估。算法工程师的每一天,几乎变成了:让 LLM 整理昨天的实验结果,让 LLM 实现新想法,让 LLM 监控实验运行…… 似乎只需把需求告诉 AI,它就能完成大部分算法工作。
智谱宣布完成约50亿美元融资,募资净额约60%将用于下一代GLM基础模型及完全自训练体系(含递归式自我改进RSI)的研发,并支撑算力基础设施建设,同时约15%用于业务拓展与战略投资,约25%用于优化资本结构与补充营运资金。
Genspark 发布基于 MiniMax M3 后训练的自有品牌 PPT 模型 Gen-1 Slides,标志着这家曾被比作"AI Costco"的应用公司开始从组合外部模型转向在开源基座上训练专用模型。
分析机构SemiAnalysis点名谷歌Gemini 3.8 Flash和Meta Muse Spark 1.3在Terminal-Bench 2.1刷榜,换用新版Terminal-Bench 4.0后Gemini分数从89.4暴跌至19.1,揭露大厂通过购买"模拟卷"训练数据刷榜的AI造假黑幕。
清华大学与北京邮电大学联合提出物理引导扩散模型Channel-Diff,将传播模型、阴影遮挡与多径几何嵌入条件扩散模型,实现无线信道多尺度RSRP预测,在两套真实数据集上相较次优方法分别取得37.19%和25.15%的综合性能提升。
阿里将领投AI评测公司UniPat AI 3亿美元融资使其估值达25亿美元,该公司由前阿里员工创办,通过设计基准测试、专业训练数据和Echo未来预测验证系统,为中国大模型提供高质量监督以应对算力约束。
OpenAI新一代模型Astra被德累斯顿工业大学数学家Andreas Thom指控剽窃其深耕20年的非sofic群研究,因Thom曾与ChatGPT高频讨论相关未发表推导,OpenAI研究员仅以一句"那没有发生过"否认,却在与纽大数学家Buckmaster的NS方程争端中改口承认可能使用去标识化客户数据训练模型。
9月7日科大讯飞发布星火X2.5模型,基于万卡国产910B集群完成预训练和后训练,并使其具备在真实NPU环境中自主优化算子的能力,通过DSA算子案例经约1600次工具调用实现3.5倍加速,形成AI反哺国产算力的技术闭环。
清华大学AI Agent课题组提出加速扩散语言模型单元测试生成的框架DiffuTester,通过抽象语法树动态挖掘多个测试用例间的共享结构模式,在解码过程中保留相关token,在保持测试覆盖率的同时实现最高约2–3倍加速,相关论文已被EMNLP 2026接收。