曝苹果已与阿里合作训练大模型
曝苹果已与阿里合作训练大模型据路透社援引三位知情人士爆料,苹果已和阿里巴巴展开合作,联合训练一款专门面向中国市场的大语言模型。就在8月8日,苹果悄然更新Mac使用手册,新增《在Mac上配合Apple智能使用千问》相关章节,这也是苹果首次对外官方披露国行Apple智能的合作细节,不过该章节后续已被删除。
搜索
据路透社援引三位知情人士爆料,苹果已和阿里巴巴展开合作,联合训练一款专门面向中国市场的大语言模型。就在8月8日,苹果悄然更新Mac使用手册,新增《在Mac上配合Apple智能使用千问》相关章节,这也是苹果首次对外官方披露国行Apple智能的合作细节,不过该章节后续已被删除。
《智能涌现》从相关人士处获悉,混元资深研究员徐灿在近期加入腾讯WeLM团队,从事大模型研发相关工作。多名知情人士透露,在姚顺雨接手腾讯大语言模型研发前,徐灿在混元LLM体系中担任后训练一个方向上的负责人。值得一提的是,这次转岗发生在微信持续强化自研大模型和Agent能力的阶段。
就在刚刚,X上网友「三只草莓」爆料,SSI正在探索一种基于TTT(Test-Time Training,测试时训练)的小型推理引擎。 据其描述,这个模型会用专门整理的数据学习「如何学习」,再在解决问题的过程中更新部分权重。
MiniMax 过去一年的 agent 实践,从一个内部飞书 bot 开始,演化成了桌面应用 MiniMax Code,最终形成了一个训练-服务的闭环:模型在自己的 harness 里训练,通过 harness 服务用户,用户行为变成训练信号反哺下一个模型。这个闭环是模型公司设计 Agent 的核心逻辑。
AI智能体训练平台Bespoke Labs宣布已完成4000万美元融资,其中A轮由Wing VC领投,Mayfield、The House Fund、dbt Labs CEO Tristan Handy,以及来自Anthropic、OpenAI和Meta的其他天使投资人参与
近日,北京航空航天大学洪晟教授团队在信息处理领域顶级期刊Information Processing&Management(IPM)上发表了最新成果。他们提出了一套名为BGA的噪声免疫神经蒸馏框架。实验显示,该框架在面对复杂的工业互联网(IIoT)加密流量时,不仅能精准识别隐藏深度极高的恶意指令,且推理延迟低至0.28毫秒,达到了“免疫级”的防干扰能力。
本文主要介绍来自该团队的最新论文 Teaching Vision-Language-Action Models What to See and Where to Look,目前该论文已经被 ECCV 2026 正式接收,相关代码和模型已全部开源。
啥情况?统治科研圈几十年的PDF格式,都需要因AI而“退休”…
只做一次生成器前向,就能得到一张图,这是一步生成追求的效率。但想把采样步数降到 1,难题其实在训练端:怎样用足够稳定、简单的监督信号,让生成分布靠近真实分布?
过去两年,self-reflection、self-correction、self-play、agentic RL、skill learning、test-time adaptation、open-ended evolution、self-evolving agent等概念不断涌现。