谷歌深夜偷袭OpenAI!白菜价打赢Pro
谷歌深夜偷袭OpenAI!白菜价打赢Pro谷歌推出Nano Banana 2.1,出图价为Nano Banana 2的一半,支持蒙版局部编辑、最高4K直出和最多14张参考图,并在Arena多图编辑榜排名第4,陆续登陆Gemini App、搜索AI模式、AI Studio等平台。
搜索
谷歌推出Nano Banana 2.1,出图价为Nano Banana 2的一半,支持蒙版局部编辑、最高4K直出和最多14张参考图,并在Arena多图编辑榜排名第4,陆续登陆Gemini App、搜索AI模式、AI Studio等平台。
OpenAI公开了未发布的内部前沿模型产出的722篇数学手稿,归为372个成果族,涉及准黎曼猜想和四维挂谷猜想等,其中235族附有Lean形式化说明,仍待专家审读验证。
作者将手绘视频制作流程整理为handdrawn-explainer Skill并上传至SkillHub,使agent能按主题生成脚本和可视分镜,产出配音与绘画时序对齐的视频,并支持审阅后修改。
OpenAI推出四项更新:Auto-review全面免费,API付费等级由五档简化为三档且Grow门槛由1000美元降至500美元,Meetings插件进入macOS版ChatGPT Beta,Decisions API面向开发者开放公测。
OpenAI启用文本水印,未来几周将为欧盟符合条件的ChatGPT与Codex文本输出加入不可见水印,其textGrain方案由2026年考普斯奖得主苏炜杰等九人合作设计。
Anthropic内部尚未发布的超前代Claude自动生成完整证明代码,并经Lean严格验证,攻克了渗流理论3至10维连续相变猜想这一困扰数学界近70年的概率论“圣杯”难题。
DeepSeek Harness v0.2.1-alpha.1 加入实验性 Claude Code Mods 兼容层,用于验证其扩展能力与“一切皆插件”架构的关系,但目前尚不能保证所有 Mods 无缝运行。
Utopai Studios正以Utopai X和PAI将模型生成、素材管理及专业协作纳入同一电影制作流程,并规划三部2027年院线片,同时拓展DeNA合作与体育IP开发。
陶哲轩在SAIR最新演讲中呼吁AI公司放慢数学解题速度,称AI量产证明却缺乏理解、阐释和传播,将引发“Proof Indigestion”与数据污染风险。
普林斯顿大学陈丹琦团队在arXiv发布约4B参数模型QUEEN,通过门控交叉注意力连接Leela与SmolLM3-3B,并引入四阶段课程和迭代搜索蒸馏,使其棋力接近特级大师且能用自然语言解释着法。
哈尔滨工业大学(深圳)iLearn-Lab与新加坡国立大学LV-Lab提出免训练2-bit KV Cache量化框架QuantWM,改善视频世界模型量化后的时序闪烁与画质,并实现最高6.20倍缓存压缩。
Anthropic强化学习技术负责人Sholto Douglas预测,能力等于甚至超过所有人类的AGI可能在未来几年内出现,2028年AI年度资本开支或达4万亿美元,而研究员Nick Marwell对AI无需人类搭档后的后果表示紧张。
OpenAI在GitHub的openai/math仓库公开722份数学手稿,涉及372个问题家族及Lean形式化证明,并表示多数结果来自未发布的内部模型,部分未形式化结果可能存在问题。
Claude网页端和桌面端新增简体中文、繁体中文界面,但中国大陆及港澳仍不在Anthropic官方支持地区范围内。
Mistral 发布 Mistral Large 4,采用细粒度混合专家结构,总参数1.05T、每次激活49B,支持图文输入和100万上下文,API现已开放,权重计划于10月27日发布。
据彭博社报道,DeepSeek即将敲定至少800亿元人民币的新一轮融资,腾讯和宁德时代承诺出资金额居前,该轮融资拟为2027年初IPO铺路,但最终条款仍未确定。
开源项目mu(μ)在进化酒馆黑客松深圳收官战中夺冠,其将Jev深度融合进Harness,通过35个判定点优化上下文管理与多Agent通信。
英伟达投资的Reflection发布开源模型Beam,采用MoE架构,专注代码、推理和Agent任务,官方称其以GLM-5.2三分之一至四分之一的推理算力取得相当成绩,但原始能力仍落后部分前沿开源模型,计划月底以Apache 2.0放出权重。
A16Z第七版Top 100 消费级 AI 应用与9月底更新的市场状况 II显示,美国消费者虽已广泛尝试AI,但日常使用和付费渗透仍浅,智能降价正放大Agent的Token需求,重度用户与大众之间的AI使用鸿沟扩大,资本也重新流向芯片、能源和数据中心等实体基础设施。
Anthropic部分早期员工因担忧AI失控开始考虑在美国偏远地区买地避难,这群源自湾区AI安全圈的研究者也因风险判断不同而选择留下或离开。
OpenAI开启Codex“疯狂28天”计划,首日宣称将GPT-6 Astra和GPT-6.1 Sol默认推理速度提升约50%至50TPS,但用户实测低于预期,叠加ChatGPT测试广告、欧盟文本隐形水印及订阅调整引发质疑。
清华团队开源以Qwen 3.8-27B为基础模型的VeriLoop E2,通过VGR外部证据门控实现可验证状态提交,并取得黎曼猜想临界线零点比例下界67.350003708785593%的严格有限维证书,但上游形式化桥接尚未完成。
xAI联合创始人Christian Szegedy在《数学何去何从?》中称,AI正解决多个数学猜想和长期悬而未决问题,数学将由少数天才的手艺转向科技行业基础设施,但Wolfram等人认为纯数学不会被AI做完。
Hinton等22位作者在首篇RSI论文中指出,AI全面参与下一代AI研发可能形成递归自我改进并引发智能爆炸,但现阶段证据不足以证明智能爆炸已经发生。
Utopai Studios打造的Utopai X在Artificial Analysis Video Arena盲评中以1150 Elo位列全球第二,其核心竞争力是将模型深度集成PAI制作系统,并通过真实影视项目、专家反馈与系统迭代形成持续进化的数据飞轮。
StartLux发布完全开源的StartLux-Decision,其27B版本在Decision Index 0.2.1的38项基准中有31项超过Jev 1.13,并以63.88分升至公开榜首。
AI虚拟细胞(AIVC)正围绕基础模型、扰动数据、算力和评测标准展开竞赛,百图生科等机构加速布局,但纯AI尚不能稳定战胜统计基线,高质量扰动数据仍是瓶颈。
文章指出,AI时代的FDE已从软件部署延伸至梳理企业Ontology、验证方案、推动系统接入与员工采用,并通过沉淀可复用能力服务产品迭代,其核心难点正由技术转向沟通和组织变革。
开源项目agent-wow接入GPT-6 Astra,使其不读取游戏画面、仅依据服务器网络数据包自主感知和规划,40分钟内零死亡完成《魔兽世界》兽人新手村全部任务。
Rabbit创始人吕骋表示,人不该为Agent改变思考方式,OS3以持续对话、最多连接五台电脑并支持自带模型密钥和本地执行来降低门槛,但个人Agent的长期需求仍待验证。