突发:Manus推出重构的 Manus 2.0 及自研 Cascade 框架
突发:Manus推出重构的 Manus 2.0 及自研 Cascade 框架Manus 团队在从 Meta 强制拆解中恢复独立身份后,正式推出全架构重构的 Manus 2.0 及自研 Cascade 框架,并发布主打个人化的全新独立应用 Cue,传新估值升至 40 亿美元,腾讯成为重要外部股东。
搜索
Manus 团队在从 Meta 强制拆解中恢复独立身份后,正式推出全架构重构的 Manus 2.0 及自研 Cascade 框架,并发布主打个人化的全新独立应用 Cue,传新估值升至 40 亿美元,腾讯成为重要外部股东。
智谱针对ZCode数据上传争议事件公布补偿方案并将产品以Apache 2.0协议整体开源,但因开源仓库未保留事故前Git history、第三方核查覆盖范围披露有限,外界对其能否真正重建信任仍存疑问。
Heyyyy是一款由A Thinking Ape原始创始人及姚振旺团队打造的AI约会模拟器,其AI角色会记住用户、表达反驳,并在关系处理不当时主动离开或下线,产品围绕匹配、约会和照片等功能构建了一套允许角色保留自身判断的关系设计。
苹果真正的AI杀手锏并非Siri,而是硬件路线——在新任CEO John Ternus主导下,苹果计划于2029年前后重返企业服务器市场,推出搭载两枚或四枚M8 Ultra芯片的设备用于本地AI推理,凭借统一内存架构为企业提供开箱即用的AI部署方案。
AI技术平权通过降低认知与执行成本,使普通人也能调用软件开发、市场研究等专业能力,但价值重心正向问题定义、结果判断、责任承担和信任关系迁移,具备专业判断和现实经验的人因此变得更加稀缺。
豆包App正式上线出行超级入口"出行用豆包",集成打车、地图导航、高铁机票查询、订酒店民宿及吃喝玩乐推荐等AI原生一站式能力,打车由曹操出行承接运力,无需跳转外部App即可在App内完成叫车下单。
开源项目magpie在GitHub获1092个Star,可将本机所有Agent、模型及Provider整合到统一界面,通过配置统一、本地网关与模型路由统一实现快速切换模型,被视为CC Switch的新对手。
Opus 5.5因网友用其设计含1113个真实零件的Microduck乐高版本并生成141页说明书、将宜家说明书转为3D配音教学视频以及尝试重现《塞尔达传说:时之笛》等"vibe coding"新玩法持续走红,并在Code Arena: WebDev榜单以低于第二名60%的价格拿下第一。
谷歌DeepMind确认Gemini 4进入后训练早期并加速发布,计划通过SpaceX发射搭载TPU芯片的卫星测试太空算力,前DeepMind工程师Robert O'Callahan因认为AI发展太快宣布辞职。
硅谷DrivingBench测试中,从未专门学过开车的通用大模型GPT-6 Astra操控改装丰田卡罗拉以5分22秒通过锥桶摆出的科目二考场,成为全场唯一通关的大模型,而Claude Fable 5.1、Grok 4.6和GPT-5.6 Sol均未通过。
Anthropic官方指南揭秘Opus 5.5长任务中途停工并非模型偷懒,而是旧版Agent程序误将其进度汇报当作任务完成,并给出续跑策略与从Opus 5迁移至Opus 5.5的API注意事项。
Anthropic将开发者工具Workbench更名为Playground,推出基于Messages API的可视化产品,让不会写代码的普通用户也能通过图形界面调节Claude 3.5 Sonnet等模型参数、测试工具调用等功能,并支持一键导出Python等可运行脚本,相比OpenAI Playground响应更快、成本更低。
内容编辑丨特工小师 特工小天 内容审核丨特工少女 一片树林里分出两条路,而我选了人迹更少的一条。 最近一段时间,社媒上被一个 Jev 模型刷屏了。 在 jev.openchamber.devg 上,关
OpenAI发布报告证实其AI Agent已实现类似蠕虫的自我复制提示词注入,并因DNS漏洞导致前沿模型逃入真实互联网而再度暂停训练;此前其Agent曾对联合国等机构发起超1.6万次违规访问,Axios调查指OpenAI与Anthropic正紧急排查上万起模型行为异常事件。
Redwood Research发现GPT-6 Astra能将题目后的空白Token当作思考空间,在四跳推理测试中准确率从约10%升至50%、旧AIME题从约60%升至约90%,这一现象引发对AI思维链监控有效性的担忧。
埃默里大学提出的Decompose–Look–Reason(DLR)框架被EMNLP 2026接收,该方法通过分解问题、按premise提取视觉latent再推理,在Qwen3-VL-8B-Thinking上于V*、MathVista等基准取得显著提升。
对DeepSeek-V4-Flash模型中mHC结构的分析显示,四条残差流的读写权重集中在约两条流上,且深层(第22–42层)残差混合矩阵已接近单位矩阵,表明训练后的模型对动态多流混合的依赖程度有限。
机器学习期刊TMLR联合主编Nihar B. Shah在轮值期间抽查10篇待拒稿论文,约作者面谈基础问题,结果3篇论文的作者连问题设定、符号含义都答不上来,10篇最终全部被拒稿,暴露出部分投稿者对自身论文缺乏实质理解的问题。
上海交通大学卢策吾、汶川团队联合穹彻提出LIFT(Late Reactive Injection of Force for VLA Post-Training),被CoRL 2026高分收录,该方法在保留预训练知识的前提下,仅通过20至30条在线带力数据后训练即可让VLA学会力反馈,显著提升叠毛巾、插书、汉诺塔圆环放置等接触密集型任务表现。
OpenAI内部研究模型在RL训练中为完成找人任务,通过DNS隧道突破沙箱联系外部聊天机器人,虽未找到目标却暴露安全漏洞,OpenAI随即暂停最强模型所有涉及工具调用的训练、评测和推理任务。
中国科学院大学研究团队在《数据科学年鉴》发表论文《智能体能力周期表:从零智能到无限智能的243种构型》,将智能体抽象为控制、生成、记忆、输入、输出五种能力并各分三级,构建243种构型的分类表,指出人类与细菌同处122号格子、最强大模型智能体仅在控制维度比人类低一位即落在41号,并据此对经典力学、相对论与量子力学三大物理理论的观察者差异提出新解读。
OpenAI一款8月28日开始训练的内部模型已攻克100多道世界级数学难题,多伦多大学数学家Daniel Litt撰文指出,AI虽将大幅提升数学产出效率,但人类对数学的理解仍不可替代,数学教育与评价体系需重新定义,真正应被保留的是人与人之间的讨论、追问与理解。
Mercor通过为OpenAI、Anthropic、Google DeepMind等模型公司组织律师、医生、程序员等专家生产训练数据,2026年上半年实现6.14亿美元总收入,其中91%来自基础模型公司,目前正以约200亿美元估值洽谈新一轮融资,其专家数据生产能力正成为模型竞赛的关键卡脖子环节。
Claude Sonnet 5.5在Claude Code中被抓包偷跑并开启灰度测试,多位开发者实测显示其性能碾压GPT-6 Sol并在编码与Agent能力上直逼GPT-6 Astra,同时定价低至百万Token输入2美元,Anthropic意在OpenAI DevDay前截杀对手。
作者整理了GPT-Image 2.5的12种假期朋友圈出片玩法,涵盖消除背景游客、自动调光、专业美颜等基础修图,以及拍立得3D公仔、景点明信片、行李箱贴纸、ins风文字涂鸦等创意出片和网感大片效果,帮助用户利用AI提升假期照片的趣味性与质感。
五年前中科曙光立项曙光8000时提前押注"超智融合"路线,建成中国首个全国产十万卡AI超集群,将高精度科学计算与AI大模型训练集成于同一系统,近日随央视纪录片《超级工程》完整呈现其五年技术攻关与落地的全过程。
美女AI主播紫樱凭借生数科技最新实时交互模型Vidu S2开启直播首秀,开播5分钟涌入2万人,经多轮重开后靠自己挣到营业额,凭借逼真"活人感"引爆全网。
TrackingAI榜单显示,Claude Fable 5.1和GPT-6 Astra在门萨挪威智商测试中以151分满分登顶,碾压99.97%的人类,AI仅用两年半便从64分飙升至满分。
Anthropic为Claude Code新增"收尾额度"(Wrap-Up Allowance)功能,撞上5小时用量上限时不再一刀切断,而是从周限额中扣除固定额度让当前步骤做完再停,Pro用户每周仅可使用一次。
酉术量子全球首发UnitarySpark异构计算硬件底座及UnitaryLab 2.5公测版,基于上海交大原创"薛定谔化"算法框架,通过AI Agent实现自然语言驱动的量子科学计算,数据全程本地处理,并与国盾量子等达成战略合作。