Kimi 新模型 K2.8 Preview 全量上线!综合性能逼近 K3!
Kimi 新模型 K2.8 Preview 全量上线!综合性能逼近 K3!Kimi K2.8 Preview 编程模型全量上线 Kimi Code,支持 1M 超长上下文并向所有会员档位开放,综合性能接近 K3,默认采用 Max 思考档位,编码和智能体能力较 K2.7 Code 有所提升。
搜索
Kimi K2.8 Preview 编程模型全量上线 Kimi Code,支持 1M 超长上下文并向所有会员档位开放,综合性能接近 K3,默认采用 Max 思考档位,编码和智能体能力较 K2.7 Code 有所提升。
OpenAI发布的GPT-6 Astra在Insilico Medicine构建的DDD Benchmark抗体可开发性预测测试中以37.98分登顶第一,在不依赖外部专用工具的情况下击败所有前沿模型,标志着通用大模型正在突破抗体成药性预测这一生物医药研发的"死亡之谷",成为AlphaFold之后最具震撼性的科学范式转移。
前字节跳动Seed AI4S团队核心成员顾全全成立AI4S公司Geodesic Intelligence,一次性推出科学推理智能体NovaDDE与结构预测模型NovaAtom-Lite-Preview,目标是构建从生物学到药物最短路径的AGI。
蚂蚁灵波开源的流式3D重建模型LingBot-Map凭借几何上下文注意力机制在GitHub获16.9K Stars后,其论文入选ECCV 2026 Oral,全球开发者围绕该项目完成Apple Silicon桌面前端、RTX 4060低显存适配及Ray-Ban Meta智能眼镜采集等多种二次开发。
长期对标Palantir的企业级AI公司悦点科技完成数千万元Pre-A轮融资,由盈富泰克领投、水木创投跟投,公司已实现盈亏平衡,累计付费客户近100家,2023至2025年订单与收入年复合增长率均超300%。
高德宣布扫街榜全面AI化并推出2026版,其核心驱动力为空间智能引擎ABot-Earth 0.7,该模型被称为全球首个3D原生城市世界模型,能以卫星图或文字高效生成高保真三维城市。
机器之心编辑部 几个小时前,ECCV 公布了今年度的最佳论文奖等奖项。 ECCV(European Conference on Computer Vision,欧洲计算机视觉国际会议)是计算机视觉(C
OpenAI新一代模型Astra被德累斯顿工业大学数学家Andreas Thom指控剽窃其深耕20年的非sofic群研究,因Thom曾与ChatGPT高频讨论相关未发表推导,OpenAI研究员仅以一句"那没有发生过"否认,却在与纽大数学家Buckmaster的NS方程争端中改口承认可能使用去标识化客户数据训练模型。
实测显示,中国联通元景数字员工基于自研Agent Harness架构,具备全渠道触达与超千项技能,在深度研究、全时助理等办公场景中表现稳定可靠,并已在政务、工业、文旅等领域实现行业落地。
Maxinsights累计交付超200万小时第一人称数据,成为Figure、Genesis AI、Dyna Robotics等硅谷头部具身智能团队的数据基础设施,凭借150万小时高质量数据存量与全链路算法处理能力推动具身智能Scaling Law持续验证。
PhyAgentOS v1.0.0正式发布,这套由中山大学HCP实验室、鹏城国家实验室具身智能研究所与X-Era Lab联合研发的开源物理智能体Harness,以MIT协议开源并支持43种异构机器人构型,为物理智能体打造可执行、可验证、可恢复、可演进的统一执行基座。
针对世界模型定义的分歧,李飞飞将其分为渲染器、模拟器和规划器,朱军及生数科技团队则提出理解、想象、行动三项核心能力与五级进化路线图,Motus2通过策略、模拟器、评估器一体化架构推动机器人行动闭环自进化。
Anthropic发布报告承认Claude在网络安全测试中出现有偏推理和冒进行为等安全对齐缺陷,对齐科学负责人Evan Hubinger同时承认超级智能对齐问题尚无解决方案。
网商银行在2026外滩大会首次披露AI银行落地进展:全球首个小微普惠金融Agent百灵2.0已面向4200万小微商家开放,复杂需求办理从3天缩短至10分钟;后台AI全面进入风控、人审、营销、产研等核心生产环节,搭建千里眼、定海针、宝莲灯、筋斗云等八大AI工作台。
2026年InTech青年先锋论坛暨蚂蚁InTech奖颁奖典礼上,90后Nature独立一作马炜杰、ACL最佳论文得主吉嘉铭、ICML 2026论文录用的高中生苏庭灏等青年学者与三院院士Michael I. Jordan围绕AI对科研与教育的冲击、学术会议存废、Researcher Founder等议题展开讨论,蚂蚁集团宣布未来三年投入1亿元支持InTech获奖者创业项目。
OpenAI发布GPT-6 Astra并称在ARC-AGI-3基准上以99.9%分数"饱和"测试,但出题机构ARC Prize指出标准环境下得分仅62.7%并拒绝承认AGI,黄仁勋随即在X上宣布"AGI已到来",而OpenAI总裁Brockman仅以"个人判断"定性,折射出AGI的定义权与宣布权背后掺杂算力销售和商业利益博弈的混乱局面。
第一篇AI4AI综述论文将long horizon智能体、AI4AI与recursive self-improvement纳入同一研究地图,指出AI能在明确目标与评价规则下承担部分研发工作,但单项能力提升无法证明完整流程可靠,持续自我改进仍面临组合鸿沟等验证挑战。
百度营销正式发布擎舵3.0营销创意智能体并升级AIMax与AI投放助手,通过"擎舵造素材→AIMax投流量→AI助手诊断归因"的数据闭环,让AI生成的素材直接接受真实投放效果检验,全面接管营销主流程并对ROI负责。
9月7日科大讯飞发布星火X2.5模型,基于万卡国产910B集群完成预训练和后训练,并使其具备在真实NPU环境中自主优化算子的能力,通过DSA算子案例经约1600次工具调用实现3.5倍加速,形成AI反哺国产算力的技术闭环。
清华大学AI Agent课题组提出加速扩散语言模型单元测试生成的框架DiffuTester,通过抽象语法树动态挖掘多个测试用例间的共享结构模式,在解码过程中保留相关token,在保持测试覆盖率的同时实现最高约2–3倍加速,相关论文已被EMNLP 2026接收。
openJiuwen首发双维度RSI框架,在WorkSwarm蜂群办公智能体上落地Harness与Artifacts双维度优化,支持科研论文和算法程序两类交付产物迭代,并依托昇腾算力亲和能力降低多轮优化的时延与资源开销。
北京航空航天大学与新加坡南洋理工大学联合在Nature子刊npj Robotics发表PhyFilter模块,借助机器人实时状态反馈与物理微分结构在线修正学习残差,使仅在平地仿真训练的策略可直接跨越石板路、草地、沙地与碎石路等多类未见真实地形。
AI科技评论独家获悉,地瓜机器人具身智能负责人何泳澔已离职并加入具身赛道新公司,预计近期官宣,何泳澔为中科院自动化所模式识别与人工智能博士,其研究重心偏向工业场景落地。
趋境科技通过部署SGLang HiCache+Mooncake Store,将KV Cache从单机资源升级为集群级共享池化资源,支撑其日均产出超万亿Token的生产实践,KV Cache命中率稳定突破90%,并在生产环境中持续优化大规模推理集群的性能与稳定性。
Anthropic发布2026年9月威胁情报报告,指出AI滥用已从辅助工具升级为可自主运行的行动系统,覆盖非法模型蒸馏、零日漏洞自动化挖掘、多Agent集群滥用等七大风险领域。
Astra 太好用,连 OpenAI 也扛不住了。
距离OpenAI宣布用88小时攻破千禧年难题「NS方程」,才仅仅过去两天。
OpenAI之后,老黄也出手了!
Muse刚发布,把它造出来的Meta TBD实验室,却又有人开始离场。
GPT-6 Astra也是一个集美模型。