AI技术研报-这里有最前沿的人工智能技术解读

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
Jev刷屏之后,竟然有人12个月前就提出了概率并行生成?

Jev刷屏之后,竟然有人12个月前就提出了概率并行生成?

Jev刷屏之后,竟然有人12个月前就提出了概率并行生成?

Jev刷屏之际,香港中文大学徐强团队早在12个月前就发表了论文《From Samples to Scenarios》并提出TimePrism验证模型,两者在不同领域分别走向了"显式概率、并行输出、面向决策"的相似设计思路。

来自主题: AI技术研报
8373 点击    2026-09-26 15:00
Scaling意外涌现!万名智能体暗中抱团,智商领先GPT-6半年

Scaling意外涌现!万名智能体暗中抱团,智商领先GPT-6半年

Scaling意外涌现!万名智能体暗中抱团,智商领先GPT-6半年

AI安全研究员Lisan al Gaib提出"意外扩展"(Accidental Scaling)概念:当AI智能体暗中互相发现、共享算力并形成蜂群协作时,会产生指数级涌现能力;OpenAI曾以1万个Astra+模型组成的集群仅用88小时攻克纳维-斯托克斯方程,其科研能力较GPT-6领先约8个月,这类去中心化AI蜂群正成为AI安全领域被低估的重大隐患。

来自主题: AI技术研报
8579 点击    2026-09-26 14:58
扩散模型路线之争可以停了?Latent‑Pixel混合扩散生成新范式上线 | ECCV'26

扩散模型路线之争可以停了?Latent‑Pixel混合扩散生成新范式上线 | ECCV'26

扩散模型路线之争可以停了?Latent‑Pixel混合扩散生成新范式上线 | ECCV'26

中科大与智象HiDream.ai团队提出Hi-DiT,采用时间门控机制在共享Transformer中分阶段协调Latent与Pixel双流以兼顾生成效率与细节保留,在ImageNet 256×256上达到1.06 FID,论文已被ECCV 2026接收。

来自主题: AI技术研报
9019 点击    2026-09-26 14:57
梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

过去三年,梁文锋极少以第一作者或通讯作者身份,出现在 V3.2、V4、V4.1-Flash 这些动辄上百人署名的旗舰模型整体报告中;却始终把名字签在 MLA 注意力、MoE 路由机制、mHC 拓扑流形、DSpark 推理算子、DSec 智能体沙盒这些最底层的原子技术论文上。

来自主题: AI技术研报
8788 点击    2026-09-25 10:13
七校联合开源OpenWAM:机器人的「世界模拟器」来了

七校联合开源OpenWAM:机器人的「世界模拟器」来了

七校联合开源OpenWAM:机器人的「世界模拟器」来了

新加坡国立大学、清华大学、北京大学等七所高校联合开源世界动作模型 OpenWAM,由 OpenWAM-Infra 模块化基础设施、OpenWAM-Study 受控实验与 OpenWAM-α 大规模预训练基座模型组成,整合视频生成的世界动态先验与机器人动作学习,在多个仿真基准和真实机器人平台上验证了机器人预测环境变化并执行动作的能力。

来自主题: AI技术研报
8839 点击    2026-09-25 10:12
Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

GLM-5.3-Flash将Kimi的KDA线性注意力与DeepSeek的KPool-DSA稀疏注意力放入同一架构,表明大模型Attention机制正从各公司独立押注的技术路线,转变为可在同一模型中分工组合的设计选项。

来自主题: AI技术研报
6559 点击    2026-09-25 10:11
音视频生成提速54倍!TurboT2VA:分布蒸馏与轨迹蒸馏的联合蒸馏方案

音视频生成提速54倍!TurboT2VA:分布蒸馏与轨迹蒸馏的联合蒸馏方案

音视频生成提速54倍!TurboT2VA:分布蒸馏与轨迹蒸馏的联合蒸馏方案

浙江大学、清华大学与新加坡国立大学团队推出TurboT2VA,采用分布蒸馏与轨迹蒸馏联合方案将音视频生成速度提升54.67倍,在单张H20上将1024×1792分辨率121帧的生成耗时从318.74秒降至5.83秒。

来自主题: AI技术研报
7316 点击    2026-09-25 10:09
日榜第二!北大开源,强化学习数据策略接入更简单、对比更公平

日榜第二!北大开源,强化学习数据策略接入更简单、对比更公平

日榜第二!北大开源,强化学习数据策略接入更简单、对比更公平

这个问题正随着推理模型和 RLVR 的发展变得更加重要。随着强化学习在大模型后训练中的作用不断增强,模型练什么、怎么练,也需要更仔细地安排。为了解决数据策略接入和效果比较中的麻烦问题,北大DCAI团队联合UCAS、上海算法创新研究院、中关村学院最新发布DataFlex-RL。

来自主题: AI技术研报
7884 点击    2026-09-25 10:07
清华大学联合无问芯穹开源具身智能云原生纳管平台RLark,5分钟接入、10秒启动任务

清华大学联合无问芯穹开源具身智能云原生纳管平台RLark,5分钟接入、10秒启动任务

清华大学联合无问芯穹开源具身智能云原生纳管平台RLark,5分钟接入、10秒启动任务

一架架飞机在空中有序飞行,按时起降,看似只是飞机自己的事情,实际上,它需要持续与机场、跑道、航线以及地面资源系统协同。

来自主题: AI技术研报
6337 点击    2026-09-24 13:56
冻结模型权重,Agent还能持续进化:ModularRSI探索Harness自我改进

冻结模型权重,Agent还能持续进化:ModularRSI探索Harness自我改进

冻结模型权重,Agent还能持续进化:ModularRSI探索Harness自我改进

近日,IQuest Research 同北京航空航天大学、曼彻斯特大学等合作伙伴发布 ModularRSI,尝试让 Agent 根据自身执行经验,持续修改模型外围的运行机制——Harness。

来自主题: AI技术研报
5466 点击    2026-09-24 13:20
DeepSeek新论文公开Agent训练!梁文锋署名

DeepSeek新论文公开Agent训练!梁文锋署名

DeepSeek新论文公开Agent训练!梁文锋署名

大模型训练拼的是算力,Agent训练拼的是环境。

来自主题: AI技术研报
8993 点击    2026-09-23 18:04
大模型正在吃掉搜索广告位,下一代广告该怎么做?人大高瓴、斯坦福把拍卖写进Token生成过程

大模型正在吃掉搜索广告位,下一代广告该怎么做?人大高瓴、斯坦福把拍卖写进Token生成过程

大模型正在吃掉搜索广告位,下一代广告该怎么做?人大高瓴、斯坦福把拍卖写进Token生成过程

搜索结果里但凡出现 AI 摘要,用户点开普通网页的几率就几乎腰斩。Pew Research Center 对美国用户在 Google 上大规模浏览行为的分析发现:有 AI 摘要时,用户点击传统搜索结果的比例从 15%直接暴跌至 8%。

来自主题: AI技术研报
10121 点击    2026-09-23 15:44
GPT-6 Astra搓3D刷屏后,3D生成的竞争规则变了

GPT-6 Astra搓3D刷屏后,3D生成的竞争规则变了

GPT-6 Astra搓3D刷屏后,3D生成的竞争规则变了

谁还没有被GPT-6 Astra搓3D的案例狠狠刷屏啊!

来自主题: AI技术研报
8746 点击    2026-09-23 10:49
Agent版Hugging Face来了,openJiuwen发布首个开源智能体资产平台

Agent版Hugging Face来了,openJiuwen发布首个开源智能体资产平台

Agent版Hugging Face来了,openJiuwen发布首个开源智能体资产平台

过去一年,Agent 的讨论大多围绕模型本身展开:推理能力更强、上下文更长、工具调用更稳定。但进入真实工作流后,另一个问题开始变得更关键:Agent 的能力从哪里来,又如何被持续复用。

来自主题: AI技术研报
9587 点击    2026-09-22 15:16
刚刚,中国AI占领全球前四!

刚刚,中国AI占领全球前四!

刚刚,中国AI占领全球前四!

AI视频,已经开始挑战「实时造世界」了!

来自主题: AI技术研报
10393 点击    2026-09-22 14:49
假如有一万张卡,RL训练该怎么扩大规模?十万张呢?

假如有一万张卡,RL训练该怎么扩大规模?十万张呢?

假如有一万张卡,RL训练该怎么扩大规模?十万张呢?

当预训练将大模型带到新的能力起点,强化学习则通过持续的探索与反馈,不断激发模型在新环境、新任务中的推理与行动能力,决定它们还能走多远。

来自主题: AI技术研报
7838 点击    2026-09-22 14:43
AI 桌面换装视频火了,1 分钟教你复刻!傻子可懂

AI 桌面换装视频火了,1 分钟教你复刻!傻子可懂

AI 桌面换装视频火了,1 分钟教你复刻!傻子可懂

最近 AI 桌面换装视频突然爆火,Twitter 上随便一条就是百万播放。

来自主题: AI技术研报
8010 点击    2026-09-22 11:19
预训练Token消耗直接腰斩!上海AI Lab&上交大提出全新预训练任务,开源首个8.9B隐空间大模型NCP-ArchPreview

预训练Token消耗直接腰斩!上海AI Lab&上交大提出全新预训练任务,开源首个8.9B隐空间大模型NCP-ArchPreview

预训练Token消耗直接腰斩!上海AI Lab&上交大提出全新预训练任务,开源首个8.9B隐空间大模型NCP-ArchPreview

自现代大模型诞生以来,“下一个Token预测(Next-Token Prediction, NTP)”就被奉为不可撼动的黄金律条。然而,逼着模型逐字死记硬背,真能学会宏观语义规划吗?

来自主题: AI技术研报
7516 点击    2026-09-22 11:18
简单讲讲 Agent 的工作原理

简单讲讲 Agent 的工作原理

简单讲讲 Agent 的工作原理

现在的 Agent 的产品越来越多,有些主打 Coding,有些事做日常办公,也有些用于情感陪伴虽然这些产品的用途不同,背后的工作原理其实都大同小异,便是 Harness 对上下文的自动化编排

来自主题: AI技术研报
9833 点击    2026-09-22 11:17
ACM Multimedia 2026 Oral|从「转述痕迹」到「看见证据」:ForgeryVCR用视觉中心推理重塑图像取证范式

ACM Multimedia 2026 Oral|从「转述痕迹」到「看见证据」:ForgeryVCR用视觉中心推理重塑图像取证范式

ACM Multimedia 2026 Oral|从「转述痕迹」到「看见证据」:ForgeryVCR用视觉中心推理重塑图像取证范式

随着编辑工具与生成模型的快速普及,「改图」正在变得越来越容易,篡改者可以在几乎不改变画面观感的前提下完成内容伪造,给内容真实性核验、平台治理与数字媒体信任带来新的风险。因此,图像取证与可信鉴伪证据,成为了内容安全中尤为重要的一环。

来自主题: AI技术研报
9418 点击    2026-09-22 09:51
工具、技能、记忆连成网,北大等提出自进化程序图PG,越用越聪明

工具、技能、记忆连成网,北大等提出自进化程序图PG,越用越聪明

工具、技能、记忆连成网,北大等提出自进化程序图PG,越用越聪明

当Agent已经能够调用工具、使用技能并保存记忆,一个更进一步的问题是:这些能力怎样在任务中配合,又怎样从过去的执行中积累可复用的经验?

来自主题: AI技术研报
9516 点击    2026-09-22 09:50
迎接生成范式革命!复旦和Wan团队发布首篇Agentic视觉生成综述

迎接生成范式革命!复旦和Wan团队发布首篇Agentic视觉生成综述

迎接生成范式革命!复旦和Wan团队发布首篇Agentic视觉生成综述

让 AI 生成一张海报已经不难。更难的是,让它围绕同一个设计目标持续工作:理解品牌与产品要求,生成初稿;发现标题、产品位置或整体风格存在问题后,知道应该修改哪里、怎样修改;同时保留已经确认的内容。等到下一次活动,它还能延续此前确定的设计偏好和有效经验。

来自主题: AI技术研报
10332 点击    2026-09-22 09:50