AI技术研报-这里有最前沿的人工智能技术解读

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
北大与微软亚研提出 BCP,让模型自己决定何时重规划

北大与微软亚研提出 BCP,让模型自己决定何时重规划

北大与微软亚研提出 BCP,让模型自己决定何时重规划

在 action chunking 已成为 VLA 标配的今天,「一次执行多少步」几乎被所有工作当作一个固定的超参数。

来自主题: AI技术研报
5567 点击    2026-08-20 14:22
世界模型驶入F1赛道:探索极限工况下具身智能体的认知物理边界

世界模型驶入F1赛道:探索极限工况下具身智能体的认知物理边界

世界模型驶入F1赛道:探索极限工况下具身智能体的认知物理边界

当自动驾驶赛车以近 300 km/h 的时速在 F1 赛道上与周车进攻防守、交互博弈,它面对的问题早已不只是提升圈速。

来自主题: AI技术研报
7046 点击    2026-08-20 14:19
我在 GitHub 翻到 21 个 Skill,产品经理的活它全接了

我在 GitHub 翻到 21 个 Skill,产品经理的活它全接了

我在 GitHub 翻到 21 个 Skill,产品经理的活它全接了

一个需求从零推到能开发,我得写调研问卷、拆竞品、出原型、写 PRD,就是给研发看的那份需求说明书,然后拉上研发测试设计法务开评审会,最后再补一份埋点方案,说清楚上线之后用户每个动作要记哪些数据。

来自主题: AI技术研报
5905 点击    2026-08-20 09:36
DeepSeek Harness满血版解锁!Seed牛来版!

DeepSeek Harness满血版解锁!Seed牛来版!

DeepSeek Harness满血版解锁!Seed牛来版!

上两天肝的视频上了热搜 + 热门,使用插件,针对 ds 模型可以提升不小的性能。

来自主题: AI技术研报
7365 点击    2026-08-20 09:03
我把 DeepSeek Harness 的代码做成了可视化教程

我把 DeepSeek Harness 的代码做成了可视化教程

我把 DeepSeek Harness 的代码做成了可视化教程

今天想和你聊聊 DeepSeek Harness。

来自主题: AI技术研报
9701 点击    2026-08-19 15:42
AI视频运镜玄学已破!告别无限抽卡,3D预演台直接封神

AI视频运镜玄学已破!告别无限抽卡,3D预演台直接封神

AI视频运镜玄学已破!告别无限抽卡,3D预演台直接封神

用 AI 做视频的同学总有这样的痛苦:提示词也不是没认真写,运镜方向、人物走位、画面构图交代了一大段,但模型给出的画面总是差着一截,运镜偏了几十度,人物走到中途消失,镜头速度前半段稳后半段飘。

来自主题: AI技术研报
9555 点击    2026-08-19 15:23
ScienceDiscovery发布:零科研幻觉的一站式AI工作台,BiomniBench-DA验证效果业界SOTA

ScienceDiscovery发布:零科研幻觉的一站式AI工作台,BiomniBench-DA验证效果业界SOTA

ScienceDiscovery发布:零科研幻觉的一站式AI工作台,BiomniBench-DA验证效果业界SOTA

ScienceDiscovery 是基于 Agent OS(JiuwenSwarm)开发的一款面向跨学科、全流程科研场景的一站式 AI 工作台,解决科研场景面临的工具碎片化、大模型科研幻觉两大痛点问题,打造 AI 辅助科研新范式,加速科学发现,广泛应用于各行各业。

来自主题: AI技术研报
7003 点击    2026-08-19 15:04
用3D几何先验驱动视频扩散,实现更一致的世界生成

用3D几何先验驱动视频扩散,实现更一致的世界生成

用3D几何先验驱动视频扩散,实现更一致的世界生成

随着视频扩散模型能力不断提升,从单张图像出发、按照用户指定的相机轨迹生成新视角视频,正在成为 World Modeling 的重要技术路线。

来自主题: AI技术研报
5940 点击    2026-08-19 15:04
浙大团队开源AI科研智能体Polaris:让AI与你一起做研究

浙大团队开源AI科研智能体Polaris:让AI与你一起做研究

浙大团队开源AI科研智能体Polaris:让AI与你一起做研究

科研的链条很长。文献读不完,方向想不清,实验一轮接一轮,论文改到深夜。过去两年,大模型已经能读论文、写代码、改文章,但它们大多以问答工具的形态散落在各个环节,替研究者节省的只是零碎时间。

来自主题: AI技术研报
8138 点击    2026-08-19 15:03
至知研究院提出大模型可解释性新路线:直接拆权重,数据成本不到1%

至知研究院提出大模型可解释性新路线:直接拆权重,数据成本不到1%

至知研究院提出大模型可解释性新路线:直接拆权重,数据成本不到1%

大模型机制可解释性研究中,一直存在一个颇具反差的现实: 为了理解一个已经训练好的模型,研究者往往需要先训练一套新的稀疏表示。

来自主题: AI技术研报
5969 点击    2026-08-19 14:39
解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

视觉 - 语言 - 动作(VLA)模型已成为端到端自动驾驶的主流技术路线,但基于自回归(AR)解码的现有架构面临双重结构性瓶颈:其一,逐 Token 串行生成导致推理延迟随序列长度线性增长,严重制约实时部署;其二,训练阶段依赖真实前缀的 teacher forcing 机制,使模型在推理时暴露于自身生成的误差之上,引发长时序累积的曝光偏差(exposure bias)。

来自主题: AI技术研报
6428 点击    2026-08-19 14:39
但凡用预演台做视频,《牛来》也不至于这么抽象

但凡用预演台做视频,《牛来》也不至于这么抽象

但凡用预演台做视频,《牛来》也不至于这么抽象

玩 AI 视频有一段时间了,经验说不上多,但有一件事我算是想明白了:提示词这条路,走到头也就那样。

来自主题: AI技术研报
7371 点击    2026-08-19 11:08
起猛了,机器人开上卡丁车了!

起猛了,机器人开上卡丁车了!

起猛了,机器人开上卡丁车了!

今天,Symbiosis Robotics(共生知行)放出了一段新演示。

来自主题: AI技术研报
6325 点击    2026-08-19 11:06
机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

端到端策略模型在物理世界频频失灵,研究者转向 “大模型智能体 + 工具调用” 自救,试图在动态物理世界中持续学习。然而,这条在线学习路径在物理世界仍未真正走通。

来自主题: AI技术研报
6882 点击    2026-08-18 15:27
世界模型一口气输出小时级视频不跑偏,开源了

世界模型一口气输出小时级视频不跑偏,开源了

世界模型一口气输出小时级视频不跑偏,开源了

视频世界模型跑久了,往往面临三个问题: 画面发灰发糊或者过曝过饱和、场景悄悄换了地方、显存先撑不住。

来自主题: AI技术研报
5449 点击    2026-08-18 11:14
Transformer祖传设计遭暴击,COLM顶会三篇论文发难

Transformer祖传设计遭暴击,COLM顶会三篇论文发难

Transformer祖传设计遭暴击,COLM顶会三篇论文发难

Transformer的许多关键技术,在一场会议上集体塌房了?!

来自主题: AI技术研报
10075 点击    2026-08-18 10:51
ECCV 2026 | 一段视频,重建一个可仿真的动态世界

ECCV 2026 | 一段视频,重建一个可仿真的动态世界

ECCV 2026 | 一段视频,重建一个可仿真的动态世界

机器人走出实验室后,训练数据不再只是 “多不多” 的问题:环境能否覆盖真实世界的尺度、遮挡、接触和运动,直接决定策略能否落地。Real2Sim 因此重新受到关注 —— 如果普通视频也能变成可交互的仿真场景,采集成本会比人工建模或专用设备低得多。

来自主题: AI技术研报
6257 点击    2026-08-18 10:50
刚刚,HiDream-O1-World首秀登顶,原生全模态UiT架构打造「可交互时代」

刚刚,HiDream-O1-World首秀登顶,原生全模态UiT架构打造「可交互时代」

刚刚,HiDream-O1-World首秀登顶,原生全模态UiT架构打造「可交互时代」

过去三年,AI 内容生成行业经历了几轮密集的技术迭代。从文生图到文生视频,从几秒的短片到分钟级的长视频,每一轮升级都让生成内容的质量和时长向前推进一步。

来自主题: AI技术研报
8833 点击    2026-08-17 16:31
北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

过去几年,大模型推理系统优化的核心目标一直围绕一个问题展开:如何让 GPU 更高效地计算权重、激活、KV Cache 等高维张量?从并行策略、请求调度、显存管理到算子优化,学界业界大量优化技术不断提升模型推理效率。

来自主题: AI技术研报
9498 点击    2026-08-17 15:18
仿真到真机零负担!轻量级方案让机械臂首次领悟“空间轨迹”

仿真到真机零负担!轻量级方案让机械臂首次领悟“空间轨迹”

仿真到真机零负担!轻量级方案让机械臂首次领悟“空间轨迹”

当机器人把书放进抽屉,它看到的是一串二维图像,然而真正需要完成的,却是一段发生在三维空间、持续随时间演化的动作。

来自主题: AI技术研报
8842 点击    2026-08-17 15:01
ECCV 2026 | 智能助手何时该主动开口?Vinci2让第一视角AI助手从「有问必答」走向「主动服务」

ECCV 2026 | 智能助手何时该主动开口?Vinci2让第一视角AI助手从「有问必答」走向「主动服务」

ECCV 2026 | 智能助手何时该主动开口?Vinci2让第一视角AI助手从「有问必答」走向「主动服务」

请想象这样一种居家场景:当你戴着 AI 眼镜在厨房准备晚饭,用刀切菜时,它会立刻提醒你注意安全;当你连续几天形成举着手机长时间录像的习惯时,它会主动建议你换一种更省力的记录方式。

来自主题: AI技术研报
7051 点击    2026-08-17 09:45