AI资讯新闻榜单内容搜索-模型训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型训练
至知研究院提出大模型可解释性新路线:直接拆权重,数据成本不到1%

至知研究院提出大模型可解释性新路线:直接拆权重,数据成本不到1%

至知研究院提出大模型可解释性新路线:直接拆权重,数据成本不到1%

大模型机制可解释性研究中,一直存在一个颇具反差的现实: 为了理解一个已经训练好的模型,研究者往往需要先训练一套新的稀疏表示。

来自主题: AI技术研报
6455 点击    2026-08-19 14:39
解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

视觉 - 语言 - 动作(VLA)模型已成为端到端自动驾驶的主流技术路线,但基于自回归(AR)解码的现有架构面临双重结构性瓶颈:其一,逐 Token 串行生成导致推理延迟随序列长度线性增长,严重制约实时部署;其二,训练阶段依赖真实前缀的 teacher forcing 机制,使模型在推理时暴露于自身生成的误差之上,引发长时序累积的曝光偏差(exposure bias)。

来自主题: AI技术研报
6915 点击    2026-08-19 14:39
机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

端到端策略模型在物理世界频频失灵,研究者转向 “大模型智能体 + 工具调用” 自救,试图在动态物理世界中持续学习。然而,这条在线学习路径在物理世界仍未真正走通。

来自主题: AI技术研报
7392 点击    2026-08-18 15:27
6个Agent组团Vibe Gaming:自己生成、试玩、修Bug

6个Agent组团Vibe Gaming:自己生成、试玩、修Bug

6个Agent组团Vibe Gaming:自己生成、试玩、修Bug

给AI一句“生成一款坦克大战游戏”,代码很快跑了起来。

来自主题: AI资讯
8432 点击    2026-08-18 15:10
ECCV 2026 | 一段视频,重建一个可仿真的动态世界

ECCV 2026 | 一段视频,重建一个可仿真的动态世界

ECCV 2026 | 一段视频,重建一个可仿真的动态世界

机器人走出实验室后,训练数据不再只是 “多不多” 的问题:环境能否覆盖真实世界的尺度、遮挡、接触和运动,直接决定策略能否落地。Real2Sim 因此重新受到关注 —— 如果普通视频也能变成可交互的仿真场景,采集成本会比人工建模或专用设备低得多。

来自主题: AI技术研报
6725 点击    2026-08-18 10:50
北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

过去几年,大模型推理系统优化的核心目标一直围绕一个问题展开:如何让 GPU 更高效地计算权重、激活、KV Cache 等高维张量?从并行策略、请求调度、显存管理到算子优化,学界业界大量优化技术不断提升模型推理效率。

来自主题: AI技术研报
9882 点击    2026-08-17 15:18
仿真到真机零负担!轻量级方案让机械臂首次领悟“空间轨迹”

仿真到真机零负担!轻量级方案让机械臂首次领悟“空间轨迹”

仿真到真机零负担!轻量级方案让机械臂首次领悟“空间轨迹”

当机器人把书放进抽屉,它看到的是一串二维图像,然而真正需要完成的,却是一段发生在三维空间、持续随时间演化的动作。

来自主题: AI技术研报
9183 点击    2026-08-17 15:01