AI资讯新闻榜单内容搜索-训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 训练
开发者要基座模型,蚂蚁真给了!6大训练关键节点同步开源

开发者要基座模型,蚂蚁真给了!6大训练关键节点同步开源

开发者要基座模型,蚂蚁真给了!6大训练关键节点同步开源

百灵为开发者提供了多个可继续训练的起点。今日,蚂蚁百灵开源Ling-3.0-tiny-base和Ling-3.0-flash-base。除最终Base模型权重外,团队还同步开放了两款模型的预训练和中期训练权重,共计6个checkpoints。

来自主题: AI资讯
9904 点击    2026-08-21 11:16
字节Seed架构迎来重大调整

字节Seed架构迎来重大调整

字节Seed架构迎来重大调整

近期,字节跳动大模型核心部门Seed完成新一轮组织调整,调整核心集中在Seed Foundation Model(Seed基础模型)板块,新设四个一级部门,重构了预训练数据、强化学习与后训练的组织链路。

来自主题: AI资讯
9664 点击    2026-08-21 09:08
北大与微软亚研提出 BCP,让模型自己决定何时重规划

北大与微软亚研提出 BCP,让模型自己决定何时重规划

北大与微软亚研提出 BCP,让模型自己决定何时重规划

在 action chunking 已成为 VLA 标配的今天,「一次执行多少步」几乎被所有工作当作一个固定的超参数。

来自主题: AI技术研报
6540 点击    2026-08-20 14:22
世界模型驶入F1赛道:探索极限工况下具身智能体的认知物理边界

世界模型驶入F1赛道:探索极限工况下具身智能体的认知物理边界

世界模型驶入F1赛道:探索极限工况下具身智能体的认知物理边界

当自动驾驶赛车以近 300 km/h 的时速在 F1 赛道上与周车进攻防守、交互博弈,它面对的问题早已不只是提升圈速。

来自主题: AI技术研报
7956 点击    2026-08-20 14:19
至知研究院提出大模型可解释性新路线:直接拆权重,数据成本不到1%

至知研究院提出大模型可解释性新路线:直接拆权重,数据成本不到1%

至知研究院提出大模型可解释性新路线:直接拆权重,数据成本不到1%

大模型机制可解释性研究中,一直存在一个颇具反差的现实: 为了理解一个已经训练好的模型,研究者往往需要先训练一套新的稀疏表示。

来自主题: AI技术研报
6659 点击    2026-08-19 14:39
解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

视觉 - 语言 - 动作(VLA)模型已成为端到端自动驾驶的主流技术路线,但基于自回归(AR)解码的现有架构面临双重结构性瓶颈:其一,逐 Token 串行生成导致推理延迟随序列长度线性增长,严重制约实时部署;其二,训练阶段依赖真实前缀的 teacher forcing 机制,使模型在推理时暴露于自身生成的误差之上,引发长时序累积的曝光偏差(exposure bias)。

来自主题: AI技术研报
7134 点击    2026-08-19 14:39