AI资讯新闻榜单内容搜索-模型训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型训练
继何恺明团队ELF后,南京大学基于昇腾算力同步提出连续扩散语言模型

继何恺明团队ELF后,南京大学基于昇腾算力同步提出连续扩散语言模型

继何恺明团队ELF后,南京大学基于昇腾算力同步提出连续扩散语言模型

近日来自南京大学模式识别实验室(PRLab)的梁嘉骏、廖宇程,在司晨阳教授的指导下,联合新加坡南洋理工大学、英国帝国理工学院,提出连续扩散语言模型 AURORA-LM(Autoencoding Unified Representation for Continuous-Latent Diffusion Language Modeling),对连续空间下的语言建模作出了更多的思考和发现。

来自主题: AI技术研报
8461 点击    2026-08-08 13:15
何恺明参与!DeepMind把文生视频模型做成通用视觉基座,训练数据量仅1/500

何恺明参与!DeepMind把文生视频模型做成通用视觉基座,训练数据量仅1/500

何恺明参与!DeepMind把文生视频模型做成通用视觉基座,训练数据量仅1/500

当下计算机视觉长期陷入“一任务一专用模型”内卷: 做深度估计要用DepthAnything,分割依赖SAM,人体姿态单独训练Sapiens,几何重建还得搭VGGT,各类网络骨干、解码器、损失函数完全割裂,研发与部署成本居高不下。

来自主题: AI技术研报
9095 点击    2026-08-07 09:10
无法蒸馏的美国市场,谁在分食 Frontier Labs 百亿美金数据预算?

无法蒸馏的美国市场,谁在分食 Frontier Labs 百亿美金数据预算?

无法蒸馏的美国市场,谁在分食 Frontier Labs 百亿美金数据预算?

在模型层之外,2026 年上半年在硅谷增长最快的赛道之一是数据:Mercor 的 run rate 从去年下半年的 5 亿美元涨到今年年中的 20 亿美元;Handshake 转型 human data 后,run rate 在年初三个月内从 5.5 亿美元冲到 10 亿美元;RL 环境公司 Fleet 则在半年内从百万美元级别做到 6000 万美元 run rate,

来自主题: AI资讯
9496 点击    2026-08-06 22:31
清华信誉机制破解电商大忽悠,让AI代理真正推你所需

清华信誉机制破解电商大忽悠,让AI代理真正推你所需

清华信誉机制破解电商大忽悠,让AI代理真正推你所需

你有没有想过,有一天你买东西,不再需要打开购物软件挨个搜索,而是直接对你的AI助手说一句“我想买一把适合初学者的吉他”,它就能跑遍全网,把最好的几个选项摆在你面前,还附带理由?

来自主题: AI技术研报
9113 点击    2026-08-06 15:41
反击VLA中「L」无用论:用对位置指令泛化能力暴涨20-40%

反击VLA中「L」无用论:用对位置指令泛化能力暴涨20-40%

反击VLA中「L」无用论:用对位置指令泛化能力暴涨20-40%

作为具身智能最主流的路线之一,VLA 快速发展的同时也因为其各种问题被诟病。其中最主要的痛点之一便是指令泛化能力。

来自主题: AI技术研报
9234 点击    2026-08-06 15:40
Fable5仅做对3.5%!大模型会看图,但还没有主动视觉

Fable5仅做对3.5%!大模型会看图,但还没有主动视觉

Fable5仅做对3.5%!大模型会看图,但还没有主动视觉

人类看图时,不会先在大脑中拍下一张「截图」,再闭眼推理。思考过程会不断引导我们的目光:找到一个线索,形成一个假设,再回到图像里验证它。

来自主题: AI技术研报
8845 点击    2026-08-05 15:50