AI资讯新闻榜单内容搜索-模型训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型训练
ICML 2026 | 我们让蒸馏模型当了采样器,Diffusion RL采样成本降低一个数量级

ICML 2026 | 我们让蒸馏模型当了采样器,Diffusion RL采样成本降低一个数量级

ICML 2026 | 我们让蒸馏模型当了采样器,Diffusion RL采样成本降低一个数量级

过去的 Diffusion RL 多聚焦于奖励设计与优化算法,训练时的采样成本被忽视。DMSampler 指出:在在线 RL 中,限制规模化的不只是奖励信号或优化器,很多时候是 rollout 本身太贵。

来自主题: AI技术研报
8190 点击    2026-08-01 10:44
推荐系统只会「猜你喜欢」,却未必「听你的」?我们用多智能体给黑盒推荐做了一次外部可控性体检

推荐系统只会「猜你喜欢」,却未必「听你的」?我们用多智能体给黑盒推荐做了一次外部可控性体检

推荐系统只会「猜你喜欢」,却未必「听你的」?我们用多智能体给黑盒推荐做了一次外部可控性体检

打开视听平台,系统决定你接下来看到什么;进入购物软件,系统预测你可能购买什么。过去几十年,推荐系统主要关注 “能否更准确地预测用户下一步喜欢什么”。但当用户希望探索小众内容、调整兴趣结构或摆脱热门推荐时,系统是否会响应?

来自主题: AI技术研报
8798 点击    2026-07-31 10:16
“接力跑”盘活全国算力,PD分离终于破局:延迟砍半、成本直降近40%!

“接力跑”盘活全国算力,PD分离终于破局:延迟砍半、成本直降近40%!

“接力跑”盘活全国算力,PD分离终于破局:延迟砍半、成本直降近40%!

在刚刚落幕的2026 WAIC世界人工智能大会上,无问芯穹首次公布了其在大模型推理系统架构中的新突破——跨集群异构推理架构PDD。

来自主题: AI技术研报
5735 点击    2026-07-30 15:57
从苹果落地到牛顿定律,Apple-π 把视频模型的物理推理过程摆上考场

从苹果落地到牛顿定律,Apple-π 把视频模型的物理推理过程摆上考场

从苹果落地到牛顿定律,Apple-π 把视频模型的物理推理过程摆上考场

一个苹果从树上落下,今天的视频模型大多能生成一段「看起来正确」的运动:苹果向下、速度加快,最终落地。

来自主题: AI技术研报
6760 点击    2026-07-30 15:56
模型变强没有用,创作仍然碎片化!面向长程多模态创作的开放式Harness

模型变强没有用,创作仍然碎片化!面向长程多模态创作的开放式Harness

模型变强没有用,创作仍然碎片化!面向长程多模态创作的开放式Harness

近几年,多模态生成模型进步很快。一句指令就能生成图片、视频、音频、网页、UI、分镜,甚至整套演示文稿。只看成品,创作门槛似乎已经大幅降低。

来自主题: AI技术研报
6860 点击    2026-07-30 15:55
大模型、机器人之外,社会智能补上AGI第三极

大模型、机器人之外,社会智能补上AGI第三极

大模型、机器人之外,社会智能补上AGI第三极

是时候讨论一下 AI 的 “第三极”—— 社会智能了。

来自主题: AI技术研报
6994 点击    2026-07-29 14:01