AI资讯新闻榜单内容搜索-模型训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型训练
A²-Edit:突破物体类别与掩码精度限制,实现精准参考图编辑

A²-Edit:突破物体类别与掩码精度限制,实现精准参考图编辑

A²-Edit:突破物体类别与掩码精度限制,实现精准参考图编辑

上海交通大学联合上海创智学院团队提出 A²-Edit,它以统一框架支持任意物体类别和任意精度掩码,通过混合 Transformer 专家路由、掩码退火训练及 50 万级多品类数据,让用户只需给出粗略区域,也能完成身份一致、结构完整、自然融合的参考图引导局部编辑。

来自主题: AI技术研报
7101 点击    2026-08-01 10:44
ECCV2026|4步去噪实现12.66 FPS,清华、港科大提出实时流式视频编辑框架LiveEdit

ECCV2026|4步去噪实现12.66 FPS,清华、港科大提出实时流式视频编辑框架LiveEdit

ECCV2026|4步去噪实现12.66 FPS,清华、港科大提出实时流式视频编辑框架LiveEdit

近日,清华大学与香港科技大学的研究团队提出 LiveEdit,一种面向通用文本指令的实时流式视频编辑框架。该方法以因果、分块的方式处理持续到来的视频,在 4 步 / 视频块的推理条件下实现 12.66 FPS 的流式编辑,并能保持被编辑区域的准确性以及未编辑区域的一致性。

来自主题: AI技术研报
7943 点击    2026-08-01 10:44
ICML 2026 | 我们让蒸馏模型当了采样器,Diffusion RL采样成本降低一个数量级

ICML 2026 | 我们让蒸馏模型当了采样器,Diffusion RL采样成本降低一个数量级

ICML 2026 | 我们让蒸馏模型当了采样器,Diffusion RL采样成本降低一个数量级

过去的 Diffusion RL 多聚焦于奖励设计与优化算法,训练时的采样成本被忽视。DMSampler 指出:在在线 RL 中,限制规模化的不只是奖励信号或优化器,很多时候是 rollout 本身太贵。

来自主题: AI技术研报
8342 点击    2026-08-01 10:44
推荐系统只会「猜你喜欢」,却未必「听你的」?我们用多智能体给黑盒推荐做了一次外部可控性体检

推荐系统只会「猜你喜欢」,却未必「听你的」?我们用多智能体给黑盒推荐做了一次外部可控性体检

推荐系统只会「猜你喜欢」,却未必「听你的」?我们用多智能体给黑盒推荐做了一次外部可控性体检

打开视听平台,系统决定你接下来看到什么;进入购物软件,系统预测你可能购买什么。过去几十年,推荐系统主要关注 “能否更准确地预测用户下一步喜欢什么”。但当用户希望探索小众内容、调整兴趣结构或摆脱热门推荐时,系统是否会响应?

来自主题: AI技术研报
8934 点击    2026-07-31 10:16
“接力跑”盘活全国算力,PD分离终于破局:延迟砍半、成本直降近40%!

“接力跑”盘活全国算力,PD分离终于破局:延迟砍半、成本直降近40%!

“接力跑”盘活全国算力,PD分离终于破局:延迟砍半、成本直降近40%!

在刚刚落幕的2026 WAIC世界人工智能大会上,无问芯穹首次公布了其在大模型推理系统架构中的新突破——跨集群异构推理架构PDD。

来自主题: AI技术研报
5971 点击    2026-07-30 15:57
从苹果落地到牛顿定律,Apple-π 把视频模型的物理推理过程摆上考场

从苹果落地到牛顿定律,Apple-π 把视频模型的物理推理过程摆上考场

从苹果落地到牛顿定律,Apple-π 把视频模型的物理推理过程摆上考场

一个苹果从树上落下,今天的视频模型大多能生成一段「看起来正确」的运动:苹果向下、速度加快,最终落地。

来自主题: AI技术研报
6951 点击    2026-07-30 15:56
模型变强没有用,创作仍然碎片化!面向长程多模态创作的开放式Harness

模型变强没有用,创作仍然碎片化!面向长程多模态创作的开放式Harness

模型变强没有用,创作仍然碎片化!面向长程多模态创作的开放式Harness

近几年,多模态生成模型进步很快。一句指令就能生成图片、视频、音频、网页、UI、分镜,甚至整套演示文稿。只看成品,创作门槛似乎已经大幅降低。

来自主题: AI技术研报
7055 点击    2026-07-30 15:55