AI资讯新闻榜单内容搜索-AI

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: AI
A²-Edit:突破物体类别与掩码精度限制,实现精准参考图编辑

A²-Edit:突破物体类别与掩码精度限制,实现精准参考图编辑

A²-Edit:突破物体类别与掩码精度限制,实现精准参考图编辑

上海交通大学联合上海创智学院团队提出 A²-Edit,它以统一框架支持任意物体类别和任意精度掩码,通过混合 Transformer 专家路由、掩码退火训练及 50 万级多品类数据,让用户只需给出粗略区域,也能完成身份一致、结构完整、自然融合的参考图引导局部编辑。

来自主题: AI技术研报
6643 点击    2026-08-01 10:44
ECCV2026|4步去噪实现12.66 FPS,清华、港科大提出实时流式视频编辑框架LiveEdit

ECCV2026|4步去噪实现12.66 FPS,清华、港科大提出实时流式视频编辑框架LiveEdit

ECCV2026|4步去噪实现12.66 FPS,清华、港科大提出实时流式视频编辑框架LiveEdit

近日,清华大学与香港科技大学的研究团队提出 LiveEdit,一种面向通用文本指令的实时流式视频编辑框架。该方法以因果、分块的方式处理持续到来的视频,在 4 步 / 视频块的推理条件下实现 12.66 FPS 的流式编辑,并能保持被编辑区域的准确性以及未编辑区域的一致性。

来自主题: AI技术研报
7421 点击    2026-08-01 10:44
ICML 2026 | 我们让蒸馏模型当了采样器,Diffusion RL采样成本降低一个数量级

ICML 2026 | 我们让蒸馏模型当了采样器,Diffusion RL采样成本降低一个数量级

ICML 2026 | 我们让蒸馏模型当了采样器,Diffusion RL采样成本降低一个数量级

过去的 Diffusion RL 多聚焦于奖励设计与优化算法,训练时的采样成本被忽视。DMSampler 指出:在在线 RL 中,限制规模化的不只是奖励信号或优化器,很多时候是 rollout 本身太贵。

来自主题: AI技术研报
7877 点击    2026-08-01 10:44
1小时花一亿token极限实测DeepSeek-V4-Flash,得出7个结论

1小时花一亿token极限实测DeepSeek-V4-Flash,得出7个结论

1小时花一亿token极限实测DeepSeek-V4-Flash,得出7个结论

DeepSeek-V4-Flash风评冲爆了,原生支持接入Codex,而且还强化了Agent能力。我第一时间把它接进了Codex,用cc swich非常方便。一个小时,跑了一亿多token。跟大家说说体感。

来自主题: AI产品测评
8488 点击    2026-08-01 10:40
5050亿参数!余承东开源盘古新模型openPangu-2.0-Pro,距离“世界第一”还有差距

5050亿参数!余承东开源盘古新模型openPangu-2.0-Pro,距离“世界第一”还有差距

5050亿参数!余承东开源盘古新模型openPangu-2.0-Pro,距离“世界第一”还有差距

今日,华为开源基于昇腾NPU训练的盘古MoE模型openPangu-2.0-Pro。该模型是openPangu-2.0系列的最新开源模型,总参数规模5050亿,激活参数规模180亿,支持512K上下文长度,训练数据总量约34T tokens。另一轻量化模型openPangu-2.0-Flash已于6月12日开源,参数92亿,其中6亿为激活参数。

来自主题: AI资讯
9185 点击    2026-07-31 21:54
1300 万月活、近 6000 万美元 ARR:OpenCode 如何在 Claude Code、Codex 夹缝中长出来?

1300 万月活、近 6000 万美元 ARR:OpenCode 如何在 Claude Code、Codex 夹缝中长出来?

1300 万月活、近 6000 万美元 ARR:OpenCode 如何在 Claude Code、Codex 夹缝中长出来?

我们整理了最近半年来 OpenCode CEO Jay V 以及联合创始人 Dax Raad 近期在多档播客和访谈中的核心观点,试图还原一个完整的图景,一家开源公司究竟如何在巨头夹缝中找到自己的位置,以及他们怎么看待商业化和模型编排。

来自主题: AI资讯
9260 点击    2026-07-31 21:25
刚刚,DeepSeek-V4-Flash正式版API公测上线!

刚刚,DeepSeek-V4-Flash正式版API公测上线!

刚刚,DeepSeek-V4-Flash正式版API公测上线!

7月31日,DeepSeek正式向公众开放V4-Flash正式版API公测。这一次,最亮眼的关键词是——Agent能力大幅跃升。9项基准测试成绩全面披露,多项指标远超此前发布的V4-Pro-Preview预览版,直接将“代码智能体”的天花板又顶高了一截。

来自主题: AI资讯
8718 点击    2026-07-31 15:54
刚刚,即梦 Seedance 2.5来了!我狂测测测测...

刚刚,即梦 Seedance 2.5来了!我狂测测测测...

刚刚,即梦 Seedance 2.5来了!我狂测测测测...

就在刚刚,字节跳动正式发布了自研视频模型Seedance 2.5,而我们熟悉的「即梦AI」作为模型的官方体验入口也第一时间妥妥接入。贴心的我呢,也直接帮友友们把这次新模型最夯夯夯夯的能力都扒好了,咱先一睹为快——

来自主题: AI资讯
8535 点击    2026-07-31 15:54
翁荔刚回OpenAI,Thinking Machines反手发布新模型Inkling-Small

翁荔刚回OpenAI,Thinking Machines反手发布新模型Inkling-Small

翁荔刚回OpenAI,Thinking Machines反手发布新模型Inkling-Small

今天,Thinking Machines正式发布第二款重磅模型——Inkling-Small。276B总参数、12B激活参数,原生多模态,100万token上下文。半个月前,首个开源975B Inkling登场,曾在AI圈掀起了巨浪。

来自主题: AI资讯
8683 点击    2026-07-31 13:35
AI 3D七大前沿模型同场竞技,竟被比特无限发布的4B模型 Arko-T拿下8项第一

AI 3D七大前沿模型同场竞技,竟被比特无限发布的4B模型 Arko-T拿下8项第一

AI 3D七大前沿模型同场竞技,竟被比特无限发布的4B模型 Arko-T拿下8项第一

近日,比特无限发布的 Arko-T,是一款面向 Text-to-Structured 3D Generation 的 4B 参数基础模型。该模型由比特无限联创、首席科学家周平义博士带队完成。它接收自然语言描述,直接输出可执行的 Build123d 程序。程序经过 CAD 内核运行后,可以得到带有命名参数、结构特征和建模过程的 CAD 设计实体。

来自主题: AI资讯
8692 点击    2026-07-31 13:34