AI资讯新闻榜单内容搜索-训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 训练
分享一个很前沿的 AI4AI 成果:两个月,把 Deep Search 做到了SOTA

分享一个很前沿的 AI4AI 成果:两个月,把 Deep Search 做到了SOTA

分享一个很前沿的 AI4AI 成果:两个月,把 Deep Search 做到了SOTA

刚读了一篇 AI4AI 论文《AI4AI at Scale》,来自 XYZ Agentic Team。还是第一次听到这个 Lab。他们用 AI4AI 的方式做出了两个很强的搜索 agent,也公开了方法。借这篇 paper 讲讲 AI4AI 到底怎么工作,下面尽量少堆术语。

来自主题: AI技术研报
8558 点击    2026-07-26 15:38
Vibe Coding撞墙了?换个思路治好AI编程的「局部失忆」

Vibe Coding撞墙了?换个思路治好AI编程的「局部失忆」

Vibe Coding撞墙了?换个思路治好AI编程的「局部失忆」

现在的 Agent 将所有的工程线索和垃圾噪音都一股脑扔进 Chat Context 里,缺乏一层独立、结构化的 Engineering State 来做隔离与控制。为了打破这个瓶颈,Valkor 联合浙江大学智能计算与软件研究中心、伦敦大学学院(UCL)软件工程团队正式推出并开源了 loom。

来自主题: AI技术研报
8805 点击    2026-07-26 14:21
迈向长程智能体,人大高瓴发布149页全景综述

迈向长程智能体,人大高瓴发布149页全景综述

迈向长程智能体,人大高瓴发布149页全景综述

我们想强调的是:智能体 “跑得久”,并不等于 “具备长程能力”。真正的关键,不在于占用更多时间与算力,而在于能否在更长、更复杂、更真实的推理依赖链上持续、有效地行动。长期以来,Autonomous Agent、Self-Evolving Agent 等概念常与长程智能体混用。

来自主题: AI技术研报
8745 点击    2026-07-26 11:28
Loss收敛不代表学会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假学会”样本

Loss收敛不代表学会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假学会”样本

Loss收敛不代表学会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假学会”样本

SFT是LLM从“通才”变成“专才”的关键步骤。业界默认做法是:准备标注数据(QA对、指令-回复对等)在基座模型上跑SFT训练。看loss曲线收敛了→认为训练完成。但问题在于:loss是全局平均,掩盖了样本间的差异。loss收敛只代表“大部分样本学会了”——那些始终学不会的样本被淹没了。

来自主题: AI技术研报
8425 点击    2026-07-26 11:25
千万级标注成本归零!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师

千万级标注成本归零!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师

千万级标注成本归零!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师

以往的空间音频模型,要么受限于实验室的苛刻采集条件,要么被高昂的人工标注成本卡住脖子。而团队的核心洞察是:相机的自运动本身就是一种免费的监督信号。当相机转动时,声源在声场中的相对位置随之改变——这种变化无需人工标注,模型即可从中学习空间对应关系。这项工作入选CVPR 2025 Highlight,投稿论文前2%。

来自主题: AI技术研报
8183 点击    2026-07-26 11:25
告别“无脑”长推理!腾讯E-GRM让模型学会“自我怀疑”:拿不准才多想,拿得准直接答

告别“无脑”长推理!腾讯E-GRM让模型学会“自我怀疑”:拿不准才多想,拿得准直接答

告别“无脑”长推理!腾讯E-GRM让模型学会“自我怀疑”:拿不准才多想,拿得准直接答

E-GRM的核心思路就是让模型自己判断输入复杂度——通过多次采样看答案是否收敛。收敛了就直接回答,不收敛再触发CoT。在RM-Bench、RMB、RewardBench三个基准上,约58%的样本被智能路由到“直答”,延迟降低62%,同时准确率还有提升。

来自主题: AI技术研报
8501 点击    2026-07-25 11:37
“Gemini,谁啊?”谷歌Gemini 3.5 Pro一拖再拖,引Meta、OpenAI接连嘲讽:希望它有一天能训练完!

“Gemini,谁啊?”谷歌Gemini 3.5 Pro一拖再拖,引Meta、OpenAI接连嘲讽:希望它有一天能训练完!

“Gemini,谁啊?”谷歌Gemini 3.5 Pro一拖再拖,引Meta、OpenAI接连嘲讽:希望它有一天能训练完!

近日,Meta 首席 AI 官、被称为公司“最高薪员工”的 Alexandr Wang,因一句简单却极具挑衅意味的话引起热议:“gemini who?(Gemini,谁啊?)”这场口水战的背后,其实是一场 AI 巨头之间的公开较量——Meta 最新模型 Muse Spark 1.1 在一份模型排行榜中超过了谷歌刚发布的 Gemini 3.6 Flash

来自主题: AI资讯
9342 点击    2026-07-25 11:30
一个Skill为什么越改越好?腾讯SkillHone让Agent记住每次优化决策

一个Skill为什么越改越好?腾讯SkillHone让Agent记住每次优化决策

一个Skill为什么越改越好?腾讯SkillHone让Agent记住每次优化决策

腾讯微信在论文 SkillHone 中,将这个问题归结为优化历史丢失,进而提出了面向持续 Skill 进化的开发框架。 SkillHone 把每轮诊断、候选修改、评估证据和最终决定组织成持久决策历史。同时,持续优化的对象也从单一的 SKILL.md 文件扩展到了整个 Skill 文件夹及其修改过程。

来自主题: AI技术研报
8716 点击    2026-07-24 15:56
多模态大模型训练的显存与吞吐困局,被小红书开源的BigMac打破了

多模态大模型训练的显存与吞吐困局,被小红书开源的BigMac打破了

多模态大模型训练的显存与吞吐困局,被小红书开源的BigMac打破了

BigMac 是原生多模场景下的流水并行训练新范式。它针对多模态大模型训练中计算效率与显存占用难以兼顾的问题,提出了依赖安全的嵌套流水线:以成熟的 LLM 流水线为主干,在不打乱 LLM 执行顺序的前提下,有序嵌入编码器和生成器计算,从而在不增加 LLM 流水线空泡、保持激活显存有界的同时,高效实现多模态流水训练。

来自主题: AI技术研报
8425 点击    2026-07-24 15:55
清华弄了个镜像错觉艺术生成器,支持3D打印 | CVPR'26亮点

清华弄了个镜像错觉艺术生成器,支持3D打印 | CVPR'26亮点

清华弄了个镜像错觉艺术生成器,支持3D打印 | CVPR'26亮点

近日,来自清华大学等单位的研究团队提出了AutoMIA,一种自动生成镜像错觉艺术的 AI 设计方法,用户仅需任意指定两张图片,分别对应镜子前和镜子中的图案,AutoMIA就可以自动完成3维艺术品的设计,并且支持直接3D打印出来制作艺术品。

来自主题: AI资讯
8407 点击    2026-07-24 15:54