AI资讯新闻榜单内容搜索-训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 训练
人大系团队、天使轮数千万元融资,境瞳科技给人类社会建一个「世界模型」

人大系团队、天使轮数千万元融资,境瞳科技给人类社会建一个「世界模型」

人大系团队、天使轮数千万元融资,境瞳科技给人类社会建一个「世界模型」

社会智能公司境瞳科技近日完成数千万元人民币天使轮融资,投资方包括英诺天使基金、水木清华校友种子基金、零以创投和驰星创投。这笔钱将主要用来扩大社会模拟器的规模,为社会世界模型的预训练做准备。

来自主题: AI资讯
9475 点击    2026-07-27 11:29
分享一个很前沿的 AI4AI 成果:两个月,把 Deep Search 做到了SOTA

分享一个很前沿的 AI4AI 成果:两个月,把 Deep Search 做到了SOTA

分享一个很前沿的 AI4AI 成果:两个月,把 Deep Search 做到了SOTA

刚读了一篇 AI4AI 论文《AI4AI at Scale》,来自 XYZ Agentic Team。还是第一次听到这个 Lab。他们用 AI4AI 的方式做出了两个很强的搜索 agent,也公开了方法。借这篇 paper 讲讲 AI4AI 到底怎么工作,下面尽量少堆术语。

来自主题: AI技术研报
8564 点击    2026-07-26 15:38
Vibe Coding撞墙了?换个思路治好AI编程的「局部失忆」

Vibe Coding撞墙了?换个思路治好AI编程的「局部失忆」

Vibe Coding撞墙了?换个思路治好AI编程的「局部失忆」

现在的 Agent 将所有的工程线索和垃圾噪音都一股脑扔进 Chat Context 里,缺乏一层独立、结构化的 Engineering State 来做隔离与控制。为了打破这个瓶颈,Valkor 联合浙江大学智能计算与软件研究中心、伦敦大学学院(UCL)软件工程团队正式推出并开源了 loom。

来自主题: AI技术研报
8810 点击    2026-07-26 14:21
迈向长程智能体,人大高瓴发布149页全景综述

迈向长程智能体,人大高瓴发布149页全景综述

迈向长程智能体,人大高瓴发布149页全景综述

我们想强调的是:智能体 “跑得久”,并不等于 “具备长程能力”。真正的关键,不在于占用更多时间与算力,而在于能否在更长、更复杂、更真实的推理依赖链上持续、有效地行动。长期以来,Autonomous Agent、Self-Evolving Agent 等概念常与长程智能体混用。

来自主题: AI技术研报
8750 点击    2026-07-26 11:28
Loss收敛不代表学会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假学会”样本

Loss收敛不代表学会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假学会”样本

Loss收敛不代表学会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假学会”样本

SFT是LLM从“通才”变成“专才”的关键步骤。业界默认做法是:准备标注数据(QA对、指令-回复对等)在基座模型上跑SFT训练。看loss曲线收敛了→认为训练完成。但问题在于:loss是全局平均,掩盖了样本间的差异。loss收敛只代表“大部分样本学会了”——那些始终学不会的样本被淹没了。

来自主题: AI技术研报
8432 点击    2026-07-26 11:25
千万级标注成本归零!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师

千万级标注成本归零!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师

千万级标注成本归零!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师

以往的空间音频模型,要么受限于实验室的苛刻采集条件,要么被高昂的人工标注成本卡住脖子。而团队的核心洞察是:相机的自运动本身就是一种免费的监督信号。当相机转动时,声源在声场中的相对位置随之改变——这种变化无需人工标注,模型即可从中学习空间对应关系。这项工作入选CVPR 2025 Highlight,投稿论文前2%。

来自主题: AI技术研报
8187 点击    2026-07-26 11:25
告别“无脑”长推理!腾讯E-GRM让模型学会“自我怀疑”:拿不准才多想,拿得准直接答

告别“无脑”长推理!腾讯E-GRM让模型学会“自我怀疑”:拿不准才多想,拿得准直接答

告别“无脑”长推理!腾讯E-GRM让模型学会“自我怀疑”:拿不准才多想,拿得准直接答

E-GRM的核心思路就是让模型自己判断输入复杂度——通过多次采样看答案是否收敛。收敛了就直接回答,不收敛再触发CoT。在RM-Bench、RMB、RewardBench三个基准上,约58%的样本被智能路由到“直答”,延迟降低62%,同时准确率还有提升。

来自主题: AI技术研报
8504 点击    2026-07-25 11:37
“Gemini,谁啊?”谷歌Gemini 3.5 Pro一拖再拖,引Meta、OpenAI接连嘲讽:希望它有一天能训练完!

“Gemini,谁啊?”谷歌Gemini 3.5 Pro一拖再拖,引Meta、OpenAI接连嘲讽:希望它有一天能训练完!

“Gemini,谁啊?”谷歌Gemini 3.5 Pro一拖再拖,引Meta、OpenAI接连嘲讽:希望它有一天能训练完!

近日,Meta 首席 AI 官、被称为公司“最高薪员工”的 Alexandr Wang,因一句简单却极具挑衅意味的话引起热议:“gemini who?(Gemini,谁啊?)”这场口水战的背后,其实是一场 AI 巨头之间的公开较量——Meta 最新模型 Muse Spark 1.1 在一份模型排行榜中超过了谷歌刚发布的 Gemini 3.6 Flash

来自主题: AI资讯
9348 点击    2026-07-25 11:30