AI资讯新闻榜单内容搜索-训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 训练
刚刚,翁荔博客又上新:通过Harness工程实现AI自我提升

刚刚,翁荔博客又上新:通过Harness工程实现AI自我提升

刚刚,翁荔博客又上新:通过Harness工程实现AI自我提升

刚刚,翁荔(Lilian Weng)又更新博客了!距离她上一次更新《谨慎对待 Scaling Law》还不到 10 天。这一次,她书写的主题是当前大热的 Harness Engineering,聚焦的正是当下 AI 研究最前沿一个环节:当模型本身的智能已经足够强大时,真正决定它能走多远的,或许是包裹在模型外面的那层「Harness」也就是负责编排模型思考、调用工具、管理上下文、评估结果的那套系统。

来自主题: AI技术研报
9324 点击    2026-07-08 00:04
刚刚,DeepSeek 文档更新,Agent 开发者要注意这个字段

刚刚,DeepSeek 文档更新,Agent 开发者要注意这个字段

刚刚,DeepSeek 文档更新,Agent 开发者要注意这个字段

刚刚,DeepSeek 在官方 API 文档里给出了一个 thinking mode 和 tool call 结合使用的样例。表面上看,这只是一个常规的工具调用演示:用户提出问题,模型判断需要调用工具,工具返回结果后,模型再继续生成答案。

来自主题: AI技术研报
9505 点击    2026-07-07 15:16
General Intuition:一家 23 亿美元 AI 公司,为什么拿游戏录像训练机器人

General Intuition:一家 23 亿美元 AI 公司,为什么拿游戏录像训练机器人

General Intuition:一家 23 亿美元 AI 公司,为什么拿游戏录像训练机器人

General Intuition 做的事听起来有点绕:用游戏数据训练现实世界里的 AI Agent。换成更直白的话说,General Intuition 做的是让 AI 先在游戏里学会“怎么行动”,再把这种能力迁移到机器人、无人机、自动驾驶、仿真环境里。

来自主题: AI资讯
9170 点击    2026-07-07 14:58
ECCV'26 | 为视频虚拟试衣解锁自由视角,TryOnCrafter玩转4D试衣代理

ECCV'26 | 为视频虚拟试衣解锁自由视角,TryOnCrafter玩转4D试衣代理

ECCV'26 | 为视频虚拟试衣解锁自由视角,TryOnCrafter玩转4D试衣代理

视频虚拟试衣(VVT)作为电商展示与数字内容创作中的核心技术,已在动态人物换装、服装纹理保持和视频时序连贯性方面取得显著进展。然而,现有方法大多仍受限于固定相机视角,生成结果被动依赖源视频的原始相机轨

来自主题: AI技术研报
6773 点击    2026-07-07 14:58
世界模型太慢?西交大提出Fast LeWorldModel:用「动作前缀并行预测」让动态估计加速4倍

世界模型太慢?西交大提出Fast LeWorldModel:用「动作前缀并行预测」让动态估计加速4倍

世界模型太慢?西交大提出Fast LeWorldModel:用「动作前缀并行预测」让动态估计加速4倍

以 LeWorldModel(LeWM)为例,它在规划时有一个重要瓶颈:每评估一条候选动作序列,模型都要一步步自回归 rollout。也就是说,LeWM 先预测下一步 latent,再把预测出的 latent 输入 dynamics model,继续预测下一步:

来自主题: AI技术研报
7932 点击    2026-07-07 14:57
让GUI Agent不再「边做边忘」:快手、浙大提出MemGUI-Agent,攻克长程GUI任务

让GUI Agent不再「边做边忘」:快手、浙大提出MemGUI-Agent,攻克长程GUI任务

让GUI Agent不再「边做边忘」:快手、浙大提出MemGUI-Agent,攻克长程GUI任务

手机GUI Agent正在从「看懂屏幕、点击按钮」走向更复杂的跨App自动化任务:这些任务听起来并不复杂,但对现有手机GUI Agent来说,一个核心难题始终存在:任务一长,就容易忘。

来自主题: AI技术研报
7578 点击    2026-07-07 14:56
如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26

如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26

如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26

AI视频生成技术迅猛发展,生成内容的逼真度不断提升,现有检测方法已无法满足需求。最新综述提出「事实保真度验证」新目标,从视觉与语言双视角梳理出四层检测框架,涵盖底层线索、时空一致性、跨模态核验及世界知识推理,强调多层证据耦合与可解释性。

来自主题: AI技术研报
7926 点击    2026-07-07 14:56
蚂蚁灵波开源空间感知模型LingBot-Depth 2.0,11亿参数逆袭70亿大魔王

蚂蚁灵波开源空间感知模型LingBot-Depth 2.0,11亿参数逆袭70亿大魔王

蚂蚁灵波开源空间感知模型LingBot-Depth 2.0,11亿参数逆袭70亿大魔王

蚂蚁灵波的 LingBot-Depth 2.0,一出手就是王炸——12项世界第一!深扒内幕发现:他们竟然直接抛弃了 DINOv3,从头自研预训练基座,仅用11亿参数暴力干翻70亿大魔王,且宣布重磅开源。

来自主题: AI资讯
9471 点击    2026-07-07 11:43
全球第一位AI哲学家,在谷歌DeepMind的9年:为AGI安全奔走

全球第一位AI哲学家,在谷歌DeepMind的9年:为AGI安全奔走

全球第一位AI哲学家,在谷歌DeepMind的9年:为AGI安全奔走

谷歌 DeepMind 有一个哲学家,已经待了九年。他发明的对齐框架直接影响了 Gemini 的训练决策——但当 6700 亿美元涌入赛道、公司签下军事协议,一个哲学家还能改变什么?

来自主题: AI资讯
8156 点击    2026-07-07 10:22
15个推理模型集体翻车,详解输出背后的思考链潜藏风险

15个推理模型集体翻车,详解输出背后的思考链潜藏风险

15个推理模型集体翻车,详解输出背后的思考链潜藏风险

哈佛大学、南加州大学、布朗大学、MIT 等多个机构的研究者联合做了一项系统性研究,给出了否定的答案,并举例到「当我们发现大模型的思考链可被用于生成炸弹装置或投毒配方等高风险内容时,便意识到这一问题非同小可」。

来自主题: AI技术研报
8163 点击    2026-07-07 10:21