AI资讯新闻榜单内容搜索-训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 训练
无本体数据直达真机,深朴智能拔掉机器人后训练的「真机数据锚点」

无本体数据直达真机,深朴智能拔掉机器人后训练的「真机数据锚点」

无本体数据直达真机,深朴智能拔掉机器人后训练的「真机数据锚点」

当下,一个逐渐清晰的共识是,具身智能的叙事正由「会不会做一个动作」,转向「能不能在真实世界里稳定完成复杂任务」。尤其是在刚刚过去的 WAIC2026 现场,这一点尤为明显,机器人不再满足于表演式的单动作演示,而是被期待走进产线、仓储和酒店客房,真正「做事」。

来自主题: AI技术研报
8370 点击    2026-08-05 11:27
GPT-Live 底层拆解:OpenAI 如何让 95% 的音频帧不再延迟

GPT-Live 底层拆解:OpenAI 如何让 95% 的音频帧不再延迟

GPT-Live 底层拆解:OpenAI 如何让 95% 的音频帧不再延迟

通过重写 Python、魔改 WebRTC 握手,GPT-Live 让Agent从单向对话进入「实时交互」时代。

来自主题: AI技术研报
10058 点击    2026-08-05 11:04
北大等联合发布Data Pyramid:用五层数据金字塔系统回答「机器人应该从什么数据中学习?」

北大等联合发布Data Pyramid:用五层数据金字塔系统回答「机器人应该从什么数据中学习?」

北大等联合发布Data Pyramid:用五层数据金字塔系统回答「机器人应该从什么数据中学习?」

多模态基础模型可以通过互联网规模的图像与语言学习「看」和「说」,但具身智能没有同样的捷径。机器人必须进一步理解物理状态与动力学,判断动作如何改变环境,并在真实世界中执行连续行为;这要求训练数据同时连接观察、状态、动作与物理后果。

来自主题: AI技术研报
6344 点击    2026-08-05 10:30
大模型灾难性遗忘新解法:秩1联想记忆实现无损持续学习 | ICML'26

大模型灾难性遗忘新解法:秩1联想记忆实现无损持续学习 | ICML'26

大模型灾难性遗忘新解法:秩1联想记忆实现无损持续学习 | ICML'26

想象一个刚上岗的实习生。教他做A任务,他学得很好;接着教他做B任务,他又学会了——但回过头再让他做A,他却忘得七七八八。

来自主题: AI技术研报
7645 点击    2026-08-05 10:30
VQA高分是在看图,还是在记答案?ReKey只更新决定答案的那一小块

VQA高分是在看图,还是在记答案?ReKey只更新决定答案的那一小块

VQA高分是在看图,还是在记答案?ReKey只更新决定答案的那一小块

视觉问答模型的准确率不断提高,但高分未必来自视觉理解 —— 当基准图像与答案已进入训练语料,模型可能只是复现了记忆。浙江大学等团队提出 ReKey:保留原始真实场景,只更新决定答案的那一小块视觉线索,使每轮评测都面向未见过的内容。

来自主题: AI技术研报
8395 点击    2026-08-04 10:33
速递|蚂蚁AGI研究中心主任大模型创业,西湖心辰拿下亿元融资

速递|蚂蚁AGI研究中心主任大模型创业,西湖心辰拿下亿元融资

速递|蚂蚁AGI研究中心主任大模型创业,西湖心辰拿下亿元融资

刚刚,杭州大模型公司西湖心辰宣布,公司近日完成数亿元人民币B+轮融资。该公司创始人蓝振忠,是卡耐基梅隆大学AI博士、自然语言处理预训练语言模型“ALBERT”第一作者,曾任谷歌人工智能研究院科学家,研究成果已被应用于Google News、Google Assistant 等数亿级用户产品中。他于2020年6月受聘于西湖大学,创办深度学习实验室并担任博士生导师。

来自主题: AI资讯
8545 点击    2026-08-03 18:13
告别通用具身模型崇拜:具身智能走向异构策略编排

告别通用具身模型崇拜:具身智能走向异构策略编排

告别通用具身模型崇拜:具身智能走向异构策略编排

当 VLA、WAM、RL、TAMP、MPC 等机器人控制策略在各自擅长的任务中大放异彩,如何刻画其能力边界,并在正确的时机为不同子任务匹配最合适的策略,正逐渐成为机器人完成复杂长时序任务的关键。

来自主题: AI技术研报
7555 点击    2026-08-03 15:31
VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

近年来,视觉 — 语言 — 动作模型(Vision-Language-Action Model,VLA)正逐渐成为通用机器人控制的重要技术路线,但当这些模型真正进入高频闭环执行时,一个矛盾越来越突出:模型越来越大、语义能力越来越强,动作更新却未必足够快。

来自主题: AI技术研报
10249 点击    2026-08-03 15:30
全世界最强的AI,都在“抄”这群普通人的作业

全世界最强的AI,都在“抄”这群普通人的作业

全世界最强的AI,都在“抄”这群普通人的作业

这两天,AI圈百家争鸣。GPT-6曝光、DeepSeek V4 Flash公测、SD2.5发布、MiniMax多模态开源视频模型发布……

来自主题: AI资讯
10459 点击    2026-08-03 11:01