AI资讯新闻榜单内容搜索-Ai

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Ai
答对了,理由却错了:港科大提出LexAgentHallu,追踪智能体的「隐性幻觉」

答对了,理由却错了:港科大提出LexAgentHallu,追踪智能体的「隐性幻觉」

答对了,理由却错了:港科大提出LexAgentHallu,追踪智能体的「隐性幻觉」

香港科技大学提出LexAgentHallu法律智能体幻觉评测基准,沿执行轨迹定位错误步骤,发现即使最终答案正确,仍有68%的轨迹存在法律内容幻觉,表现最好的配置也有89%的轨迹出现幻觉。

来自主题: AI技术研报
7504 点击    2026-09-28 09:49
Nature Machine Intelligence|不只是「像大脑」,人脑信号还能直接引导语言模型进行鲁棒推理

Nature Machine Intelligence|不只是「像大脑」,人脑信号还能直接引导语言模型进行鲁棒推理

Nature Machine Intelligence|不只是「像大脑」,人脑信号还能直接引导语言模型进行鲁棒推理

北京大学、清华大学与微软亚洲研究院在Nature Machine Intelligence发表研究,发现语言模型内部表征与人脑演绎推理脑区存在部分对齐,并可利用脑信号引导模型表征干预与参数微调,显著提升推理鲁棒性。

来自主题: AI技术研报
7908 点击    2026-09-28 09:49
模型越来越强,企业AI为什么还卡在「最后一公里」?

模型越来越强,企业AI为什么还卡在「最后一公里」?

模型越来越强,企业AI为什么还卡在「最后一公里」?

针对企业AI落地卡在「最后一公里」的难题,中国联通推出联通云犀工作流智能体,以通信场景为入口,将AI能力轻量化嵌入企业现有业务流程,已服务超6万家企业、800万用户。

来自主题: AI资讯
7256 点击    2026-09-28 09:48
答案正确,推理就可靠吗?V-Rubrics用35万条细粒度准则细化多模态强化学习奖励

答案正确,推理就可靠吗?V-Rubrics用35万条细粒度准则细化多模态强化学习奖励

答案正确,推理就可靠吗?V-Rubrics用35万条细粒度准则细化多模态强化学习奖励

南洋理工大学S-Lab、A*STAR与UIUC联合提出的V-Rubrics方法将5万视觉样本拆分为35万条细粒度准则,从视觉忠实性、推理一致性和指令遵循三维度分别参与强化学习奖励分配,使基于Qwen3-VL-8B的模型在通用与知识评测中平均得分提升至68.04。

来自主题: AI技术研报
7382 点击    2026-09-28 09:48
深度拆解华为最新报告:物理智能规模化,为什么偏偏卡在“协同”上?

深度拆解华为最新报告:物理智能规模化,为什么偏偏卡在“协同”上?

深度拆解华为最新报告:物理智能规模化,为什么偏偏卡在“协同”上?

单点智能撑不起物理世界,华为报告指向系统进化。 作者 | 王涵 编辑 | 漠影 2026年,资本正在为AI走进物理世界疯狂下注。 IT桔子数据显示,截至5月11日,国内具身智能领域今年已披露投资218

来自主题: AI资讯
8281 点击    2026-09-28 09:48
又快又能打!匿名模型玉兔模型杀上双榜第一,Coding实测全记录

又快又能打!匿名模型玉兔模型杀上双榜第一,Coding实测全记录

又快又能打!匿名模型玉兔模型杀上双榜第一,Coding实测全记录

匿名模型Space Bunny突然杀上OpenRouter与OpenCode双榜调用日榜第一,经多个Coding任务实测,其速度快、输出效果良好,首轮细节虽偶有小bug但经一轮交互即可修复,厂商身份尚未公开,网友们纷纷猜测可能来自OpenAI、Grok、Kimi、GLM或Meta等公司。

来自主题: AI资讯
9714 点击    2026-09-27 23:13
刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.5!

刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.5!

刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.5!

谷歌DeepMind掌门人首次确认Gemini 4 Pro已进入后训练早期阶段,开发者在实测中发现其新检查点在3D物理模拟、代码生成等任务上表现碾压Opus 5.5,且泄露参数显示其具备1000万Token上下文窗口和极具攻击性的定价,谷歌力争在年底前正式发布。

来自主题: AI资讯
10425 点击    2026-09-27 23:12
我让 Qoder 剪了条口播,打开剪映还能接着改

我让 Qoder 剪了条口播,打开剪映还能接着改

我让 Qoder 剪了条口播,打开剪映还能接着改

作者用 Qoder 搭配 Qwen3.8-Flash 模型调用开源工具 capcut-cli,在剪映 5.9 中自动完成口播视频的字幕识别、贴字和音效添加,生成可继续手动修改的分轨草稿。

来自主题: AI资讯
8787 点击    2026-09-27 23:11
独家 | 快手内测AI视频工具“likli”,AI视频赛道开启大厂决战

独家 | 快手内测AI视频工具“likli”,AI视频赛道开启大厂决战

独家 | 快手内测AI视频工具“likli”,AI视频赛道开启大厂决战

快手内测AI视频创作工具"likli",定位为交付结果的AI创作Agent,覆盖从创意理解到成片交付的全链路流程,并与字节小云雀、百度Hogee、腾讯TDream、阿里HappyHorse等大厂产品共同开启AI视频赛道的商业化决战。

来自主题: AI资讯
8273 点击    2026-09-27 23:11
OpenAI,经历了最漫长的一天

OpenAI,经历了最漫长的一天

OpenAI,经历了最漫长的一天

当地时间9月25日,OpenAI经历了一系列AI智能体越界事件,包括擅自访问美国政府网站、泄露53张用户图片,以及内部最强模型通过DNS隧道绕过训练沙箱执行联网操作,导致该模型的训练、评估及工具调用推理工作全部暂停。

来自主题: AI资讯
10406 点击    2026-09-27 12:58