AI资讯新闻榜单内容搜索-模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型
重磅!谷歌开源Gemma 4 12B:统一的、无编码器的多模态模型,16G内存笔记本就可以跑

重磅!谷歌开源Gemma 4 12B:统一的、无编码器的多模态模型,16G内存笔记本就可以跑

重磅!谷歌开源Gemma 4 12B:统一的、无编码器的多模态模型,16G内存笔记本就可以跑

刚刚,谷歌DeepMind发布了Gemma 4 12B。一句话概括这个模型的定位:把原本需要高端服务器才能跑的多模态智能,装进你的笔记本电脑里。它填补的是Gemma家族里一个关键空缺:比边缘端的E4B更强,比26B混合专家模型(MoE)更轻。而且在整个Gemma 4系列里,它是第一个支持原生音频输入的中等规模模型。

来自主题: AI资讯
10560 点击    2026-06-04 09:46
老黄的Cosmos 3刚发一天,就被一家中国公司反超了

老黄的Cosmos 3刚发一天,就被一家中国公司反超了

老黄的Cosmos 3刚发一天,就被一家中国公司反超了

6 月 1 日,老黄在 GTC 上用了不小的篇幅讲物理 AI 和具身智能,并重磅发布了 Cosmos 3。英伟达将其定义为面向 Physical AI 的最新前沿模型,也是全球首个完全开放的全能模型,原生具备视觉推理、世界生成和动作生成能力。

来自主题: AI资讯
9460 点击    2026-06-04 09:15
RSS 2026|蚂蚁灵波提出首个自回归因果世界模型,50条数据解锁通用机器人操控

RSS 2026|蚂蚁灵波提出首个自回归因果世界模型,50条数据解锁通用机器人操控

RSS 2026|蚂蚁灵波提出首个自回归因果世界模型,50条数据解锁通用机器人操控

赋予机器人物理理解和预测能力是通用操作的关键。蚂蚁灵波等机构提出的 LingBot-VA 试图将视频帧预测与动作推理统一起来,让机器人通过自回归扩散框架学会“一边思考一边行动”。

来自主题: AI技术研报
10786 点击    2026-06-04 09:13
Agent记忆框架怎么做才靠谱?UC Berkeley MemFai测穿4款顶尖记忆系统,向量库不是唯一答案

Agent记忆框架怎么做才靠谱?UC Berkeley MemFai测穿4款顶尖记忆系统,向量库不是唯一答案

Agent记忆框架怎么做才靠谱?UC Berkeley MemFai测穿4款顶尖记忆系统,向量库不是唯一答案

过去半年,几乎所有Agent框架都在补长期记忆能力。最常见的做法,是给系统接一个向量数据库,把历史对话、用户偏好、项目经验、工具调用结果、失败案例都存进去。看起来,只要把“记忆”这块补上,Agent就能从一次性对话工具变成长期协作伙伴。

来自主题: AI技术研报
9170 点击    2026-06-04 08:38
吃透大模型SFT底层机理:终结实践争议,规避无效算力

吃透大模型SFT底层机理:终结实践争议,规避无效算力

吃透大模型SFT底层机理:终结实践争议,规避无效算力

长期以来,监督微调(Supervised Fine-Tuning,SFT)一直是深度神经网络中最常用的模型适配手段。在中小规模的传统神经网络中,SFT 通常能够稳定提升下游任务表现。

来自主题: AI技术研报
6855 点击    2026-06-04 08:38
16位顶尖数学家起草宣言反对AI,警示算法霸权:数学的灵魂不能被自动化夺走

16位顶尖数学家起草宣言反对AI,警示算法霸权:数学的灵魂不能被自动化夺走

16位顶尖数学家起草宣言反对AI,警示算法霸权:数学的灵魂不能被自动化夺走

几天前,OpenAI 用 AI 模型解决了一个关于点与点之间距离的数学问题,此前 80 年来这道题目一直未被完全攻克,消息一出一度被媒体刷屏。不过,没隔几天 16 位数学家站了出来,他们在荷兰莱顿大学发布了一份名为《莱顿宣言》的文件 [1]。

来自主题: AI资讯
8346 点击    2026-06-03 20:55
还在纠结「本地 or 云端」?Perplexity 的「任务路由」彻底解决 AI 难题

还在纠结「本地 or 云端」?Perplexity 的「任务路由」彻底解决 AI 难题

还在纠结「本地 or 云端」?Perplexity 的「任务路由」彻底解决 AI 难题

当地时间 6 月 2 日,Perplexity 在 Computex 2026 的 Intel 主题演讲上,做了一个很多人没太在意、但可能改变整个 AI 应用行业走向的演示。不是新模型,不是更快的搜索,而是一套「任务路由」系统。

来自主题: AI资讯
9337 点击    2026-06-03 16:29
世界模型榜首易主!跨维智能登顶WorldArena

世界模型榜首易主!跨维智能登顶WorldArena

世界模型榜首易主!跨维智能登顶WorldArena

近日,全球具身世界模型权威评测基准 WorldArena 公布最新榜单。在 5 月 25 日截止的最终榜单中,跨维智能登顶 Track 2 赛道全球第一。可以说是,在英伟达、谷歌等全球科技巨头深度布局、重兵把守的世界模型核心腹地,跨维智能实现了强势突围。

来自主题: AI资讯
9285 点击    2026-06-03 15:27
多模态模型终于不用「抽帧看世界」?LLaVA-OneVision-2.0全开源全帧率技术解读

多模态模型终于不用「抽帧看世界」?LLaVA-OneVision-2.0全开源全帧率技术解读

多模态模型终于不用「抽帧看世界」?LLaVA-OneVision-2.0全开源全帧率技术解读

由格灵深瞳灵感实验室主导研发的 LLaVA-OneVision-2.0,是一款面向下一代感知智能的视觉语言大模型。团队充分利用视频 Codec 流和自研 OneVision-Encoder,实现跨帧、跨事件的增量观测和连续证据流建模。本文将详细介绍模型架构、训练方法与能力验证,展示该技术在视频理解、空间推理和目标追踪等任务中的应用潜力。

来自主题: AI技术研报
6745 点击    2026-06-03 15:03