AI资讯新闻榜单内容搜索-语言模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 语言模型
专访DeepMind创始人:从被嘲落后到诺奖加身,哈萨比斯如何复盘Google的AI战略?|投资笔记第258期

专访DeepMind创始人:从被嘲落后到诺奖加身,哈萨比斯如何复盘Google的AI战略?|投资笔记第258期

专访DeepMind创始人:从被嘲落后到诺奖加身,哈萨比斯如何复盘Google的AI战略?|投资笔记第258期

过去几年,大语言模型几乎成为了AI的代名词。从ChatGPT到Google DeepMind推出的Gemini,从Anthropic开发的Claude到中国的DeepSeek,人们讨论更多的是聊天机器人、推理能力和生成内容。但如果问Google DeepMind CEO、2024年诺贝尔化学奖得主Demis Hassabis(下简称“哈萨比斯”)

来自主题: AI资讯
9846 点击    2026-07-13 14:43
你的自教师模型还在用参考解吗?马普所联合清华大学推出d-OPSD,第一个针对扩散语言模型的在线自蒸馏学习

你的自教师模型还在用参考解吗?马普所联合清华大学推出d-OPSD,第一个针对扩散语言模型的在线自蒸馏学习

你的自教师模型还在用参考解吗?马普所联合清华大学推出d-OPSD,第一个针对扩散语言模型的在线自蒸馏学习

有没有一种更为合适的 OPSD 范式?近期,清华大学和马普所等机构的研究者们联合推出的 d-OPSD,给这一问题提供了完美的答案。这是第一个针对扩散大语言模型的 OPSD 范式,无需参考解,无需额外的教师模型,只需要 RL 十分之一的训练步数,便可以达到或超出 RL 的后训练效果。

来自主题: AI技术研报
8200 点击    2026-07-10 10:41
速递|爆MiniMax研发2.7万亿参数新模型,解禁前获超八成基石股东承诺长期持有

速递|爆MiniMax研发2.7万亿参数新模型,解禁前获超八成基石股东承诺长期持有

速递|爆MiniMax研发2.7万亿参数新模型,解禁前获超八成基石股东承诺长期持有

据 The Information 报道,MiniMax 正在研发一款参数规模达 2.7 万亿的大语言模型,内部代号暂定为 M3 Pro,最快有望于今年第三季度发布,并计划同步开源。相较于现有旗舰模型 M3 的 4280 亿参数,M3 Pro 的规模实现了数量级跃升,预计将在复杂推理、多步骤任务处理及长上下文理解等能力上进一步增强。

来自主题: AI资讯
9086 点击    2026-07-08 22:25
姚顺雨的OpenAI前同事田永龙,也加入腾讯了

姚顺雨的OpenAI前同事田永龙,也加入腾讯了

姚顺雨的OpenAI前同事田永龙,也加入腾讯了

智东西获悉,OpenAI前研究员田永龙(Yonglong Tian)已确认于近期加入腾讯大语言模型部,后续将参与VLM(视觉语言模型)相关研发。在OpenAI期间,田永龙曾参与GPT-5的研发工作。加入OpenAI之前,他在Google Research和DeepMind长期从事视觉表征学习和对比学习等方向研究,对后续视觉模型以及多模态表征学习的发展产生了广泛影响。

来自主题: AI资讯
8886 点击    2026-07-08 16:05
竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500

竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500

竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500

大语言模型在代码生成上的能力不断增强,但在复杂算法题,尤其是竞赛编程场景中,仍然容易因为算法选择错误、边界条件遗漏、复杂度判断失误或隐藏测试覆盖不足而失败。Solvita是一款面向竞赛编程的智能体框架,通过四个角色(Planner、Solver、Oracle、Hacker)形成闭环系统,并利用可训练的图结构知识网络积累经验。

来自主题: AI技术研报
8905 点击    2026-07-08 15:09
聊聊Anthropic这篇最新研究,我觉得可能是AI意识诞生的前夜。

聊聊Anthropic这篇最新研究,我觉得可能是AI意识诞生的前夜。

聊聊Anthropic这篇最新研究,我觉得可能是AI意识诞生的前夜。

今天凌晨刷到Anthropic发了一篇研究。标题叫《A Global Workspace in Language Models》,语言模型中的全局工作空间。如果用一句最简单的话来说,那就是,Anthropic在Claude的大脑里,找到了一个暗房间。

来自主题: AI技术研报
9269 点击    2026-07-07 09:42
世界模型走了一些弯路

世界模型走了一些弯路

世界模型走了一些弯路

「不如直接数字人」 私以为,世界模型这个概念的发展经过了三个非常幽默的阶段。 第一阶段:硅谷真懂行的老登如杨立昆、李飞飞,觉得大语言模型在讲故事上没啥空间了,所以从学术圈拽了个新概念过来尝试弯道超车。

来自主题: AI资讯
8128 点击    2026-07-04 10:51
ICML26 | 浙江理工大学马啸讲师和南京大学李武军教授课题组联合提出EMCES:为强化学习合成更有价值的样本

ICML26 | 浙江理工大学马啸讲师和南京大学李武军教授课题组联合提出EMCES:为强化学习合成更有价值的样本

ICML26 | 浙江理工大学马啸讲师和南京大学李武军教授课题组联合提出EMCES:为强化学习合成更有价值的样本

近年来,强化学习在游戏智能体、具身智能、大语言模型等领域取得了显著进展。然而,在真实世界中,强化学习仍面临一个核心难题:高质量样本的获取不仅成本高昂,还可能带来多种风险。因此,样本增强成为缓解强化学习中样本获取成本高、风险大等问题的重要途径之一。

来自主题: AI技术研报
10187 点击    2026-07-02 14:31
ICML 2026 Oral|大模型的能力从哪些训练数据来?北大&智源提出「机理数据归因」

ICML 2026 Oral|大模型的能力从哪些训练数据来?北大&智源提出「机理数据归因」

ICML 2026 Oral|大模型的能力从哪些训练数据来?北大&智源提出「机理数据归因」

近年来,大语言模型展现出了越来越强的能力,从上下文学习(In-Context Learning, ICL)到复杂推理、代码生成,这些能力不断刷新人们对模型能力边界的认知。

来自主题: AI技术研报
9496 点击    2026-06-29 09:19
刚刚,OpenAI发布首款AI芯片,九个月完成流片

刚刚,OpenAI发布首款AI芯片,九个月完成流片

刚刚,OpenAI发布首款AI芯片,九个月完成流片

美国当地时间6月24日,OpenAI与博通联合发布了双方合作的首款定制芯片Jalapeño。这是一款专用集成电路(ASIC),专门针对大语言模型的推理任务而设计,也标志着OpenAI正式进军AI芯片领域。

来自主题: AI资讯
10739 点击    2026-06-25 00:11