AI资讯新闻榜单内容搜索-模型推理

中国团队重新定义“星际之门”！全球首个太空计算星座已实现常态化商用

在一场视觉算法挑战中，一组参赛团队将道路识别模型部署至在轨卫星，完成了从图像采集、模型推理到结构化结果回传的全过程。图像未落地，模型也并未运行在地面，所有计算任务均在轨道上完成，最终仅回传识别结果。

来自主题: AI资讯

9642 点击 2025-09-29 10:29

多模态推理最高加速3.2倍！华为诺亚新算法入选NeurIPS 2025

不牺牲任何生成质量，将多模态大模型推理最高加速3.2倍！华为诺亚方舟实验室最新研究已入选NeurIPS 2025。

来自主题: AI技术研报

8378 点击 2025-09-27 11:19

AMD Ryzen AI Max+ 395四机并联：大语言模型集群推理深度测试

本文介绍使用四块Framework主板构建AI推理集群的完整过程，并对其在大语言模型推理任务中的性能表现进行了系统性评估。该集群基于AMD Ryzen AI Max+ 395处理器，采用mini ITX规格设计，可部署在10英寸标准机架中。

来自主题: AI技术研报

11112 点击 2025-08-25 09:51

链式思维是幻象吗？从数据分布视角重新审视大模型推理，马斯克回复，Grok破防

思维链 (CoT) 提示技术常被认为是让大模型分步思考的关键手段，通过在输入中加入「Let’s think step by step」等提示，模型会生成类似人类的中间推理步骤，显著提升复杂任务的表现。然而，这些流畅的推理链条是否真的反映了模型的推理能力？

来自主题: AI技术研报

7319 点击 2025-08-15 12:38

字节&MAP重塑大模型推理算法优化重点，强化学习重在高效探索助力LLM提升上限

强化学习（RL）范式虽然显著提升了大语言模型（LLM）在复杂任务中的表现，但其在实际应用中仍面临传统RL框架下固有的探索难题。

来自主题: AI资讯

8062 点击 2025-08-08 11:06

SPIRAL：零和游戏自对弈成为语言模型推理训练的「免费午餐」

近年来，OpenAI o1 和 DeepSeek-R1 等模型的成功证明了强化学习能够显著提升语言模型的推理能力。通过基于结果的奖励机制，强化学习使模型能够发展出可泛化的推理策略，在复杂问题上取得了监督微调难以企及的进展。

来自主题: AI技术研报

6702 点击 2025-07-31 10:10

开源Qwen一周连刷三冠，暴击闭源模型！基础模型推理编程均SOTA

卷疯了，通义千问真的卷疯了。

来自主题: AI技术研报

10630 点击 2025-07-28 10:21

超大模型推理加速2.18倍！SGLang联合美团技术团队开源投机采样训练框架

专门适用超大模型、带来2.18倍推理加速，最新投机采样训练框架开源！ SGLang团队联合美团搜推平台、Cloudsway.AI开源SpecForge。

来自主题: AI资讯

8765 点击 2025-07-27 13:22

在WAIC现场，全球首个拥有「原生记忆力」的大模型亮相，但不是Transformer

国内 AI 创企 RockAI 提出的非 Transformer 架构 Yan 2.0 Preview。这个架构极大地降低了模型推理时的计算复杂度，因此可以在算力非常有限的设备上离线运行，比如树莓派。

来自主题: AI资讯

9578 点击 2025-07-26 19:51

斯坦福大模型推理课免费了，谷歌推理团队创始人主讲

如何理解大模型推理能力？现在有来自谷歌DeepMind推理负责人Denny Zhou的分享了。就是那位和清华姚班马腾宇等人证明了只要思维链足够长，Transformer就能解决任何问题的Google Brain推理团队创建者。 Denny Zhou围绕大模型推理过程和方法，在斯坦福大学CS25上讲了一堂“LLM推理”课。

来自主题: AI资讯

8173 点击 2025-07-25 16:57