推理芯片之战:聊聊Groq、Cerebras与OpenAI三大路径与Bill Dally的设计哲学
推理芯片之战:聊聊Groq、Cerebras与OpenAI三大路径与Bill Dally的设计哲学本期节目对比了Groq、Cerebras与OpenAI在推理芯片上的三条技术路径,指出业界正围绕SRAM提升带宽性价比进行系统级异构收敛,并分享了英伟达首席科学家Bill Dally关于局部性与追求全局最优的芯片设计哲学。
搜索
本期节目对比了Groq、Cerebras与OpenAI在推理芯片上的三条技术路径,指出业界正围绕SRAM提升带宽性价比进行系统级异构收敛,并分享了英伟达首席科学家Bill Dally关于局部性与追求全局最优的芯片设计哲学。
从真武 V900 到新一代磐久超节点服务器,平头哥八年来陆续布局的 AI 芯片、CPU、scale up 互联、scale out 网络和存储芯片,开始被装进同一套算力系统。
在华为2026年全联接大会上,华为发布"灵衢"统一互联总线协议及昇腾960超节点、OceanStor M900 AI记忆存储等AI基础设施新品,使10万卡集群模型浮点算力利用率从20%提升至35%,并支持单集群100万颗AI处理器。
高通提前剧透下一代骁龙旗舰移动平台的核心升级:Oryon CPU首次实现5GHz主频并引入动态缓存架构FlexCache,Hexagon NPU推出Element Accelerator与更大共享内存,Adreno GPU首次加入Matrix Cores并集成AI图形渲染技术Adreno Neural Fusion,全面强化端侧智能体AI性能与体验。
寒武纪正式成为PyTorch基金会最高级别白金成员并获得理事会席位,其AI框架高级总监王进加入理事会、PyTorch核心维护者朱靖进入技术咨询委员会,标志着中国AI芯片从框架适配者转变为全球AI开源生态的参与者。
寒序科技正式公布uHBM®与uLPU™推理计算架构,首次完整亮相其基于Persistent MRAM的权重驻留片内计算方案。
RSI(Recursive Self-Improvement,递归自我改进)正在成为人工智能领域最受瞩目的前沿方向。
2022 年,刘癸庚遇到了博士期间最难回答的一道题。
就在刚刚,OpenAI首颗自研芯片Jalapeño「墨西哥辣椒」,交出了首批实测成绩单——AI推理性能,全面反超英伟达GB200和GB300。实测速度直接起飞!Jalapeño一秒能狂吐1459个Token,英伟达GB200只有535个,连一半都不到。
初创公司Groq已完成3.5亿美元融资,继续推进其从AI芯片制造商向新云公司的转型,致力于提供强大的GPU及AI基础设施服务。本轮融资由投资公司Disruptive领投,英伟达计划参与其中,此次融资对该公司的估值为35亿美元。