OpenAI推出自研AI芯片应对推理需求,2026年亮相
OpenAI推出自研AI芯片应对推理需求,2026年亮相据路透社消息,OpenAI的首款自主研发AI芯片将于2026年亮相。此芯片由博通(Broadcom)负责设计,台积电(TSMC)进行代工,表明OpenAI开始深入硬件领域。该举措旨在通过定制推理芯片,降低运营成本、优化AI推理环节的效率,同时提高芯片供应链的灵活性和安全性。
搜索
据路透社消息,OpenAI的首款自主研发AI芯片将于2026年亮相。此芯片由博通(Broadcom)负责设计,台积电(TSMC)进行代工,表明OpenAI开始深入硬件领域。该举措旨在通过定制推理芯片,降低运营成本、优化AI推理环节的效率,同时提高芯片供应链的灵活性和安全性。
不久之前,OpenAI 发布了 o1 系列模型,其强大的推理能力让我们看见了 AI 发展的新可能。近日,OpenAI 著名研究科学家 Noam Brown 一份 5 月的演讲上线网络,或可揭示 o1 背后的研究发展脉络。
虽然英伟达的GPU在AI训练领域的主导地位仍然难以撼动,但似乎有迹象表明,在AI推理方面,竞争对手正在迎头赶上这家科技巨头,尤其是在能效方面。
智东西8月28日消息,AI芯片独角兽Cerebras Systems于8月27日宣布推出AI推理服务Cerebras Inference,号称“全球最快”。该服务已经在云端上线。
LLM数学水平不及小学生怎么办?CMU清华团队提出了Lean-STaR训练框架,在语言模型进行推理的每一步中都植入CoT,提升了模型的定理证明能力,成为miniF2F上的新SOTA。
不用H100,三台苹果电脑就能带动400B大模型。 背后的功臣,是GitHub上的一个开源分布式AI推理框架,已经斩获了2.5k星标。
什么AI应用每秒处理20000个AI推理请求,达到2024年谷歌搜索流量的1/5?
对于小型语言模型(SLM)来说,数学应用题求解是一项很复杂的任务。
大模型的训练阶段我们选择GPU,但到了推理阶段,我们果断把CPU加到了菜单上。
在英伟达市值超过2万亿位居全球第三之后,谁能挑战它赖以生存的GPU芯片?