2亿枚AI芯片大爆发,人类最大基建集体开工!

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
2亿枚AI芯片大爆发,人类最大基建集体开工!
7278点击    2026-08-03 10:08

2亿枚AI芯片,要集体开机了!


目前,全球投入使用的AI芯片,总算力已经相当于约2000万枚英伟达H100芯片


按照Epoch AI的估算,这个数字大约每9个月翻一倍。


到2028年年底,全球AI算力预计将相当于约2亿枚


不到3年,直接增长到今天的10倍。


2亿枚AI芯片大爆发,人类最大基建集体开工!


但这2亿枚芯片,并不只是为了训练一个更大的模型。


它们要支撑的是一套不断加速的循环:


  • 芯片增加,模型变强;
  • 模型变强,Agent开始承接更多工作;
  • Agent开始参与写代码、跑实验,下一代模型的研发随之提速;
  • 新模型上线,又带来更大的算力需求。


每转一圈,需要的算力更多,AI迭代的速度也会更快。


而这,正是AI行业正在押注的ASI路径。


AI数据中心,进入百万级算力时代


要让这套循环真正跑起来,第一步就是把更多芯片组成更大的计算集群。


目前,Epoch AI追踪的74座大型AI数据中心共有约1250万枚等效芯片


其中,最大的Colossus 2位于美国孟菲斯,算力约为111.2万枚


2亿枚AI芯片大爆发,人类最大基建集体开工!


紧接着的几座,也已经冲到几十万枚量级:


  • 微软Fairwater Atlanta:约76.9万枚;
  • Meta Prometheus:约76.3万枚;
  • 亚马逊New Carlisle:约68.6万枚;
  • OpenAI Stargate Abilene:约50.9万枚。


训练前沿模型时,海量芯片需要通过高速网络持续交换数据。一次训练可能运行数周甚至数月,芯片、网络、存储和软件必须一起协作。


从某种角度来说,数据中心本身,已经变成了新一代计算机。


2亿枚AI芯片大爆发,人类最大基建集体开工!


2亿枚AI芯片大爆发,人类最大基建集体开工!


2亿枚AI芯片大爆发,人类最大基建集体开工!


2亿枚AI芯片大爆发,人类最大基建集体开工!


2022|得梅因:OpenAI在爱荷华州得梅因附近的数据中心完成GPT-4训练。


2024|孟菲斯:xAI把一座旧家电工厂改造成Colossus,一次接入10万枚英伟达GPU。


2026|印第安纳:Anthropic接入亚马逊建设的互联数据中心集群。


2026|威斯康星:微软首座Fairwater设施正式投运,性能达到全球最快超级计算机的10倍。


相应的,投入的资金也随之起飞。


2026年,亚马逊、Alphabet、Meta、微软和甲骨文五家公司的资本开支预计合计约7500亿美元,相当于它们全年总收入的38%。


IDC预计,AI基础设施支出将从2025年的3180亿美元,增长到2029年的1万亿美元以上


把芯片、服务器、光纤、土地和电力全算进去,这场AI建设已经冲到了人类基础设施史上从未有过的规模。


根据Google DeepMind联合创始人兼CEO Demis Hassabis判断,AI带来的技术变革,不仅可能会达到工业革命的10倍,而且推进速度也会快10倍。


2亿枚AI芯片大爆发,人类最大基建集体开工!


芯片越堆,Agent越能干


算力起来以后,最先变强的是模型。


律师考试、15天天气预报、疾病机制研究、延续数十年的数学难题,AI能处理的事情一项项增加。


更明显的变化,出现在Remote Labor Index里。


这套测试包含240个真实项目,覆盖23个领域,相当于超过6000小时的人类工作。


2025年10月,领先模型只能完成其中2.5%的任务。到了2026年7月,Claude Fable 5已经把完成率拉到16.1%。


8个月,能力涨了6倍多!


虽然AI还包办不了所有工作,但已经开始承接可以交付、验收和计价的任务。


模型越能干,Agent接手的任务也越复杂。


你随口说一句「帮我做一份市场调研」,Agent就要搜索网页、阅读文件、运行代码、制作表格、核对数字,再根据结果调整后续步骤。


Agent每向前走一步,后台就要再进行一轮计算。


这部分计算,就是推理。


Gartner预计,2026年面向AI的云基础设施支出中,55%将用于推理;到2029年,这一比例将超过65%!


2亿枚AI芯片大爆发,人类最大基建集体开工!


当然,Agent能接手的不只是市场调研。


更难的科研任务,也开始进入同一套工作流。


7月,Claude Fable 5甩出一个反例,推翻了存在87年的广义雅可比猜想。


另一边,Claude Science不仅把接近两年的科研工作压缩到了几周,还让一套基因分析流程提速了近10倍。


而所有科研任务中,最特殊的一类,正是AI研发本身。


AI正在学会造自己


最直接的例子,来自GPT‑5.6 Sol。


就在最近,它支撑整个GPT‑5.6系列运行的生产系统给优化了。


具体来说,工程师先定方向,然后Sol直接参与重写GPU Kernel,一口气跑了数百次实验。


结果就是,端到端服务成本下降20%,Token生成效率提升超过15%。


OpenAI转头就把这轮效率提升写进了价格表。


GPT‑5.6 Luna的输入、输出价格同时下调80%,直接降到原来的两折。


AI一边参与改进系统,一边把自己的运行成本打下来。


这个循环,已经开始了。


2亿枚AI芯片大爆发,人类最大基建集体开工!


在Google首席科学家Jeff Dean看来,未来可以让成千上万个小模型同时提出研究想法、设计实验、分析结果,再把最好的线索交给更大的模型和人类研究者,然后一直迭代下去


至此,整条链路就真正地接上了:


算力变成模型,模型驱动Agent,Agent又回到研发流程,参与制造下一代AI。


2亿枚AI芯片不是终点。它们要让这个循环跑得更快。


而AI,已经开始给下一个AI打工了。


参考资料:
https://www.linkedin.com/posts/jorge-guajardo_the-impending-inescapable-deluge-of-ai-activity-7489710082021158912-FZRh/


文章来自于微信公众号 “新智元”,作者 “新智元”

AI转型,免费服务,就找AITNT
AITNT资源拓展
根据文章内容,系统为您匹配了更有价值的资源信息。内容由AI生成,仅供参考
1
AI工作流

【开源免费】字节工作流产品扣子两大核心业务:Coze Studio(扣子开发平台)和 Coze Loop(扣子罗盘)全面开源,而且采用的是 Apache 2.0 许可证,支持商用!

项目地址:https://github.com/coze-dev/coze-studio


【开源免费】n8n是一个可以自定义工作流的AI项目,它提供了200个工作节点来帮助用户实现工作流的编排。

项目地址:https://github.com/n8n-io/n8n

在线使用:https://n8n.io/(付费


【开源免费】DB-GPT是一个AI原生数据应用开发框架,它提供开发多模型管理(SMMF)、Text2SQL效果优化、RAG框架以及优化、Multi-Agents框架协作、AWEL(智能体工作流编排)等多种技术能力,让围绕数据库构建大模型应用更简单、更方便。

项目地址:https://github.com/eosphoros-ai/DB-GPT?tab=readme-ov-file



【开源免费】VectorVein是一个不需要任何编程基础,任何人都能用的AI工作流编辑工具。你可以将复杂的工作分解成多个步骤,并通过VectorVein固定并让AI依次完成。VectorVein是字节coze的平替产品。

项目地址:https://github.com/AndersonBY/vector-vein?tab=readme-ov-file

在线使用:https://vectorvein.ai/付费

2
智能体

【开源免费】AutoGPT是一个允许用户创建和运行智能体的(AI Agents)项目。用户创建的智能体能够自动执行各种任务,从而让AI有步骤的去解决实际问题。

项目地址:https://github.com/Significant-Gravitas/AutoGPT


【开源免费】MetaGPT是一个“软件开发公司”的智能体项目,只需要输入一句话的老板需求,MetaGPT即可输出用户故事 / 竞品分析 / 需求 / 数据结构 / APIs / 文件等软件开发的相关内容。MetaGPT内置了各种AI角色,包括产品经理 / 架构师 / 项目经理 / 工程师,MetaGPT提供了一个精心调配的软件公司研发全过程的SOP。

项目地址:https://github.com/geekan/MetaGPT/blob/main/docs/README_CN.md