元脑SD200超节点刷新大模型Token速度,万亿参数模型跑进5ms!
元脑SD200超节点刷新大模型Token速度,万亿参数模型跑进5ms!浪潮信息宣布,元脑SD200超节点AI服务器率先完成主流领先开源大模型Kimi K2.6、DeepSeek V4、GLM 5.2、MiniMax M3等的高性能优化,并在Kimi K2.6万亿参数大模型上实现Token生成时间快达4.77ms,为Agent场景应用的高效运行提供强大算力支撑。
搜索
浪潮信息宣布,元脑SD200超节点AI服务器率先完成主流领先开源大模型Kimi K2.6、DeepSeek V4、GLM 5.2、MiniMax M3等的高性能优化,并在Kimi K2.6万亿参数大模型上实现Token生成时间快达4.77ms,为Agent场景应用的高效运行提供强大算力支撑。
美团今日宣布开源万亿参数大模型LongCat-2.0,同步开放针对国产算力芯片深度优化的推理代码。该模型总参数达1.6万亿,平均激活约480亿参数,是业界首个在五万卡国产算力集群上完成全流程训练与推理的万亿参数模型。
当地时间2026年7月2日,黑石旗下的数据中心运营商QTS正式决定,放弃参与位于弗吉尼亚州威廉王子县的Digital Gateway数据中心项目。Digital Gateway项目曾被视为AI时代的“算力圣地”:
AI 时代,面临传统电网和可再生能源的压力,科技巨头们争夺的资源已不仅仅是 GPU,而是稳定、低价、全天候不断电的清洁能源。现在,解决方案或许又多了一个新的选择。近日,美国核能初创公司 Ampera 称,已基于 3D 打印完成全球首个全尺寸核反应堆模块,旨在为 AI 数据中心、国防应用、工业设施和偏远地区等提供清洁电力。
OpenAI误导了整个AI圈好几年!过去五年,整个AI行业都被Scaling Law推着往前冲。现在,有人站出来说:这条曲线,一开始就错了。刚刚,他发出一篇博客,标题冷得发指——《Scaling Laws, Honestly》。
同样一兆瓦电,英伟达最新的GB300 NVL72能同时扛住61400个智能体,上一代H200只扛得住大约2600个。这中间,差了整整20倍。它就是独立评测机构Artificial Analysis发布的新基准:AA-AgentPerf。
埃森哲的 AI 策略负责人最近在一次内部会议上,吐槽了公司里消耗 AI 算力的情况:驱动 token 消耗的,不是工程师在做开发,是非技术人员在用 AI 把 PDF 转成 PPT。 这怎么是滥用呢?堂堂埃森哲一个咨询公司,做 PPT 才是正经事啊!
模型卷不过,Meta 反手开门卖自家算力,直接抢 AWS 的饭碗——昔日金主 CoreWeave、Nebius 一夜被炸崩 17%。
如果只看标题,它很容易被归到“又一个万亿参数大模型”的队伍里:1.6 万亿总参数、MoE 架构、100 万 token 上下文、面向代码和 Agent 场景。但这次真正值得看的,不只是模型有多大,而是它背后的三个问题:国产算力能不能支撑前沿级大模型训练?
随着全球智能体加速落地,算力需求呈指数级爆发,以 GPU 为核心的 AI 基础设施正变得愈发关键。据摩根士丹利报告预测,2028 年全球 AI 基础设施累计总投资将达 2.9 万亿美元。