扎克伯格亲证千兆瓦级AI集群:算力军备竞赛进入“千亿美元俱乐部”时代

当Meta创始人马克·扎克伯格亲口说出“我们正在建设这个Prometheus集群,首个千兆瓦以上的单一集群……我们是在谈论数千亿美元的资本投入”时,AI行业的算力竞赛正式跨过了一个关键里程碑。这不再是某家公司的实验室实验,而是全球科技巨头对下一代通用智能基础架构的豪赌。

千兆瓦级是什么概念?以当前最先进的NVIDIA H100 GPU为例,单颗功耗约700瓦,千兆瓦意味着一个集群可同时驱动超过140万颗H100。对比OpenAI此前披露的“百亿级美元”训练集群,千兆瓦级的资本支出直接提升了一个数量级——数千亿美元,相当于多个主权基金的年度投资额。扎克伯格口中的Prometheus集群,并非简单堆砌硬件,而是从电力供应、芯片互联到冷却系统的全链条重构,目的是支撑未来超大规模模型(如Llama 4或更高级别)的持续扩展。

这一消息的深层含义在于:AI算力正从“可租赁的云资源”演变为“不可替代的核心资产”。Meta、微软、谷歌等巨头自研芯片、自建数据中心,本质上是在构建排他性的算力壁垒。对于依赖云算力的创业团队和科研机构而言,这意味着:第一,训练成本的基底将随集群规模加速膨胀,百亿参数模型的门槛会持续提高;第二,云厂商的定价策略将更多反映自身集群的边际成本,而非单纯的市场竞争——当Meta、Google等同时扮演“算力供给方”和“模型研发方”时,第三方云客户可能会面临算力优先配给的挤压。

从行业格局看,千兆瓦级集群的落地将加速“算力集中化”趋势。中小团队若想参与前沿模型研发,要么拥抱开源生态(如Llama系列),在已有预训练基础上做微调;要么聚焦垂直场景,避开与巨头拼算力规模。而对投资机构而言,此时更需要关注电力基础设施、液冷散热、光互连等配套产业链——它们将从这场军备竞赛中获取确定性增长。

扎克伯格的发言并非孤例。早在2024年,微软和甲骨文就已披露过百兆瓦级集群计划,但千兆瓦是质的飞跃。可以预见,未来18个月内,全球将出现至少3-5个千兆瓦级AI集群,它们将成为新一代“数字工厂”,而谁控制了这些工厂,谁就掌握了AGI时代的入场券。对于所有AI从业者,是时候重新计算你的“算力杠杆”了:要么加入巨头的生态,要么找到那条不需要千兆瓦也能存活的赛道。