2026年10月6日 · 星期二

返回

SpaceX 重整数据中心建设,扩建或因此放慢

新班子要先装备用电源和冷却、测完再上线,少用燃气轮机等临时系统。Colossus 曾 122 天点亮 10 万块 GPU;现在可靠性优先,扩建可能变慢。

来源:The Information · SpaceX Overhauls Data Center Build-Out, Potentially Slowing Expansion
作者:Grace Kay(2026-09-10)

SpaceX 数据中心建设工地配图

本文为对上述报道的中文编译,力求忠实于原文事实、结构与引述。

SpaceX 新的数据中心策略,把可靠性放在快速铺开之前。

xAI 初期快建的数据中心,曾被频繁停电困扰。

火箭工程师现在领导数据中心团队,替换了原先的资深人员。

埃隆·马斯克以「快」出名。两年前,他用创纪录的时间给自己的人工智能初创公司建新数据中心,把这套管理哲学推到极致。但最近被他安插来管数据中心的火箭工程师团队,走的是另一条路。

据知情人士称,SpaceX 正在改变安置人工智能服务器的巨型设施的建造方式,这可能拖慢新园区的建设。其中两人说,新管理层打算为电力和冷却装上更多备份系统,并在数据中心投运前更彻底地测试这些系统,而不是像这家人工智能公司此前那样事后再补。一人说,SpaceX 还想减少数据中心里临时电力和冷却系统的使用。

这些人说,在某些情况下,新管理层正在重新设计现有数据中心的部分区域。

这一新做法,标志着与 xAI——马斯克的人工智能公司,现已并入 SpaceX——2024 年动手建设田纳西巨型数据中心园区 Colossus 时的路线分道。知情人士说,当时马斯克选择优先速度和算力容量,而不是先把提高可靠性所需的基础设施铺齐。

但在 6 月末,马斯克震动了 SpaceX 数据中心团队的管理层,用火箭发射团队的人替换了数据中心老兵。(SpaceX 今年早些时候收购了马斯克的 xAI 初创公司。)

两人说,数据中心团队新管理层今夏接手时告诉部分员工,调来 SpaceX 工程师,是为了提高公司在田纳西和密西西比设施的可靠性。

一人说,早期频繁停电迫使公司的人工智能研究人员把项目搁置数小时,并损失部分训练进度。对 SpaceX 来说,可靠性现在可能更要紧:它已开始把算力租给 Anthropic、谷歌等其他公司。

今年早些时候可靠性曾有改善,但有迹象表明,这次管理层改组可能带来新问题。据一名知情人士称,上周施工碰到一条电力线路,导致 SpaceX 在田纳西州孟菲斯的一座巨型数据中心发生一次高调停电。SpaceX 说,停电让部分 SpaceXAI 的 Grok 模型下线,余波也伤及一些算力客户。

SpaceX 发言人未回应置评请求。

扩建放慢 ​

马斯克看起来支持这项新政策。两人说,近几个月他几乎每周都去孟菲斯的设施,多半是周日;最近一次是刚过去的这个周日。

过去,他反复把公司快速建设数据中心的能力,宣传为人工智能竞赛中的关键优势。SpaceX 今年早些时候收购 xAI 后,甚至在 6 月的首次公开募股文件里写了速度这一条。

SpaceX 说,人工智能部门用 122 天把第一座配备 10 万块图形处理单元的数据中心点亮——在这个行业里,同等规模往往要数年。英伟达首席执行官黄仁勋曾称这支团队的努力「超人」(superhuman)、「难以置信」(unbelievable)。

知情人士说,为了求快,xAI 请来数千名承包商,并行建设设施的不同部分:安装冷却管道、拉电力和网络线缆、以及其他工种,常常在同一区域同时开工,而不是等一项完成再进入下一阶段。

但速度有代价。一人说,许多大型云厂商分阶段建设数据中心,以确保顺利、可靠运行。

知情人士说,SpaceXAI 的流程是:先把数据中心最低限度的电力和冷却基础设施点亮,备份系统后补,有的要过几个月才加上。一人说,自数据中心开张以来,公司一直依赖临时电力和冷却系统,例如几十台燃气轮机。

熟悉设计的人士说,最初上线时,公司前两座数据中心的冗余,只有其他超大规模云厂商数据中心的一小部分。此人说,这让它们容易停电:单台设备故障就可能让整簇下线。

知情人士说,数据中心团队里的个人有权批准施工计划和设备变更,也可以按需采购,而不是先优化成本。一人说,这有时意味着机架和服务器来源混杂,而不是统一供应。另一名知情人士说,这也可能损害可靠性。

需要说明的是,一人说:尽管更早建设备份系统、做更多测试,很可能拖慢施工,SpaceX 大概不会完全放弃 xAI 那套加速建设模式。

数据中心人事出走 ​

SpaceX 于 2 月完成对 xAI 的收购,当时这家初创公司现金消耗很大。交易关闭几个月后,SpaceX 领导人与数据中心团队成员开了情况摸底会,其中一人说。(收购前不久,SpaceX 也曾在加州帕洛阿尔托的 xAI 办公室开过类似的会,随后数十名工程师离开这家初创公司。)

过去几周,数据中心项目上十多名负责人离开团队,换成具备数据中心建设以外的制造与运营背景的 SpaceX 工程师和领导人。

人事出走发生在 SpaceX 的 Wesley Salandro 从 Dan Rowland 手中接管团队之后不久。Rowland 曾领导基础设施工程,一度直接向马斯克汇报。Salandro 在 SpaceX 工作七年以上,曾任猎鹰(Falcon)与龙飞船(Dragon)火箭的生产副总裁。Rowland 在 2024 年加入 xAI 之前,是特斯拉 Dojo 超级计算机项目的负责人;Salandro 接手后不久,他便离开了。

两人说,与 Salandro 上任同时,SpaceX 领导层号召得克萨斯州巴斯托普和佛罗里达州卡纳维拉尔角的部分火箭与星链工程师,自愿轮岗六到八周支援数据中心。他们说,超过 1,300 名工程师报名,过去一个月已有 300 多名 SpaceX 工程师加入数据中心项目。

几周之内,负责 SpaceXAI 物理基础设施的 Jake Palmer 离开。同时离开的还有:数据中心安保负责人 Logan Beach、数据中心采购负责人 Tiffany Wilson、数据中心财务负责人 Pablo Mendoza。SpaceXAI 在 Duke Energy 场址的项目工程师 Aakash Verma 8 月离开,加入 OpenAI;场地建设经理 Brent Mayo 也一并离开。曾参与数据中心设计的 Liz Balke,现在 Anthropic 的基础设施团队工作。

两人说,近几个月 SpaceX 领导人还给一度相当扁平的组织加了更多中层。这意味着工人批准设备订单或在现场做决定的自主权更少,从而可能拖慢建设,知情人士说。

震动可能还没完。上周数据中心停电后,马斯克在 X 上写道,公司正在「采取纠正措施,确保此事不再发生」。


中文编译,仅供学习交流。文中事实、引述与数字以 The Information 原文 为准;权利归原作者及原出版方。