新浪财经 18小时前
SpaceX重整AI数据中心建设:补强供电和冷却冗余,扩张速度或放缓
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_font3.html

 

SpaceX 正在调整旗下 AI 数据中心的建设方式,将供电、冷却系统的可靠性和投运前测试置于更优先位置。新方案可能延长数据中心的建设周期,反映公司在 xAI 并入后开始修正此前以速度和算力为核心的扩张模式。

从快速投运转向可靠性建设

SpaceX 计划在数据中心启用前完成更多备用供电和冷却系统,并进行更全面的测试,同时减少临时电源及制冷设备的使用。部分既有设施也可能重新设计。

这一调整与 xAI 建设孟菲斯 Colossus 数据中心时的模式存在差异。该项目曾在 122 天内安装并启用 10 万枚 GPU。为压缩工期,施工团队同步推进冷却管道、电力和网络工程,数据中心在部分备用系统完工前便已运行,并长期使用燃气轮机等临时电源。

快速建设带来了运行风险。早期频繁断电曾迫使 AI 研究人员暂停项目,并损失部分模型训练进度。9 月 3 日,施工活动影响孟菲斯一处数据中心的电力线路,导致部分 Grok 模型离线,并波及部分外部算力客户。马斯克随后表示,公司正在采取纠正措施,防止类似事件再次发生。

火箭工程师接管,原数据中心团队多人离职

此次策略转变发生在管理层改组之后。SpaceX 今年 2 月完成对 xAI 的收购,6 月底开始由火箭制造和运营团队接管数据中心业务。拥有七年以上 SpaceX 经历、曾负责猎鹰火箭和龙飞船生产的 Wesley Salandro,接替 Dan Rowland 领导相关团队。

SpaceX 还从火箭及星链部门招募人员轮岗支援。在超过 1300 名志愿者中,已有 300 多名工程师于过去一个月加入数据中心项目。与此同时,项目近期有十多名负责人离职,涉及基础设施、安全、采购和财务等部门。

新管理层增加了中层管理岗位,并收紧现场人员采购设备和变更施工方案的权限。这些措施可能降低建设速度,但有助于统一设备规格、控制成本并减少单点故障。随着 SpaceX 开始向 Anthropic 和 Google 等外部客户出租计算能力,数据中心停机造成的影响已超出 Grok 自身业务,可靠性的重要性随之上升。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

数据中心 spacex 火箭 工程师 冷却系统
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论