SpaceXAI 首席执行官埃隆·马斯克计划在其公司的 Colossus 数据中心项目中部署超过 50 万个 NVIDIA AI GPU。Colossus 项目于 2024 年开工建设,其一期工程 Colossus 1 已投入运营。马斯克此次谈及的是二期工程 Colossus 2,该项目与一期工程一样,也在孟菲斯进行开发。马斯克表示,Colossus 1 主要采用 NVIDIA 的 Hopper GPU,而 Colossus 2 将主要采用 NVIDIA 的 Blackwell GB300 GPU。
马斯克表示,SpaceXAI 位于孟菲斯的 Colossus 2 数据中心计划在 2026 年底前上线 66 万块 NVIDIA Blackwell GPU。由于 GPU 是人工智能构建中最稀缺的资源之一,埃隆·马斯克的 Colossus 2 数据中心是全球最大的数据中心之一。借鉴特斯拉的做法,xAI 将 Colossus 称为其计算领域的“超级工厂”,该数据中心依赖于 20 万块 NVIDIA H100 GPU。有趣的是,马斯克最近关于该数据中心的评论显示,该数据中心的 GPU 总数已达到 23 万块,因为他提到 Colossus 1 也使用了 3 万块 NVIDIA GB200 AI GPU。
对于 Colossus 2 项目,马斯克和 xAI 计划主要采用 NVIDIA 的 Blackwell GB300 GPU。GB300 是 GB200 的升级版。虽然它们都采用了相同的 Grace CPU,但 GPU 使用的是更新的 Blackwell Ultra 型号。
这位高管的最新言论是他此前就 SpaceXAI 发表的一系列评论的一部分,这些评论与他声称 SpaceXAI 应该能够达到 Anthropic 的 Fable 类模型和 OpenAI 的 GPT-6 模型的水平有关。他认为,这些模型应该在未来两到三个月内就能实现。马斯克补充说,“快速实现大规模在线计算极其困难”,并补充道:“我们将继续加速发展。我们的人工智能研发项目只有 3 年历史,而 Anthropologie 和 OpenAI 分别有 6 年和 10 年的历史。如果我们的二阶导数保持强劲势头,SpaceX 将在大约 6 个月内占据领先地位。”
马斯克致力于在计算能力上与 Anthropologie 和 OpenAI 相匹敌,而其核心在于计算基础设施。据马斯克透露,SpaceXAI 正在努力将 NVIDIA 的 GB300 GPU 添加到 Colossus 2 数据中心。他指出,目前该数据中心运行着 11 万块 GB200 GPU 和 44 万块 GB300 GPU。马斯克补充说,到本周末,该数据中心应该会将 22 万块 GB300 GPU 上线,到 11 月底还将有另外 22 万块投入运营。这位高管认为,最终,在 2026 年底之前,该数据中心应该会在 12 月底之前将最后一批 22 万块 GB300 GPU 上线。