马斯克秀算力:新增 66 万颗 GB300
马斯克公布了 Colossus 1 和 Colossus 2 最新的 GPU 部署规模及接下来的扩容计划。 Colossus 1 目前部署 15 万颗 NVIDIA H100、5 万颗 H200 和 3 万颗 GB200,合计 23 万颗 GPU。 Colossus 2 的规模更大,目前部署 11 万颗 GB200 和 44 万颗 GB300,合计 55 万颗 GPU。 两座集群目前合计部署约 78 万颗 GPU。 扩容仍在继续。 马斯克表示,另外 22 万颗 GB300 将在下周全面投入运行,届时 Colossus 1 和 Colossus 2 的 GPU 总规模将达到约 100 万颗。 按照当前计划,11 月还将有另外 22 万颗 GB300 投入运行,两座集群的 GPU 总规模将进一步增至约 122 万颗。 马斯克还表示,如果进展顺利,12 月底前可能再增加 22 万颗 GB300。 如果最后一批 GPU 也能如期投入运行,Colossus 1 和 Colossus 2 的 GPU 总规模最高将达到约 144 万颗。 其中,Colossus 2 届时将拥有 11 万颗 GB200 和最高 110 万颗 GB300,总规模最高达到 121 万颗 GPU。 与目前的 55 万颗相比,未来几个月最多还将增加 66 万颗 GB300。 马斯克还解释,为何扩容数字多次以 11 万颗为单位,主要与集群网络架构有关,取决于中央交换机能够连接的光纤数量。 Colossus 位于美国田纳西州孟菲斯,是 SpaceXAI 用于训练和运行 Grok 等 AI 模型的核心算力基础设施。 SpaceXAI 官方此前表示,计划在 2026 年为孟菲斯设施配置 100 万颗 GPU。 Colossus 最初于 2024 年开始建设。 SpaceXAI 官方资料显示,首套 Colossus 系统在 122 天内建成,随后又用 92 天将规模扩大至 20 万颗 GPU。SpaceXAI 此前还公布,到 2025 年底,Colossus I 和 II 的整体算力已经超过 100 万颗 H100 GPU 等效算力。 从马斯克此次公布的配置来看,Colossus 的扩张重点正在快速转向 NVIDIA Blackwell 平台。Colossus 1 仍以 H100、H200 为主,而 Colossus 2 已经大规模采用 GB200 和 GB300。未来计划新增的 GPU 则全部为 GB300。 如果年底前全部扩容计划完成,两座 Colossus 集群的实际 GPU 数量将从目前约 78 万颗增加至最高约 144 万颗,其中新增部分几乎全部来自 NVIDIA 最新一代 GB300。 Sawyer Merritt 估算,这批 GPU 的总价值可能超过 500 亿美元。 云头条