马斯克xAI建全球最大AI数据中心,66万块英伟达GPU半年内上线
特斯拉CEO埃隆·马斯克旗下xAI公司正在加速推进其位于孟菲斯的Colossus 2数据中心建设,计划在2026年底前部署66万块英伟达Blackwell GB300 GPU。该项目被视为全球最大的A...
近日,特斯拉CEO埃隆·马斯克(Elon Musk)宣布,其旗下人工智能公司xAI正在加速推进位于美国田纳西州孟菲斯的Colossus 2数据中心建设。根据最新披露的信息,该数据中心计划在2026年底前上线66万块英伟达Blackwell GB300 GPU,整体部署规模超过50万块AI GPU,将成为全球最大的AI计算基础设施之一。
Colossus 2项目于2024年开工建设,是xAI计算能力扩张计划的核心部分。与一期工程Colossus 1相比,Colossus 2将全面采用英伟达最新的Blackwell架构GPU,其中GB300是GB200的升级版,二者均搭载Grace CPU,但GB300使用的是更新的Blackwell Ultra GPU。目前,Colossus 2已部署11万块GB200 GPU和44万块GB300 GPU,预计到本周末将再上线22万块GB300,11月底增加22万块,最后一批22万块将于2026年12月底前完成部署。
马斯克表示,Colossus 2的建设速度远超预期,这得益于其借鉴特斯拉超级工厂模式的高效部署策略。他透露,Colossus 1数据中心最初依赖20万块英伟达H100 GPU,目前已扩展至23万块,其中包括3万块GB200 AI GPU。加上Colossus 2的66万块GPU,xAI在运营的GPU总数将达到约144万颗,其中仅GB300就将达到110万颗。
这一庞大的算力规模将显著提升xAI的模型训练能力。马斯克表示,尽管其AI业务仅有3年历史,而Anthropic和OpenAI分别已有6年和10年的积累,但如果保持当前的发展势头,xAI有望在未来6个月内达到与这些头部企业相当的水平。他特别指出,快速实现大规模在线计算极其困难,但通过Colossus 2这样的超级工厂式数据中心,可以有效解决这一难题。
值得注意的是,Colossus 2的数据中心配套建设了1.2吉瓦的自备电厂,提供的算力超过2吉瓦。目前,谷歌已经签约使用该数据中心的部分算力,每月付款额将在10月增至9.2亿美元。这一合作不仅为xAI带来了可观的收入,也进一步验证了其数据中心的商业价值。
从技术角度来看,Colossus 2的建设标志着AI基础设施向更高性能、更大规模方向发展。英伟达Blackwell架构的引入,使得xAI能够充分利用最新的硬件优势,包括更高的能效比和更强的并行计算能力。这将为其后续推出的新一代Grok系列模型提供坚实的基础。
业界普遍认为,Colossus 2的建成将改变AI领域的竞争格局。随着xAI算力的快速扩张,其在模型开发和应用落地方面的竞争力将进一步增强。未来,xAI能否凭借强大的算力优势,在与Anthropic和OpenAI的竞争中占据领先地位,值得持续关注。
