spot_img

馬斯克xAI算力狂飆的戰略意圖與全球AI晶片競賽變局 Colossus 2晶片翻倍計畫的數字與時間表

文:張恭銘

馬斯克日前在X平台公布旗下xAI在美國曼菲斯打造的AI運算集群Colossus 2最詳細擴建時程。Colossus 2目前部署11萬顆輝達GB200晶片與44萬顆GB300晶片,合計55萬顆GPU。依照規劃,首批22萬顆GB300將於下週投入運作,11月再增22萬顆,若進展順利,12月底前還可能再啟用22萬顆。若三階段擴容全部落實,Colossus 2年底將新增66萬顆GB300,晶片總數達到約121萬顆,較目前增加約120%。

戰略意圖:算力租賃與模型訓練的雙輪驅動

這項擴張計畫的戰略邏輯遠不止於訓練Grok模型。xAI已將Colossus 1的算力租賃給Anthropic與Google,根據協議,Google的付款額將於10月增至每月9.2億美元。這意味著Colossus 2不僅是模型訓練的基礎設施,更是一座「算力工廠」,透過對外租賃創造現金流,支撐馬斯克在AI領域的持續投入。馬斯克同時指出,xAI的AI研究僅有3年歷史,而Anthropic和OpenAI分別已有6年和10年積累,若發展勢頭保持強勁,xAI有望在約6個月內達到領先地位。

技術約束:光纖電纜決定擴容節奏

值得注意的是,馬斯克特別說明了晶片以11萬顆為單位增加的原因——受到中央交換機的光纖電纜數量限制。這揭示了超大規模AI集群建設中,瓶頸往往不在GPU本身,而在於網路互連與資料傳輸的物理極限。Colossus 2全面採用Blackwell架構GB300晶片,相較Colossus 1的Hopper世代H100/H200,在能效與算力密度上有顯著提升,也確保了集群內部不會出現世代混雜的技術瓶頸。

對全球AI競爭格局的潛在衝擊

Colossus 2若如期達到121萬顆晶片規模,將成為全球最龐大的單一AI算力集群之一。特斯拉投資人Sawyer Merritt估計,Colossus兩期項目的晶片總價值超過1000億美元,提供超過2吉瓦的計算能力。這不僅是對輝達業績的強力背書,更預示著AI訓練的門檻已被拉高到「百萬級晶片」時代。當OpenAI、Anthropic等競爭對手還在規劃2027年路線圖時,xAI已將「城市級」算力規模落地,這場競賽正從算法層面的智力比拼,加速下沉為一場關乎能源、硬體調度與底層半導體製造的「重工業之戰」。