前不久,中國首個全國產十萬卡AI超集群曙光8000(登峰)在鄭州正式落成,並同步接入國家超算互聯網。這是國內首個從芯片到服務器再到交換機,全部完成國產化的十萬卡集群。據鈦媒體7月14日報道,若全部用於模型推理,該集群可支撐當前中國5%至10%的Token訪問需求;若用於科學計算,可在一天內完成過去數月才能跑完的模擬任務。

截至2025年底,全國已建成萬卡智算集群42個,但十萬卡集群此前沒有先例。中科曙光(Sugon)高級副總裁李斌表示,萬卡到十萬卡的升級不存在十倍疊加的線性邏輯,算力規模每提升一個數量級,系統的工程難度、可靠性壓力、協同複雜度都會呈幾何倍數增長。

曙光8000採用「原生超智融合」架構,在同一套系統內同時支持從FP64到INT8的全精度計算,既能承接傳統超算的高精度科學工程任務,也能支撐大模型訓練和智能體推理。為此,曙光自研了scaleFabric高速互連網絡,採用類InfiniBand的原生RDMA技術,具備毫秒級鏈路故障恢復能力。在櫃級單元內優先使用銅互連而非光互連,以提高可靠性並降低故障率,同時採用浸沒式液冷控制溫度波動。

在具體應用中,8萬張卡完成了蛋白質折疊全流程模擬,9萬張卡協同完成了3.16萬億原子的DFT高精度仿真,8.8萬張卡完成了328萬億網格湍流直接模擬。李斌坦言,國產芯片單點能力與全球頂尖水平尚有差距,但可以用更多芯片、更優的系統效率彌補。

據企業官方信息,中科曙光已與北京科學智能研究院達成合作,啟動第二套十萬卡系統的研制與建設。不過,十萬卡集群若要從示範工程走向商業可複製,仍需面對大模型工程化能力、推理需求增長及全生命周期成本等關鍵挑戰。