重回世界第一,中國超算未來怎么走_靈晟_發展_盧宇彤
【環球時報綜合報道】近日在德國漢堡舉行的第41屆國際超算大會上,新公布的全球超級計算機TOP500榜單顯示,首次入榜的中國超算“靈晟”位列榜首。這是自2017年“神威·太湖之光”以后,時隔9年我國超算再次排名全球第一。“靈晟”何以領先其他超算登頂榜單?中國超算重獲世界冠軍有何重要意義?未來又將如何發展?《環球時報》記者就此***訪了多名業內專家。
“靈晟”奪冠的秘訣
“靈晟”超級計算機部署在國家超算深圳中心,持續雙精度浮點性能達2.19EFlops(衡量算力規模的性能單位),即每秒可執行219億億次浮點運算,是世界上首個持續性能超200億億次(即2EFlops)的超算系統。
這么快的運算速度意味著什么?“靈晟”超算系統總設計師、國家超算深圳中心主任盧宇彤用一個比喻來說明:“按照每人每秒完成一次簡單計算來估算,‘靈晟’一秒鐘完成的計算量,大約相當于全球70億人連續計算近10年。”
它的性能不止于計算速度快,更在于***用了非常有特色的架構——首創Online Acceleration的全CPU架構,打破傳統CPU+GPU異構架構壁壘。
全國政協委員、中國計算機學會高性能計算專委會副主任張云泉對《環球時報》記者表示,中國超算之前曾公開過多種技術路線,其中包括異構眾核、CPU+GPU等,“靈晟”延續了“神威·太湖之光”的眾核路線,只不過是***用了同構眾核。這種眾核處理器的好處是特別適合于進行科學計算的運行,用戶用起來難度會降低,移植起來的成本也會降低。
張云泉認為,總體來看,“靈晟”這類超算主要面向科學計算任務,并在一定程度上結合人工智能(AI)應用,但它與當前主流的大模型訓練與推理系統(尤其是以GPU為核心的體系)并不完全相同,本質上仍然更偏向傳統意義上的超算系統。
盧宇彤認為,“靈晟”登頂是中國超算發展歷程中的一個重要里程碑。“這標志著我國高性能計算在核心芯片、高速互連、系統軟件、綠色節能以及應用協同等關鍵環節形成了系統性創新能力。”
中國超算為何9年后重登榜首
2013年至2017年,我國憑借“天河二號”“神威·太湖之光”兩大超算系統,在全球超算TOP500榜單(每年6月和11月各更新一次)中斬獲十連冠。此后多年,中國超算團隊聚焦核心技術自主可控,深耕技術迭代與算力應用落地,接連攻克一系列“卡脖子”技術難題。
張云泉表示,“靈晟”奪得世界冠軍的意義在于,中國超算的研制在蟄伏了多年之后,再一次參加TOP500排行榜。此舉向世界釋放的信號是,中國有能力研發出自主可控的超算系統,而且是世界冠軍級別。之前幾年之所以不參加排名,并非沒有合適的超算可以參加,主要是基于以下幾個考慮:一是要保護核心參數,避免被一些國家針對性制裁;二是要等待國產半導體供應鏈發展成熟,能夠完全獨立自主地進行研制;三是我國之前已經拿過11次世界冠軍,包括十連冠,所以中國超算研制機構對于爭取超算世界冠軍的心態更加成熟了。
在本次榜單上,美國超算“酋長巖”(El Capitan)、“前沿”(Frontier)、“極光”(Aurora)三臺E級超算(每秒百億億次級別計算)分列第二三四位,德國“木星助推器”(JUPITER Booster)位列第五,前十位中半數為E級超算系統。
盧宇彤表示:“中國超算現在已經從跟跑、并跑,進入到超智融合架構創新階段,把算力優勢轉化為科學發現、工程突破和產業創新的生產力。”
談及全球高性能計算競爭格局,盧宇彤說,當前,美國、歐洲、日本都在圍繞E級計算、AI和科學智能加快布局。中國超算經過多年發展,已經具備完整的系統研制和應用支撐能力。“靈晟”登頂說明,中國超算能夠達到世界最高性能水平,也能引領面向AI時代的新型計算架構。中國超算在不斷擴大算力規模的同時,邁向服務科學發現、工程創新和AI融合發展的新階段。
中國超算未來要走自己的路
“靈晟”奪冠之后,將會如何進一步發展?盧宇彤表示,“靈晟”登頂是階段性成功,也是新的起點。團隊接下來將進一步完善“靈晟”的超智融合多領域應用軟件和服務環境,構建國產超算軟件生態和應用生態,讓系統充分發揮應用效益。“未來十年,超算仍然是國家科技競爭和產業創新的重要底座。”盧宇彤說,“只有把關鍵技術掌握在自己手里,才能真正支撐面向未來的科學計算和AI發展。”
談到全球超算未來的發展方向,張云泉表示,從大的發展趨勢來看,全球超算的下一個里程碑應該是運算速度達到1000EFlops的超算,也就是Z級超算。但目前世界各國都還沒有公布自己的研制***。據業內專家分析,即使是***用最好的技術,全球Z級超算最早的研制成功時間也要到2035年。所以對標下一個里程碑,就要看全球超算大國誰能率先突破。近期一個觀察點是哪國能率先實現10EFlops的雙精度浮點超算。
也有業內專家認為,其實***用現有技術,完全可以堆出10EFlops級別的超算,甚至更高級別的超算。但關鍵問題是超算需要考慮運營成本,因此全球超算業界對這種頂級超算的功耗有一定限制,希望將功耗限制在50兆瓦以內來實現相關運算目標,而這是目前最難做到的一點。
張云泉分析稱,未來超智融合也是一個大的發展方向。大模型時代的AI超算發展很快,已經可以達到一個系統集成幾十萬張卡的算力,能夠實現幾十EFlops的混合精度性能。這是因為相比聚焦科學計算任務的傳統超算,智能超算可以實現更高的經濟效益,所以為了追求更高的算力,就取消了對其功耗的限制。
在第41屆國際超算大會上,超智融合也是與會專家討論最多的話題之一。熟悉情況的一名業內專家告訴《環球時報》記者,傳統超算用于解決科學模型,追求高精度的確定性求解;而AI大模型驅動的智算追求中低精度的大規模并行。按照以往的思路,兩者用不同的硬件、不同的軟件,服務不同的用戶群體。但如今超算和智算的融合趨勢,使得全球超算的下一步發展面臨艱難的選擇:是等硬件突破、發展性能覆蓋從高精度科學計算到低精度推理等所有場景的“全能芯片”,還是靠架構創新和調度優化,讓不同制程、不同精度的算力協同起來,把現有***用出最大價值。專家表示,中國選擇的是第二條道路,這也就意味著需要將計算芯片的算力、高速存儲和網絡互連能力結合起來,充分發揮出它們的最大性能,并穩定運行,才能實現大規模AI算力集群的高效協同。
值得注意的是,第41屆國際超算大會發布的最新IO500榜單中,中國國家超算互聯網多家算力中心所使用的ParaStor F9000分布式全閃存儲系統,在生產型全節點和10節點兩大榜單中同時位列全球性能第一,為我國構建AI時代高性能算力體系奠定了堅實存力自信。
(前沿科技工作室)返回搜狐,查看更多








