沒用一塊GPU!國產超算靠自研CPU干翻美國,重返全球第一_靈晟_中國_系統
中國芯片“逆襲”,時隔九年重返全球第一!
近日,最新全球超算TOP500榜單揭曉,中國“靈晟”拿下第一,每秒跑到219.8億億次,是全球超算第一次沖破2EFlops的算力天花板。
先科普下,全球超級計算機500強榜單由國際組織“TOP500”編制,約每半年發布一次,算是全球超算界的“奧斯卡”。中國超算上一次登頂,還得追溯到2017年的“神威·太湖之光”。
時隔九年,中國超算重回世界巔峰。
從太湖之光的每秒9.3億億次,干到了靈晟的每秒219.8億億次,性能提升了超過23倍。
消息一出,國內網友直接沸騰。有人自豪地表示:咱不爭第一,不代表沒有第一。
更硬核的是,這次全是國產芯,誰也卡不住。
那么,在高端GPU被全面斷供的今天,中國超算是怎么做到的?
帶著這個疑問,咱來拆一拆靈晟背后的技術密碼。
先看硬實力。靈晟由國家超級計算深圳中心研制部署,搭載國產LX2處理器,這顆芯片基于ARM架構,每顆集成304個核心。整個系統由20480個計算節點,加起來近245萬個CPU核心,相當于把24萬多臺高性能電腦綁在一起干活。
那么,它跑起來有多快呢?“每秒2.198百億億次”這個數字聽起來有點抽象。打個比方:全世界70億人,每人拿個計算器不停按,要整整十年才能趕上它一秒的工作量。
這個速度,直接把長期霸榜的美國“酋長巖”擠了下去,性能領先超過20%。
更硬核的是,它沒用一塊GPU加速卡。
當前主流超算普遍走“CPU+GPU”異構路線,CPU負責調度,GPU負責算力。行業也早有共識:論并行計算,GPU天生比CPU強。
但靈晟沒按這個劇本走。它是純CPU同構架構,整機搭載約4.7萬顆國產LX2處理器,完全不依賴任何國外GPU。
別人用顯卡堆算力,我們自己造的CPU來干同樣的事,而且干成了!
而真正讓外界震撼的,是全棧國產。整個系統的心臟是國產LX2處理器,它基于ARMv9架構,每顆集成304個核心,全系統近4.7萬顆處理器、加起來超過245萬個CPU核心。每個核心支持ARM SVE和SME可伸縮擴展,能同時處理FP64科學計算和BF16、INT8等AI數據格式,這正是“超智融合”的硬件根基。
存儲方面,LX2集成了首顆國產HBM高帶寬內存,帶寬達4TB/s,較傳統CPU提升10倍,同時配合最大256GB的DDR5內存,由內置SDMA引擎智能調度數據。HBM此前幾乎被三星、SK海力士壟斷,國產化本身就是一枚重磅信號。
互聯和系統層面,自研“靈啟”高速互聯網絡撐起了這座超算的骨架,支持200萬個端口、10萬節點組網,每節點帶寬1.6Tb/s。操作系統跑的是國產麒麟,散熱***用100%全液冷方案,能效比達51-52GFlops/W,整機功耗約42.2MW。
說到底,高端GPU買不到,英偉達CUDA生態的路也走不通,那就不走了。靈晟從芯片到網絡到系統,徹底甩開了對國外加速器的依賴。這是一個真正的、從硬件到軟件的全棧式突破。
縱觀中國超算史,曾多次登頂世界第一,卻屢遭美國“拉黑”,超算中心、研發企業被列入實體清單,高端芯片和互聯器件供應被切斷。
過去,國內部分超算仍存海外技術依賴,一旦高調上榜就容易引來精準打壓。靈晟登頂證明了一件事:封鎖,堵不死中國的路。在高端GPU被禁運的情況下,中國超算硬是蹚出了一條自己的路。
這條路不一定是最優解,但它證明:沒有英偉達,照樣造出世界最快的計算機。與其說這是“超越”,不如說這是“不被卡死”。
而且靈晟不是擺設,已經在實實在在干活了,天氣預報、飛機火箭設計、新藥研發、AI大模型訓練,這些關乎國家長遠發展和科技前沿的大事,現在都有了更強大、更安全、完全自主可控的算力兜底。
靈晟只是一個節點,不是終點。封鎖,擋不住創新。
本文由極果用戶極果原創返回搜狐,查看更多









