
一家領軍企業選擇“不建牆”,而是為整個AI計算産業“修路”。
在2025世界智能産業博覽會上,中科曙光協同AI芯片、AI整機、大模型等20多家産業鍊上下遊企業,共同發布了國内首個AI計算開放架構。
這一舉動被産業界解讀為國産計算産業向“安卓模式”開放的明确信号,旨在解決長期存在的算力資源割裂與協同難題。
同期發布的曙光AI超集群系統,單機櫃支持96加速卡、百P級AI算力,最大可實現百萬卡大規模擴展。這套系統已在于9月15日啟動的國家網絡安全宣傳周天津地區活動中亮相,展示其在網絡安全智能化升級方面的應用潛力。
産業困境
國内AI算力領域長期面臨高端算力供給不足、國産加速卡性能差距大、算力成本高、自主軟硬件生态不成熟等嚴峻問題。
各廠商技術自成體系、難以高效聯動,不同廠商的服務器、芯片、存儲與網絡設備大多采用私有接口與協議,導緻算力資源被分割在一個個“孤島”上。
這種技術路線上的不兼容,造成了大量的資源浪費和協同内耗。用戶需要花費大量精力“重複造輪子”,寶貴的算力資源無法高效協同,整體上難以形成與外部成熟生态相抗衡的合力。
架構突破
AI計算開放架構是面向大規模智能計算場景,以GPU為核心進行高效緊耦合系統設計的協同創新體系。
該架構從“算、存、網、電、冷、管、軟”單點突破走向集群創新,促進算力普惠。
中科曙光首批開放了AI存儲優化能力、液冷基礎設施設計規範、DeepAI基礎軟件棧等三項技術能力,降低中小企業研發門檻。
這套架構開放了五個層面的技術能力:部件級、系統層、基礎設施層、軟件層和數據集層。
超集群系統
基于AI計算開放架構設計的曙光AI超集群系統擁有“超高性能、超高效率、超高可靠、全面開放”四大特征。
該系統可支持多品牌加速卡,并兼容CUDA等行業主流的軟件生态,這意味着用戶不必再被單一的技術路線綁定。
曙光AI超集群系統具備121項設備和鍊路RAS可靠性設計,能夠将平均無故障時間提升2.1倍,平均故障修複時間降低47%。
該系統支持超30天長穩運行,并實現百萬級部件故障自動分析與秒級隔離,全面保障智能安全系統的不間斷穩定運行。
性能表現
在AI計算開放架構發布前,中科曙光于8月18日推出了國内首個行業标準化超智融合算力平台——Nebula800。
該平台專攻智能制造、生命科學、石油勘探、新材料等領域AI4S複雜計算任務場景,以一套系統打通超算、智算技術與生态壁壘。
Nebula800一平台支持多精度、混精度計算,破解非融合系統計算精度不全、應用普适性差、異構資源管理調度困難等問題,填補了國内相關産品空白。
免責聲明:本文僅代表作者個人觀點,與每日科技網無關。其原創性以及文中陳述文字和内容未經本站證實,對本文以及其中全部或者部分内容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關内容。
本網站有部分内容均轉載自其它媒體,轉載目的在于傳遞更多信息,并不代表本網贊同其觀點和對其真實性負責,若因作品内容、知識産權、版權和其他問題,請及時提供相關證明等材料并與我們聯系,本網站将在規定時間内給予删除等相關處理.


