近日,國際權威AI基準評測組織MLPerf公布AI推理(Inference)V2.1榜單,包括21家世界主流芯片、系統廠商、雲廠商參與本次評測,共提交超過5300項結果。在激烈的角逐中,紫光股份旗下新華三集團服務器表現優異,繼今年6月在MLPerfAI訓練(Training)榜單中斬獲25項第一後,本輪一舉奪得數據中心場景任務(Datacenter)和邊緣場景任務(Edge)61項世界第一,體現了新華三在人工智能領域深厚的技術積澱和實力。

MLPerf由圖靈獎得主大衛帕特森(DavidPatterson)聯合斯坦福、哈佛大學等學術機構發起成立,是全球影響力最廣的AI性能基準評測。其評測任務與AI領域的前沿應用緊密結合,覆蓋當下主流AI應用場景,例如BERT(自然語言處理)、DLRM(推薦)、ResNet(圖像分類)、3D UNet(醫學圖像分割)等,行業用戶可根據評測結果了解廠商在AI領域的真正實力,為AI技術的發展和落地提供極大的應用參考價值。
數據中心場景推理任務:34項世界第一
本輪MLPerf評測,數據中心固定任務分為6個模型,16個測試項,面向多場景對各計算系統進行測試。例如3D UNet(醫學圖像分割)、RetinaNet(目标檢測)和ResNet50(圖像分類)測試,重點應用于醫學圖像分析、自動駕駛、工業質檢等場景,是數據中心的典型應用領域,也是MLPerf競争最為激烈的主戰場。新華三集團AI服務器憑借的AI系統設計和全棧優化能力,一舉拿下數據中心場景測試34項評測任務世界性能,以及1項配置第一。
在3DUNet模型任務中,R5300 G5在99.9%精度要求下,每秒能處理13.04張3D醫療影像的分割,平均隻需十幾秒就可以輔助醫生完成病竈分析
在ResNet50模型任務中,R5500 G5每秒可對314368張圖片進行分類,讓以圖搜圖的等待不再漫長
在RetinaNet模型任務中,R5500 G5每秒可完成對4657.04張圖片中的目标進行識别,讓交通肇事或生産質量缺陷無處遁形
H3C UniServer R5300 G5作為“推理+訓練”的全能型選手,共取得25項同配置第一,實力诠釋了其對于大規模、多元化、高複雜度AI場景的支撐能力,可提供1:8、1:4、1:2等多種拓撲配置,靈活适應不同人工智能場景的需求。同時,單機支持8塊雙寬GPU或20塊單寬GPU計算加速卡,相當于40台傳統服務器的運算速度,全面加速人工智能及深度學習等大規模計算應用場景的運算效率。
邊緣場景推理賽道:27項世界第一
在邊緣推理賽道,H3C UniServer R5500 G5、R5300 G5、R4900 G5三款AI服務器同樣表現出色,在邊緣固定任務中共斬獲27項世界第一,其中3項配置第一。R5500 G5在本輪推理評測中拿下19項同配置第一,彰顯了其在邊緣推理場景下的強大競争力。
R5500 G5針對Transformer架構模型進行優化,為機器視覺、自然語言處理等多種AI業務提供強大支持,在單線程模式下BERT推理時延僅為1.53毫秒。同時,R5500 G5支持全新的多實例GPU特性,可将單顆GPU分割成7個GPU實例,每個GPU實例運行不同應用,極大地提升了GPU的資源利用率,滿足業務快速部署的需求。
數字化時代,以人工智能技術加速業務創新已成為行業共識。作為數字化解決方案,未來,新華三集團将繼續深耕人工智能領域,依托“雲智原生”戰略和數字大腦的全棧實力,讓内生智能的智慧計算持續賦能百行百業數字化轉型,為數字經濟的發展注入源源不斷的智慧動力。
免責聲明:本文僅代表作者個人觀點,與每日科技網無關。其原創性以及文中陳述文字和内容未經本站證實,對本文以及其中全部或者部分内容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關内容。
本網站有部分内容均轉載自其它媒體,轉載目的在于傳遞更多信息,并不代表本網贊同其觀點和對其真實性負責,若因作品内容、知識産權、版權和其他問題,請及時提供相關證明等材料并與我們聯系,本網站将在規定時間内給予删除等相關處理.

