近日,上海人工智能實驗室(簡稱“上海AI實驗室”)正式推出DeepLink多元算力混合推理加速方案,成功實現華為昇騰、沐曦等多款國産GPU的混合調度與協同推理,破解了國産GPU生态割裂、難以形成算力合力的行業痛點,實測性能表現亮眼。
據悉,該方案基于統一推理中間件、低時延通信等四大原創技術底座,搭配預填充-解碼分離策略,有效打通了不同架構國産GPU的異構算力壁壘,實現了多品牌芯片的高效協同。千卡規模推理集群實測數據顯示,與單一芯片方案相比,該混合調度方案在多模态生成、高并發智能服務等場景,推理時延最大優化34.5%;在科學論文處理等任務中,推理吞吐提升32%,真正實現異構算力“1+1>2”的效能躍升。
作為上海AI實驗室打造的人工智能開放計算體系,DeepLink方案并非簡單的硬件堆疊,其核心優勢在于通過标準化技術打破軟硬件壁壘。其中,高速通信庫可實現跨架構設備高速互聯,核心場景帶寬利用率突破97%;策略求解器能自動匹配最優調度策略,兼顧性能與成本,助力企業節省30%以上算力成本。
此次方案不僅實現華為、沐曦等GPU的協同,還兼容阿裡平頭哥、壁仞等多款國産芯片,已适配InternLM、Qwen等主流大模型,可靈活組合算力與顯存型芯片,盤活存量算力資源。這一突破标志着國産算力從“單打獨鬥”進入“聯合作戰”的關鍵階段,為構建開放融通的國産算力生态提供了可行路徑。
目前,DeepLink方案已在MinerU文檔解析工具等場景驗證落地,未來将進一步拓展應用邊界,聯合産業鍊夥伴共建算力生态,推動國産算力在制造、政務等領域規模化應用,為“中國腦+中國芯”全棧自主閉環注入強勁動力。
免責聲明:本文僅代表作者個人觀點,與每日科技網無關。其原創性以及文中陳述文字和内容未經本站證實,對本文以及其中全部或者部分内容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關内容。
本網站有部分内容均轉載自其它媒體,轉載目的在于傳遞更多信息,并不代表本網贊同其觀點和對其真實性負責,若因作品内容、知識産權、版權和其他問題,請及時提供相關證明等材料并與我們聯系,本網站将在規定時間内給予删除等相關處理.



