
單token生成8.9毫秒,每百萬token成本跌破1元,AI産業化迎來算力成本革命。
9月26日,在2025人工智能計算大會上,浪潮信息公布兩項突破性進展:基于元腦SD200超節點AI服務器,DeepSeekR1大模型token生成速度僅需8.9毫秒,創造國内大模型最快token生成速度。
同時,最新發布的元腦HC1000超擴展AI服務器,實現每百萬token成本首次擊破1元。這兩項突破旨在解決智能體産業化面臨的交互速度和token成本兩大核心瓶頸。
速度突破
元腦SD200帶動國内AI服務器token生成速度率先進入“10毫秒時代”。這一突破得益于其創新的多主機低延遲内存語義通信架構。該架構在單機内實現了64路本土AI芯片的高速統一互連,單機可承載4萬億參數單體模型,或部署多個萬億參數模型組成的智能體應用。為實現極低的通信延遲,元腦SD200采用精簡高效的三層協議棧,原生支持多種内存語義操作,避免冗餘數據拷貝,将基礎通信延遲降至百納秒級。
成本革命
浪潮信息同步發布的元腦HC1000超擴展AI服務器,聚焦解決智能體産業化的另一個關鍵瓶頸——token成本。基于全新開發的全對稱DirectCom極速架構,元腦HC1000采用無損超擴展設計,聚合海量本土AI芯片、支持極大推理吞吐量。該服務器通過全面優化降本和軟硬協同增效,創新16卡計算模組設計、單卡“計算-顯存-互連”均衡設計,大幅降低單卡成本和每卡系統分攤成本。據測算,元腦HC1000通過算網深度協同、全域無損技術,實現推理性能相比傳統RoCE提升1.75倍,單卡模型算力利用率最高提升5.7倍。
産業前景
智能體産業化的核心三要素是能力、速度和成本。其中模型能力決定了智能體的應用上限,交互速度決定了智能體的商業價值,token成本決定了智能體的盈利能力。浪潮信息對AI計算架構的持續創新,旨在為多智能體協同與複雜任務推理的規模化落地,提供高速度、低成本的算力基礎設施。未來,智能體帶來的推理算力需求将呈現出指數級的爆發式增長。
算力成本壁壘的打破,為人工智能技術在千行百業的深度融合鋪平了道路。智能體産業化不再受限于響應速度和運營成本,AI技術轉化為生産力和創新力的步伐正在加速。
免責聲明:本文僅代表作者個人觀點,與每日科技網無關。其原創性以及文中陳述文字和内容未經本站證實,對本文以及其中全部或者部分内容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關内容。
本網站有部分内容均轉載自其它媒體,轉載目的在于傳遞更多信息,并不代表本網贊同其觀點和對其真實性負責,若因作品内容、知識産權、版權和其他問題,請及時提供相關證明等材料并與我們聯系,本網站将在規定時間内給予删除等相關處理.


