AMD正式宣布收購AI芯片初創公司Taalas,進一步強化其在AI推理領域的戰略布局。
Taalas成立于2023年,總部位于加拿大多倫多,其核心技術路線與主流GPU、Groq LPU及Cerebras晶圓級加速器等數據流架構存在本質區别。
該公司并非依賴傳統的高帶寬内存(HBM)存儲模型權重,而是将權重直接蝕刻進矽片之中,形成模型專用集成電路。
芯片主要由兩個功能區域構成:用于存儲模型權重的掩膜ROM召回結構,以及用于存放KV緩存和微調适配器的SRAM召回結構。這一方案有望将推理性能提升一個數量級甚至更多。
今年2月,Taalas發布了首款測試芯片HC1,采用台積電6納米工藝制造。初步基準測試顯示,該芯片運行Meta Llama 3.1 8B模型時,速度達每秒16,960個token——這一成績在當時約為英偉達GPU的48倍、Cerebras加速器的8.5倍。
盡管Llama 3.1以當前标準已非最新模型,但該光罩尺寸芯片的主要目的在于驗證技術概念的可性行。
Taalas計劃于今年夏季推出第二代HC2芯片,目标将單芯片支持的參數量提升至200億。雖然這一數值本身并不算龐大,但通過類似GPU的流水線并行方式,權重可分布在多顆加速器上協同運行。
以單芯片200億參數計算,僅需50顆加速器即可支撐萬億參數級别的大模型,而AMD擁有機架級計算平台與内部系統設計團隊,足以承接這一需求。
作為對比,英偉達近期發布的LPX系統在運行同等規模模型時,需數十顆GPU與至少2000顆Groq LPU配合,Taalas方案在空間占用與功耗效率方面具備顯著優勢。
據知情人士透露,AMD計劃将Taalas技術芯片與Instinct系列的Helios機架配對使用,構建分離式架構:計算密集型的提示詞處理由GPU負責,token生成任務則卸載至Taalas加速器。
另一種部署模式為,客戶先在Instinct加速器上部署和驗證模型,待效果确認後再遷移至Taalas加速器,形成類似“tick-tock”的疊代節奏。
此前,AMD在AI領域持續加碼并購:2024年以6.65億美元收購AI模型開發商Silo AI,随後以49億美元收購服務器廠商ZT Systems,為Helios機櫃産品線奠定基礎;此外,公司還收購了包括推理軟件開發商MK1在内的多家AI初創企業,加速完善其AI全棧生态。

免責聲明:本文僅代表作者個人觀點,與每日科技網無關。其原創性以及文中陳述文字和内容未經本站證實,對本文以及其中全部或者部分内容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關内容。
本網站有部分内容均轉載自其它媒體,轉載目的在于傳遞更多信息,并不代表本網贊同其觀點和對其真實性負責,若因作品内容、知識産權、版權和其他問題,請及時提供相關證明等材料并與我們聯系,本網站将在規定時間内給予删除等相關處理.



