
7 月 11 日消息,Arm 公司于 7 月 10 日發布博文稱,為滿足未來生成式 AI 的需求、擴展更多先進智能功能,推出了可加速 AI 工作負載的可擴展矩陣擴展 2(SME2)技術,開發者無需修改代碼,即可将其集成至現有模型和應用中。
該公司指出,移動設備上的生成式 AI 應用已不再局限于傳統的聊天機器人和虛拟助手,正逐漸拓展到生成文本、聲音、圖像和視頻,執行數學推理及群聊摘要等諸多高級智能功能。
SME 最初出現于 Armv9 架構中,是一組可選的高級 CPU 架構擴展,專門用于加速矩陣數學運算。SME2 于 2022 年底首次亮相,在 SME 基礎上增加了新功能,據 Arm 介紹,它能實現實時的移動端推理任務,涵蓋生成圖片、自然語言處理任務等。
Arm 分享的數據顯示,SME2 表現可靠:Google 的 Gemma 3 模型在 SME2 增強的硬件上,運行速度比無 SME2 的硬件快 6 倍;其可在單個 CPU 核心上不到一秒鐘内完成 800 字的文本摘要(Arm 未明确此處所指 CPU 型号)。
對消費者而言,公告的關鍵信息是未來安卓手機将具備 SME2 硬件能力。此前,SME 主要應用于服務器和工作站級處理器,因其要求較高;而 SME2 設計得更具可擴展性,可部署在筆記本電腦、平闆電腦及高端智能手機上。
重要的是,安卓已做好支持 SME2 的準備,該技術在 Google 的 XNNPACK 庫中啟用,并支持 llama.cpp、阿裡巴巴的 MNN 和微軟的 ONNX 等框架。
免責聲明:本文僅代表作者個人觀點,與每日科技網無關。其原創性以及文中陳述文字和内容未經本站證實,對本文以及其中全部或者部分内容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關内容。
本網站有部分内容均轉載自其它媒體,轉載目的在于傳遞更多信息,并不代表本網贊同其觀點和對其真實性負責,若因作品内容、知識産權、版權和其他問題,請及時提供相關證明等材料并與我們聯系,本網站将在規定時間内給予删除等相關處理.

