科技

Arm Everywhere China》手機AI代理時代來了!首款AI原生Mali GPU效能增4倍,C2 CPU讓小語言模型加速70%

編輯部 12小時前 1 瀏覽
Arm Everywhere China》手機AI代理時代來了!首款AI原生Mali GPU效能增4倍,C2 CPU讓小語言模型加速70%
加入為 Google 偏好來源

將 Yahoo 設為首選來源,在 Google 上查看更多我們的精彩報導

Arm推出第二代行動裝置運算子系統(CSS for Mobile 2),專為代理式AI與行動圖像打造的全新AI原生運算平台。(Arm提供)

生成式AI正從回應使用者提示,走向能持續理解情境、調度應用程式並代替使用者採取行動的代理式AI。Arm Holdings(NASDAQ:ARM,下稱Arm)今(8)日於「Arm Everywhere China」活動推出第二代行動裝置運算子系統CSS for Mobile 2,整合首款AI原生Mali GPU「Mali G2-Ultra NX」、C2-Ultra與C2-Pro CPU,以及兩組SME2單元。其中,Mali G2-Ultra NX神經圖像每瓦效能最高提升4倍,C2 CPU叢集則可讓最新小型語言模型速度提升70%。

Arm指出,隨著AI代理從單一功能走向持續運作,不只需要執行推論,也要維持上下文、啟動應用程式、協調模型與服務,並代表使用者執行任務,而這些工作都必須在智慧型手機有限的功耗與散熱條件下完成。因此,下一階段的手機AI能力不會只由單一NPU或加速器決定,而是需要CPU、GPU及系統IP共同協作。

Arm行銷長Ami Badani表示,代理式AI過去的討論多集中於資料中心,但考量Token成本、資料隱私及網路延遲,不是所有AI互動都適合送回雲端處理。未來仍會有大型模型及多組AI代理在雲端運作,但愈來愈多代理將直接在邊緣裝置執行,使AI從偶爾回應提示,轉向預測使用者需求並提供持續協助。

Arm邊緣AI事業執行副總裁Chris Bergey表示,「AI正徹底重新定義圖像」,過去圖像技術主要透過提高渲染精細度、場景複雜度及光照品質持續進步,如今AI已開始直接成為圖形處理管線的一部分。

Arm歷年累計出貨的Mali GPU已超過140億顆。此次推出的Mali G2-Ultra NX,是首款搭載專用神經網路加速器的Mali GPU,將神經運算直接整合至GPU著色器核心,讓AI與傳統圖形工作負載在相同管線中處理,降低資料往返及記憶體存取需求。

Mali G2-Ultra NX支援三項主要神經圖像功能。其中,Neural Super Sampling(NSS)可將540p畫面透過AI放大至1080p;Neural Frame Rate Upscaling(NFRU)可將30 FPS提高至60 FPS;Neural Super Sampling and Denoising(NSSD)則結合超級採樣、光線重建及降噪,改善光線追蹤畫面的雜訊。

Arm公布的測試數據顯示,Mali G2-Ultra NX神經圖像每瓦效能最高提升4倍,每秒畫面數最高也可提升4倍,DRAM資料流量則減少70%。相關神經圖像功能主要以約1瓦功耗範圍為設計目標,希望在行動裝置有限的功耗條件下提高解析度、畫面流暢度及光照品質。

Mali G2-Ultra NX也重新設計執行引擎,是Mali GPU七個世代以來幅度最大的指令集架構調整,並針對Unreal Engine 5的Nanite及Lumen功能進行設計;第三代光線追蹤單元則鎖定完整場景光照與陰影處理。

Arm邊緣AI客戶端運算副總裁James McNiven在會後Q&A表示,G2同時加入新的架構功能及微架構調整,在相同頻率下,既有遊戲內容效能較前一代最高提升14%,光線追蹤能力也在縮小晶片面積的情況下獲得強化。

為展示神經圖像技術,Arm與Sumo Digital共同開發《光影新生》(Neural Dawn)。遊戲引擎及遊戲業者也開始導入相關功能,包括Tencent Games Central Tech的MagicDawn,以及Unity China的團結引擎。

在實際遊戲方面,網易遊戲《燕雲十六聲》計畫於今年推出支援NSS的版本;騰訊遊戲《暗區突圍:無限》已用於NSSD技術展示,Infold Games的《無限暖暖》則進行NSS整合。Arm表示,搭載CSS for Mobile 2的新產品及相關遊戲內容,預計今年稍晚陸續推出。

Bergey說,過去行動遊戲開發者受限於手機效能與功耗,必須選擇性使用光線追蹤等進階技術;透過神經超級採樣及降噪,開發者可先以較低解析度渲染,再利用AI放大及重建畫面,在相同功耗範圍內提升效能與視覺品質。

CPU成為AI代理編排引擎 C2-Ultra同效能功耗降38%

除了GPU,代理式AI也讓CPU重新成為裝置端AI的核心。Arm指出,AI代理必須維持上下文、排程工作負載、呼叫應用程式,並協調GPU及其他加速器,CPU因而扮演整個運算系統的編排引擎。

新一代C2 CPU叢集結合強調效能的C2-Ultra、著重效率的C2-Pro,以及兩組SME2單元。相較C1-Ultra,C2-Ultra的AI效能最高提升1.7倍、單執行緒效能提升15%,相同效能下功耗最高降低38%;多執行緒效能提升12%,網頁瀏覽及應用程式啟動效能則分別提升15%及12%。

以AI代理協助使用者規劃並預訂週年晚餐為例,C2-Ultra可將工作流程縮短約280毫秒、速度提升15%;進一步運用SME2後,可縮短約450毫秒,速度提升24%。

McNiven補充,配置兩組SME2的C2 CPU叢集,典型算力約為5至7 TOPS。Mali G2-Ultra NX最少配置六組神經加速器,依GPU核心數與運作頻率不同,典型算力約10至20 TOPS,理論上可超過50 TOPS。

不過,他強調,行動裝置不能只比較TOPS,能否在1至2瓦功耗內持續提高解析度及影格率更為重要。CSS for Mobile 2的參考數據主要以台積電(2330)N2製程為基礎,但平台可依合作夥伴需求,移植至不同晶圓代工業者及製程節點。

更多風傳媒報導

城市學》草間彌生如何成為一座城市的座標?一顆南瓜如何改變直島,也讓世界理解藝術如何留下地方記憶

Arm Computex開講》Arm CEO預言:AI時代不只GPU,CPU將重新站上舞台中央

Arm Computex開講》伺服器CPU生態系100%在台打造 執行長:沒有台灣就沒有Arm

新聞來源: 原始來源

分享本文
請登入後發表評論
立即登入

尚無評論,成為第一個發言的人吧!

首頁 新聞 商家 活動 UTV AI 聊天