GPU

蘋果 M6 與 M5 Ultra 登場:2nm 與四晶粒推向端側 AI

蘋果於 8 月 25 日發表首款 2nm 晶片 M6 與首款四晶粒架構的 M5 Ultra,Mac mini 與 Mac Studio 同步更新,最高 512GB 統一記憶體讓數千億參數模型能在桌面本機執行。

蘋果 M6 與 M5 Ultra 登場:2nm 與四晶粒推向端側 AI — 文章封面

蘋果在 2026 年 8 月 25 日發表兩款新晶片:M6 與 M5 Ultra。M6 是蘋果第一顆採用 2nm 製程的晶片,隨新版 Mac mini 亮相;M5 Ultra 則是蘋果第一個四晶粒(quad-die)架構、也是自家史上最強的晶片,裝進新一代 Mac Studio。Mac Studio 即日開放預購,9 月 22 日起在 30 個國家與地區上市。兩款晶片的共同訊號很清楚:端側 AI 是下一輪硬體競賽的主戰場。

M6:第一顆 2nm

M6 採用 12 核心 CPU(2 超級、4 效能、6 節能核心),比 M5 多兩核,蘋果宣稱擁有全球最快的單執行緒效能,多執行緒比 M5 快最多 1.2 倍、比 M1 快 2.4 倍。GPU 同為 12 核心,每個核心都內建神經加速器;神經引擎是雙 16 核心設計,峰值 AI 運算量最高達前代的 2 倍,GPU 峰值 AI 運算量也比 M5 高近 30%。

記憶體配置針對入門與中階開發者:統一記憶體上限 32GB,頻寬 170GB/s——比 M5 高 10%,是 M1 的 2.5 倍。對要在筆電與小機殼上跑本地模型的人,這條頻寬數字比 CPU 核心數更值得看。

M5 Ultra:四顆晶粒,512GB 統一記憶體

M5 Ultra 把兩顆雙晶粒 M5 Max 用新一代 UltraFusion 封裝成四晶粒,晶粒間頻寬超過 4.4TB/s。CPU 最高 36 核心(12 超級、24 效能),單執行緒比 M3 Ultra 快 1.25 倍、多執行緒快 1.3 倍;GPU 最高 80 核心,每核都有神經加速器,峰值 GPU AI 運算量最高達 M3 Ultra 的 4.5 倍,繪圖快最多 40%。

真正有趣的是記憶體:最高 512GB 統一記憶體、頻寬 1.2TB/s(比 M3 Ultra 高 50%)。蘋果明說,這讓數千億參數的 LLM 能直接在桌上執行。價格方面,Mac Studio 的 M5 Ultra 版從 5,499 美元起,M5 Max(18 核心 CPU、最高 40 核心 GPU、128GB 記憶體、614GB/s 頻寬)從 2,499 美元起;512GB 記憶體配置十月下旬才到貨。

一台機器變成一個小叢集

Mac Studio 這代還藏了一個對 AI 工程師更實用的功能:透過 Thunderbolt 5 加 RDMA,可以把四台 Mac Studio 串成一個叢集,分散式 AI 推論最高加速 3 倍。加上 Thunderbolt 5 的 120Gb/s、首度支援的 Wi-Fi 7 與藍牙 6(蘋果自設計的 N1 晶片)、最多八台外接顯示器,以及媒體引擎的 AV1 硬解與 33 路 8K ProRes 轉碼,目標客群寫在規格表上——這是一台照著本地模型工作流設計的桌機,從大模型的提示處理、代理工作負載,到用 Core AI、Core ML、Metal 與 Xcode 在本機微調都算在內。

端側 AI 的現實檢查

蘋果把 AI 故事講得相當具體:更快的 LLM 提示處理、代理工作負載、本機跑模型甚至微調,搭配 macOS 27「Golden Gate」與擴充後的 Apple Intelligence,策略是讓「隱私、一次購斷、沒有 token 帳單」成為雲端 API 之外的另一條路。

現實檢查也要做。512GB 記憶體版本要等到十月下旬,5,499 美元起跳的價格不是入門玩具;「最高 4.3 倍 AI 效能」是相對前代的數字,峰值換算成實際的本地推理體驗,仍取決於框架與模型最佳化的腳步。但方向已經很明白——當旗艦桌機塞得下數千億參數的模型,「在本機跑大模型」就從展示品變成了可以下單的選項,這對雲端推論市場的長期壓力,比任何一場發表會的口號都實在。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

分享X電郵