← 所有主題

GPU

此主題的繁體中文文章,最新優先。

45 篇文章
繁體中文

2026

40 篇文章

  1. AI Infrastructure

    Megakernel 不是炫技:把 decode 從「等 kernel」改成「等資料」的實作取捨

    Cohere 用單一 CUDA 檔把 North Mini Code 的 decode 做成 persistent megakernel,batch size 1 吞吐從 vLLM 的 185 tok/s 拉到 292 tok/s。

    閱讀文章 ↗

  2. AWS

    在 SageMaker HyperPod 上部署 Qwen3.8-2.4T-A95B:單節點跑 2.4T 開源模型的實戰配置

    AWS 示範如何在單一 p6-b300 節點上用 NVFP4 量化與 vLLM 部署 2.4T 參數的 Qwen3.8,省下多節點成本。

    閱讀文章 ↗

  3. GPU

    蘋果 M6 與 M5 Ultra 登場:2nm 與四晶粒推向端側 AI

    蘋果於 8 月 25 日發表首款 2nm 晶片 M6 與首款四晶粒架構的 M5 Ultra,Mac mini 與 Mac Studio 同步更新,最高 512GB 統一記憶體讓數千億參數模型能在桌面本機執行。

    閱讀文章 ↗

  4. AI Infrastructure

    Cerebras CS-4 登場:三片 Turbo 晶圓的機架級推理系統

    Cerebras 於 8 月 19 日發表 CS-4 機架級系統與 WSE-3T 晶圓:不做新矽,把同一片晶圓灌兩倍功率,宣稱推理比 GPU 快 30 倍,並把提示詞處理交給 AWS 與 AMD 加速器分擔。

    閱讀文章 ↗

  5. AI Infrastructure

    記憶體一年漲五倍:AI 資料中心把 DRAM 吃光了

    PCPartPicker 數據顯示 DDR5 均價一年上漲約 500%,128GB 套裝從 329 美元漲到 3,399 美元;HBM 排擠標準 DRAM 產能、雲端巨頭用預付款圈走 2027 年貨源,新產能卻要 2028 年後才落地。

    閱讀文章 ↗

  6. NVIDIA

    Nvidia 縮手:OpenAI 資料中心貸款擔保從 2,500 億美元砍至 1,200 億以下

    《華爾街日報》報導 Nvidia 縮減 OpenAI 資料中心債務擔保,初期將低於 1,200 億美元,遠低於 7 月談及的 2,500 億美元;交易僅有備忘錄,縮水被視為對股東的訊號,循環融資疑慮浮上檯面。

    閱讀文章 ↗

  7. AI Infrastructure

    RAMageddon 延燒:傳 DRAM 與 HBM 2027 年產能已被採購一空

    DIGITIMES 報導經 TweakTown 披露:三星、SK 海力士與美光的 DRAM 與 HBM 產能,據傳已被五年期長約包到 2027 年;AI 是最大買家,消費端 SSD 與 RAM 價格持續攀升。

    閱讀文章 ↗

  8. AI Infrastructure

    AMD 收購 Taalas:把模型權重直接蝕刻進晶片

    2026 年 8 月 6 日 AMD 宣布收購多倫多新創 Taalas:以權重蝕刻加 SRAM 快取的專用推理晶片路線,HC1 已在 Llama 3.1 8B 跑出每秒近 1.7 萬 token。

    閱讀文章 ↗

  9. NVIDIA

    NVIDIA 投資 SSI:封閉兩年的實驗室,換來一個量級的算力

    NVIDIA 於 7 月 27 日宣布投資 Ilya Sutskever 的 Safe Superintelligence 並達成長期策略合作,SSI 取得 Vera Rubin 平台存取權、算力擴大一個數量級,代價是讓 NVIDIA 罕見地看見其內部研究。

    閱讀文章 ↗

  10. SpaceXAI

    Google 揭露94.1億美元SpaceX持股,賺了超過百倍

    Alphabet 在 2026 年 7 月 23 日提交的 Q2 10-Q 中揭露:持有約 6% SpaceX 股權,價值 941 億美元,相對 2015 年投入的 9 億美元成長逾百倍。本文整理持倉細節、分階段解禁安排,以及 Google 同時身為 SpaceX 股東與算力客戶的雙重關係。

    閱讀文章 ↗

  11. Gemini

    Google 新晶片 Frozen v2 曝光:為 Gemini 而生、能效目標十倍

    The Information 報導 Google 正開發內部代號 Frozen v2 的伺服器晶片,為 Gemini 模型打造,目標 2028 年推出、能效較現有晶片提升六到十倍。

    閱讀文章 ↗

  12. Anthropic

    Anthropic 洽談三星代工自研晶片:多源算力的第四條線

    The Information 報導 Anthropic 正與三星洽談代工自研 AI 晶片,用途與規格皆未定;在 Google TPU、Amazon Trainium 與 Nvidia GPU 之外,多源硬體策略可能再添一條自己的供應線。

    閱讀文章 ↗

  13. AI Infrastructure

    Etched 走出隱身:10 億美元訂單與台積電量產的推理晶片

    AI 晶片新創 Etched 宣布走出隱身:手上握有 10 億美元合約訂單,首款晶片已由台積電成功量產,Frontier 推理叢集進入客戶測試,成為挑戰 Nvidia 的最新獨立勢力。

    閱讀文章 ↗

  14. OpenAI

    OpenAI 首顆自研推理晶片 Jalapeño 登場:九個月設計到量產,宣稱勝過 GB300

    2026 年 6 月 24 日,OpenAI 與 Broadcom 發表首顆自研 LLM 推理晶片 Jalapeño,約九個月完成設計到量產,兩家公司並宣稱在關鍵推理基準擊敗 NVIDIA GB300。本文解析自研晶片對推理成本與算力供應的意義。

    閱讀文章 ↗

  15. AWS

    Amazon 擬對外出售 Trainium 晶片,劍指 NVIDIA

    Bloomberg 報導,Amazon AI 主管 Peter DeSantis 證實 AWS 正與潛在買家洽談對外出售 Trainium 晶片;執行長 Andy Jassy 估算晶片事業獨立運作的年營收可達約 500 億美元,直接挑戰 NVIDIA 在資料中心 AI 晶片市場的主導地位。

    閱讀文章 ↗

  16. AI Infrastructure

    Google 每月付 SpaceX 9.2 億美元租算力:IPO 前的橋接合約

    2026 年 6 月 5 日 SpaceX 在 SEC 文件披露:Google 將月付 9.2 億美元、租用約 11 萬顆 NVIDIA GPU,期間為 2026 年 10 月至 2029 年 6 月,作為 Gemini Enterprise 需求超預期的橋接產能,也是 SpaceX 上市前一週的最新算力大單。

    閱讀文章 ↗

  17. AI Infrastructure

    XCENA 融資 1.35 億美元:賭 AI 瓶頸不在算力而在記憶體

    韓國晶片新創 XCENA 以 5.7 億美元估值完成 1.35 億美元 B 輪。其 MX1 晶片把數千顆 RISC-V 核心放到 DRAM 旁,在記憶體模組內管理 KV cache,號稱十台伺服器的工作一台就能做完,2026 年底由三星 4 奈米製程量產。

    閱讀文章 ↗

  18. NVIDIA

    黃仁勳宣稱 Vera CPU 打開 2,000 億美元新市場:agent 晶片戰開打

    NVIDIA 財報會上黃仁勳宣稱為 agent AI 而生的 Vera CPU 打開 2,000 億美元全新市場,今年獨立銷售已達 200 億美元;在 AWS 自研晶片與 Meta 轉單之際,CPU 成為 AI 晶片戰的新前線。

    閱讀文章 ↗

  19. AI Infrastructure

    AMD Q1 2026 財報:資料中心營收年增 57%,伺服器 CPU 市場預測翻倍

    AMD 公布 2026 年第一季財報:資料中心營收 58 億美元、年增 57%,總營收 102.5 億美元。蘇姿豐將伺服器 CPU 市場年增率預測從 18% 上調至 35%、2030 年超過 1,200 億美元。本文拆解財報數字、MI450 與 Helios 時程,以及 agentic AI 帶動的 CPU 需求。

    閱讀文章 ↗

  20. AI Infrastructure

    Cerebras IPO 定價出爐:35 億美元募資、瞄準 266 億美元市值

    2026 年 5 月 4 日,Cerebras 啟動 IPO 定價:釋出 2,800 萬股、每股 115 至 125 美元,高點估募 35 億美元、市值達 266 億美元,可望成為 2026 年迄今最大科技 IPO;Bloomberg 報導承銷訂單已湧入 100 億美元。

    閱讀文章 ↗

  21. GPU

    Cerebras 重新送件 IPO:5.1 億美元營收與 OpenAI 百億大單

    AI 晶片公司 Cerebras 於 2026 年 4 月向 SEC 送件申請 IPO,計畫五月中掛牌。文件顯示 2025 年營收 5.1 億美元,加上 OpenAI 超過百億美元的運算訂單與 AWS 合作,這是它兩年內第二次挑戰公開市場。

    閱讀文章 ↗

  22. AI Infrastructure

    Amazon 自研晶片年營收破 200 億美元:Jassy 股東信的算力藍圖

    2026 年 4 月 9 日 Jassy 年度股東信揭露:Graviton、Trainium 與 Nitro 年營收突破 200 億美元、年增三位數百分比,獨立計價約 500 億美元,並首度鬆口未來可能把機櫃賣給第三方。

    閱讀文章 ↗

  23. AI Infrastructure

    GPU 變成放貸標的:Forum Markets 切入 AI 晶片過橋融資

    2026 年 4 月 8 日,Forum Markets 宣布以 60 至 120 天過橋貸款資助 Neocloud 業者採購 NVIDIA GPU,首筆承諾 2,500 萬至 5,000 萬美元、目標年化報酬中雙位數,並計畫把貸款代幣化。

    閱讀文章 ↗

  24. AI Infrastructure

    韓國國家基金投資 Rebellions 1.66 億美元,啟動「K-Nvidia」晶片計畫

    2026 年 3 月 26 日,韓國金融委員會批准透過國家成長基金直接投資 AI 晶片新創 Rebellions 約 1.66 億美元,是「K-Nvidia」計畫首筆直接投資,用於 NPU 量產與次世代 AI 晶片開發。本文解析主權 AI 晶片競賽。

    閱讀文章 ↗

  25. Meta

    Meta 與 Nebius 簽五年 270 億美元協議:認購 Vera Rubin 世代產能

    2026 年 3 月 16 日,Nebius 宣布與 Meta 簽署五年協議:120 億美元專屬 AI 容量,最高再以 150 億美元認購未來叢集剩餘產能,總值約 270 億美元,建立於 NVIDIA Vera Rubin 平台,2027 年初開始交付,是 Neocloud 迄今最大合約之一。

    閱讀文章 ↗

  26. NVIDIA

    GTC 2026 開幕:Vera Rubin 七款晶片全量投產,訂單總額約一兆美元

    NVIDIA 執行長黃仁勳在 GTC 2026 主題演講發表 Vera Rubin 平台,七款新晶片已全面量產;CNBC 報導 Blackwell 加 Vera Rubin 到 2027 年的合計訂單約 1 兆美元。本文解析這場演講對算力供應鏈與採購規劃的意義。

    閱讀文章 ↗

  27. AI Infrastructure

    Tesla Terafab 倒數七天:Musk 押上 200 億美元的自建 AI 晶圓廠

    2026 年 3 月 14 日,Musk 宣布 Terafab Project 七天後啟動。這座造價約 200 億美元、瞄準 2nm 製程的 AI 晶圓廠,目標月產十萬片晶圓,為 FSD 與 Optimus 供應 AI5 晶片。本文解析一家車廠跳進半導體最前沿的垂直整合豪賭。

    閱讀文章 ↗

  28. Meta

    Meta 四款自研 MTIA 晶片登場:兩年四代的矽節奏

    2026 年 3 月 11 日,Meta 發表 MTIA 300、400、450、500 四款自研 AI 晶片,數十萬顆已在生產環境運轉,並宣稱約每六個月推出新一代。本文解析逐代規格跳幅、chiplet 模組化設計,與 NVIDIA、Broadcom 之間的分層算力佈局。

    閱讀文章 ↗

  29. AI Infrastructure

    Ayar Labs 募得 5 億美元 Series E:用共封裝光學打通 AI 叢集的銅線天花板

    2026 年 3 月 3 日,光互連公司 Ayar Labs 宣布 5 億美元 Series E,投後估值 37.5 億美元,NVIDIA 與 AMD 續投。執行長 Mark Wade 直指 AI 基礎設施正撞上互連效率造成的電力高牆,本文解析 CPO 共封裝光學如何讓數千顆 GPU 如同一台機器運作。

    閱讀文章 ↗

  30. Meta

    Meta 向 Google 租 TPU:自建雲巨頭回頭當對手的客戶

    2026 年 2 月 26 日,路透社報導 Meta 簽下數十億美元多年期協議,租用 Google Cloud TPU 訓練下一代模型,並洽談購買數百萬顆 TPU 自行部署。本文解析交易動機與對 Nvidia 的衝擊。

    閱讀文章 ↗

  31. NVIDIA

    NVIDIA FY2026 Q4 財報:單季營收 681 億美元創紀錄,全年 2,159 億美元

    2026 年 2 月 25 日,NVIDIA 公布 FY2026 第四季財報:單季營收 681 億美元創新高、季增 20%,淨利 430 億美元;全年營收 2,159 億美元、年增 65%。本文拆解數字背後的訊號,以及對採購與產品團隊的意義。

    閱讀文章 ↗

  32. Meta

    Meta 向 NVIDIA 鎖定數百萬顆 Blackwell:供給先被大單吃掉

    Meta 與 NVIDIA 簽長期協議、鎖定數百萬顆 Blackwell GPU:訓練算力天花板大幅拉高,百萬顆級的排程與容錯成為新工程關卡,供給被大單提前佔用後,其他買家取得算力更貴也更慢。

    閱讀文章 ↗

  33. AI Infrastructure

    Cerebras 完成 10 億美元 Series H 融資:晶圓級推論的 230 億美元賭注

    2026 年 2 月,Cerebras 完成 10 億美元 Series H 輪融資,投後估值約 230 億美元,Tiger Global 領投、AMD 與 Benchmark 等跟投。本文解析晶圓級引擎的技術賭注、OpenAI 大單後的資本驗證,以及推論市場的多供應商格局。

    閱讀文章 ↗

  34. AI Infrastructure

    Microsoft Maia 200 登場:FP4 破 10 petaFLOPS 的自研推理晶片

    2026 年 1 月 26 日,Microsoft 發表第二代自研 AI 加速器 Maia 200:FP4 算力超過 10 petaFLOPS、1,400 億顆以上電晶體、750W 封裝,宣稱 FP4 效能為 Amazon Trainium3 的三倍。本文解析規格對比與自研矽的成本帳。

    閱讀文章 ↗

  35. AI Infrastructure

    台積電 Q4 獲利創新高,2026 資本支出上看 560 億美元

    台積電 1 月 15 日公布 2025 年第四季財報:單季營收首破 1 兆新台幣、淨利年增 35% 創新高,2 奈米開始量產,2026 年資本支出指引 520–560 億美元。本文拆解數字背後的 AI 需求訊號、記憶體短缺與美國擴產的拉扯。

    閱讀文章 ↗

  36. OpenAI

    OpenAI 與 Cerebras 簽逾 100 億美元協議:750 MW 晶圓級算力直攻低延遲推論

    2026 年 1 月 14 日,OpenAI 與 Cerebras 簽署多年協議:到 2028 年部署最多 750 MW 晶圓級算力,CNBC 報導交易價值超過 100 億美元,全部用於低延遲推論。本文解析條款細節、Cerebras 對 G42 的營收依賴,以及 OpenAI 的多供應商算力佈局。

    閱讀文章 ↗

  37. AI Infrastructure

    Etched 募得 5 億美元:用 transformer 專用晶片挑戰 NVIDIA

    2026 年 1 月 13 日,Bloomberg 報導 AI 晶片新創 Etched 募得約 5 億美元,由 Stripes 領投、估值約 50 億美元。其 Sohu 晶片採 TSMC 4nm 製程,是專為 transformer 模型設計的 ASIC,直接挑戰 NVIDIA 的通用 GPU。

    閱讀文章 ↗

  38. OpenAI

    OpenAI 與 SoftBank 合投 SB Energy 10 億美元,簽下 1.2 GW Stargate 租約

    2026 年 1 月 9 日前後,OpenAI 與 SoftBank 各投資 5 億美元於 SB Energy,合計 10 億美元,並伴隨 1.2 GW 的 Stargate 資料中心租約。本文解析算力與電力深度綁定的最新階段。

    閱讀文章 ↗

  39. AI

    Intel CES 2026 發表 Core Ultra Series 3:18A 製程上機的 AI PC 首役

    Intel 在 CES 2026 發表 Core Ultra Series 3(Panther Lake):首款運算晶片採用 18A 製程的 AI PC 平台,搭配 Arc B390 內顯與 200 款以上筆電設計,1 月 27 日全球開賣。本文解析規格、時程與對邊緣 AI 佈局的意義。

    閱讀文章 ↗

  40. AI Infrastructure

    AMD CES 2026 開局:Helios 機架、MI455X 與 AI Everywhere 全線推進

    2026 年 1 月 5 日,AMD 執行長蘇姿豐在 CES 發表「AI Everywhere」主題演講:每機架 3 AI exaflops 的 Helios 平台、MI455X 與 MI440X GPU,加上 60 TOPS 的 Ryzen AI 400 系列。本文解析 AMD 從資料中心到終端的完整算力佈局。

    閱讀文章 ↗

2025

5 篇文章

  1. AI Infrastructure

    HBM 行情發酵:美光、SK 海力士股價齊揚

    2025年6月26日記憶體行情延燒:美光財報後股價走揚,SK 海力士市值創下約1,570億美元新高;AI 伺服器帶動 HBM 需求,兩大記憶體巨頭同步改寫市場對記憶體股的評價。

    閱讀文章 ↗

  2. AI Infrastructure

    美光財報:HBM 年內售罄,單季營收創新高

    2025年6月25日美光公布會計年度第三季財報,單季營收93億美元創新高,HBM 收入季增近五成;執行長梅羅特拉表示 HBM 2025 年產能已全數售罄,第四季營收指引107億美元也高於市場預期。

    閱讀文章 ↗

  3. AI

    黃仁勳:輝達財測將排除中國市場,H20季度損失約80億美元

    2025年6月中,輝達執行長黃仁勳接受CNN專訪表示,因H20出口管制短期難解,公司財測將不再計入中國市場,第二季營收損失約80億美元;若政策反轉,對輝達而言只是額外紅利。

    閱讀文章 ↗

  4. GPU

    AMD 發表 MI350 系列:4 倍算力、35 倍推論

    2025 年 6 月 12 日,AMD 在 Advancing AI 活動發表 Instinct MI350 系列:288GB HBM3E、原生 FP4/FP6,宣稱對 MI300X 算力最高 4 倍、推論最高 35 倍;MI350X 與 MI355X 已量產出貨,並預告 2026 年 Helios 機架與 MI400。

    閱讀文章 ↗

  5. NVIDIA

    輝達 GTC 巴黎:歐洲 AI 算力兩年要拚十倍

    2025 年 6 月 11 日,黃仁勳在巴黎 VivaTech 的 GTC 主題演講宣布歐洲 AI 算力兩年內將成長十倍:Mistral 首階段部署 18,000 套 Grace Blackwell 系統、德國打造全球首座工業 AI 雲端、英國首階段 14,000 顆 Blackwell GPU,各國主權 AI 部署合計超過 3,000 EFLOPS。

    閱讀文章 ↗