← 所有主題

Machine Learning

此主題的繁體中文文章,最新優先。

48 篇文章
繁體中文

2026

45 篇文章

  1. Cloudflare

    當掃描器看不見攻擊:Cloudflare 用 ML 拆解店面前的惡意 JavaScript

    Cloudflare 的 Page Shield ML 在真實流量中攔下八個惡意 payload,而 VirusTotal 與 URLScan 幾乎全部漏判。

    閱讀文章 ↗

  2. AWS

    把商品標籤交給小模型:SageMaker serverless 客製化的取捨

    AWS 示範用 SageMaker serverless 客製化 Qwen3-8B 做商品標籤,重點在把訓練與推論的責任拆開。

    閱讀文章 ↗

  3. AI for Science

    把兩階段訓練拿掉之後:SimpleDesign 對蛋白質設計流程的意義

    Apple 的 SimpleDesign 直接在資料空間訓練序列與結構共同設計模型,挑戰先訓練 autoencoder 的兩階段慣例。

    閱讀文章 ↗

  4. AI Infrastructure

    Hot Chips 2026:三星把 AI 運算塞進記憶體

    Hot Chips 2026 記憶體議程焦點:三星發表全球首款 LPDDR 型 PIM 解決方案 LPDDR5X-PIM,16 個 bank 內嵌 MAC 單元,內部頻寬 614 GB/s 為外部存取的八倍,但軟體隔離與不可快取存取仍是採用門檻。

    閱讀文章 ↗

  5. NVIDIA

    NVIDIA 發表 Jetson Orin Nano 2:入門邊緣 AI 算力翻倍,機器人與無人機受惠

    2026 年 8 月 25 日,NVIDIA 發表 Jetson Orin Nano 2 機器人運算系統,將入門級邊緣 AI 算力約提升一倍,鎖定機器人與無人機應用。本文解析邊緣推理的實際意義與對開發者生態的影響。

    閱讀文章 ↗

  6. Qwen

    Qwen3.8-Flash-Next 發表:新架構把啟用參數壓到 6B

    2026 年 8 月 26 日,Qwen 開源 Qwen3.8-Flash-Next:125B 主模型加 51B n-gram 嵌入表,每個 token 只啟用 6B 參數,原生 262K 上下文,官方定位是極致成本效率。

    閱讀文章 ↗

  7. AI

    史丹佛礦坑金絲雀:AI 就業衝擊集中在入門級白領

    史丹佛 Digital Economy Lab 修訂版研究:ADP 薪資資料追蹤至 2026 年 6 月,AI 曝露度最高職業的 22 至 25 歲工作者就業比對照基準低 19%,衝擊主要來自招聘縮減而非資遣,且缺口持續擴大。

    閱讀文章 ↗

  8. AI

    DARPA 與美國空軍讓 F-16 全 AI 控制飛行:VENOM 計畫的自主里程碑

    2026 年 8 月 4 日,DARPA 與美國空軍在 Eglin 空軍基地完成 F-16 全 AI 控制飛行,安全飛行員採 human-on-the-loop。VENOM 測試機隊同時支援 AIR 計畫,在真實飛行中評測多個 AI agents。

    閱讀文章 ↗

  9. Google DeepMind

    DeepMind GenCeption:影片生成模型就是通用視覺學習器

    Google DeepMind 提出 GenCeption,把文字轉影片擴散模型改造成可用文字指令驅動的通用前饋感知模型,在深度、分割、相機姿態等任務達到 SOTA,所需訓練數據最多減少 500 倍。

    閱讀文章 ↗

  10. Mistral

    Mistral 開源 Leanstral 1.5:miniF2F 滿分、每題 4 美元的 Lean 證明

    Mistral 於 2026 年 7 月 2 日釋出 Apache-2.0 授權的 Leanstral 1.5:119B 總參數、約 6B 活躍,在 miniF2F 拿下滿分、PutnamBench 解出 587 題,把 Lean 4 證明成本壓到每題約 4 美元。

    閱讀文章 ↗

  11. Ai2

    Ai2 DiScoFormer:一次前向傳播算出密度與分數

    Ai2 團隊的 DiScoFormer 用單一 Transformer 從有限樣本同時估計機率密度與分數,在 100 維把分數誤差降為最佳核密度估計的約六分之一,並獲選 ICML 2026 口頭報告。

    閱讀文章 ↗

  12. Meta

    Meta Brain2Qwerty v2:腦波轉文字達 61%

    Meta 發表 Brain2Qwerty v2:以腦磁圖搭配端到端深度學習與微調語言模型,將非侵入式腦波解碼文字的字準確率從過去的 8% 推升至 61%,並開源 v1 與 v2 的訓練程式碼。

    閱讀文章 ↗

  13. Ai2

    Ai2 拆解混合模型優勢:贏在內容詞,輸在複製

    Ai2 用資料與訓練配方完全對齊的 Olmo 3 與 Olmo Hybrid 逐 token 比較損失,發現混合架構在內容詞上明顯佔優,但在逐字複製與右括號上優勢消失,顯示循環層擅長語意狀態追蹤、注意力擅長複製。

    閱讀文章 ↗

  14. Anthropic

    諾貝爾獎得主 John Jumper 宣布離開 DeepMind 轉戰 Anthropic

    2024 年諾貝爾化學獎共同得主 John Jumper 宣布結束近九年的 DeepMind 生涯轉投 Anthropic,同週 Transformer 論文共同作者 Noam Shazeer 也離開 Google 前往 OpenAI,前沿實驗室的人才爭奪白熱化。

    閱讀文章 ↗

  15. AI

    Theker 籌 8,500 萬美元:打造「什麼都不專精」的通用工廠機器人

    巴塞隆納機器人新創 Theker 於 2026 年 6 月 11 日宣布 8,500 萬美元 Series A,CRV 領投,Samsung 與 LVMH 旗下的 Aglaé Ventures 參投,號稱歐洲機器人最大 A 輪。其模組化機器人鎖定混亂、非重複的工廠與倉儲流程。

    閱讀文章 ↗

  16. AI

    Hello Robot Stretch 4 開賣:3 萬美元家用機器人的務實路線

    Hello Robot 第四代家用助理機器人 Stretch 4 售價 29,950 美元,首波 200–300 台售罄。它刻意保留人類在環路操控,四肢癱瘓使用者已靠語音 App 用它完成日常任務。

    閱讀文章 ↗

  17. OpenAI

    OpenAI 模型推翻 Erdős 單位距離猜想:AI 數學的首座里程碑

    2026 年 5 月 20 日,OpenAI 宣布一個通用推理模型自主推翻 Erdős 1946 年的單位距離猜想,建構出超過 n^1.014 個單位距離點對,Will Sawin 補上明確指數。本文解析證明思路與對 AI 數學研究的意義。

    閱讀文章 ↗

  18. Anthropic

    Karpathy 宣布加入 Anthropic:pre-training 人才流向的風向球

    2026 年 5 月 19 日,OpenAI 共同創辦人 Andrej Karpathy 在 X 宣布加入 Anthropic 的 pre-training 團隊。本文看這項人事的指標性,與人才流向對前沿模型競賽的訊號。

    閱讀文章 ↗

  19. AI for Science

    Google ERA 登上 Nature:Gemini 寫出專家級科學程式碼

    Google 的 ERA 用 Gemini 撰寫並最佳化科學程式碼,5 月 19 日登上 Nature:六個領域達專家級水準,五份新應用論文與開源程式碼同步釋出,並透過 Gemini for Science 逐步開放。

    閱讀文章 ↗

  20. Fine-tuning

    Adaption 推出 AutoScientist:把模型訓練的研究迴圈全自動化

    2026 年 5 月 13 日,Sara Hooker 創辦的 Adaption 推出 AutoScientist,同時最佳化資料與訓練配方,聲稱勝率從 48% 升到 64%,免費開放 30 天。本文解析這套自動化訓練系統的能力與驗證難題。

    閱讀文章 ↗

  21. Multimodal AI

    Thinking Machines 互動模型:把即時對話訓練進模型本體

    Thinking Machines Lab 發表「互動模型」研究預覽:276B 參數 MoE、12B 啟動,以 200 毫秒微回合實現全雙工語音視訊互動,FD-bench 77.8 領先 GPT-realtime-2.0 與 Gemini Live,並由背景模型補足推理與工具呼叫。

    閱讀文章 ↗

  22. AI Infrastructure

    Config 募 2,700 萬美元種子輪:韓國製造業押注機器人資料

    2026 年 5 月,Config 以逾 2 億美元估值完成超額認購的 2,700 萬美元種子輪,三星創投領投,現代、LG、SK 跟投。它不造機器人,而是幫所有人訓練機器人模型,已累積逾 10 萬小時人類動作資料,自比機器人資料的台積電。

    閱讀文章 ↗

  23. AI for Science

    Altara 種子輪 700 萬美元:為物理科學補上資料斷層

    Altara 完成 700 萬美元種子輪,Greylock 領投,Neo、BoxGroup 與 Jeff Dean 等參投:為電池、半導體與醫療器材公司在既有系統上疊加 AI 代理,把數週的故障排查壓縮到分鐘級。

    閱讀文章 ↗

  24. AI for Science

    哈佛急診研究:o1 診斷準確率勝過兩位主治醫師

    哈佛醫學院團隊在《Science》發表研究:在 76 名急診患者的檢傷診斷上,o1 以 67% 的精確或接近精確診斷率勝過兩位主治醫師的 55% 與 50%。本文解析數據、批評與落地限制。

    閱讀文章 ↗

  25. AI for Science

    10x Science:用質譜 AI 代理打通藥物開發的下游瓶頸

    2026 年 4 月,出身諾獎得主 Bertozzi 實驗室的團隊創辦 10x Science,募得 480 萬美元種子輪,用質譜數據訓練 AI 代理,解決 AI 生成候選藥物之後的表徵分析瓶頸。本文看它的技術路線與製藥 SaaS 商業模式。

    閱讀文章 ↗

  26. AI

    Neurable 開放授權非侵入式 BCI:把腦波感測做成標準零組件

    2026 年 4 月,Neurable 宣布將非侵入式腦機介面技術授權給消費穿戴廠商:EEG 感測加上 AI 分析腦波評估認知表現,可嵌入耳機、帽子與頭帶。本文解析其授權模式、HyperX 合作與神經資料隱私。

    閱讀文章 ↗

  27. Machine Learning

    內省式擴散語言模型 I-DLM:首次追平同規模自回歸模型

    Together AI 與 UIUC、Stanford 等團隊提出 I-DLM,用內省式跨步解碼讓擴散語言模型邊生成邊驗證,8B 版在 15 項基準追平 Qwen3-8B,AIME-24 大勝 LLaDA-2.1-mini,還能直接跑在 SGLang 上。

    閱讀文章 ↗

  28. AI

    Corvus Trident 登場:掛在堆高機上的 AI 副駕駛

    2026 年 4 月 13 日,Corvus Robotics 在 MODEX 2026 發表 Trident,一台掛在堆高機與揀料車上的 AI 裝置,靠視覺定位與條碼掃描自動記錄棧板流動,不需 GPS 或天花板信標。本文解析其技術路線與倉儲庫存閉環的意義。

    閱讀文章 ↗

  29. AI for Science

    牛津 AI 從 CT 影像預測心衰竭:提前五年、風險最高達 20 倍

    牛津大學 Radcliffe 醫學系團隊以逾 7 萬筆匿名 CT 掃描訓練 AI,透過心臟周圍脂肪的紋理變化預測心衰竭,最早可提前五年、準確率約 86%,最高風險組發病機率約為常人 20 倍。本文解析這項技術與臨床部署的距離。

    閱讀文章 ↗

  30. Ai2

    Ai2 開源 WildDet3D:用單張照片預測 3D 偵測框

    Ai2 於 4 月 7 日開源 WildDet3D,從單張 RGB 影像預測物體的 3D 偵測框,支援文字、點擊與 2D 框提示,並同步發布超過 1 百萬張影像、370 萬組驗證標註的資料集,零樣本成績大幅超越先前方法。

    閱讀文章 ↗

  31. LLM

    PrismML 推出 1-bit Bonsai:把 8B 模型壓進 1.15 GB 的端側 LLM

    2026 年 3 月 31 日,Caltech 衍生新創 PrismML 走出 stealth,發表號稱首款可商業化的端到端 1-bit LLM 家族 Bonsai:8B 旗艦僅 1.15 GB、比 16 位元同級小 14 倍,以 Apache 2.0 開源上架 Hugging Face。

    閱讀文章 ↗

  32. Meta

    Meta 開源 TRIBE v2:預測大腦如何回應影像、聲音與語言

    Meta FAIR 釋出 TRIBE v2,以 700 多名受試者的 fMRI 資料訓練,能 zero-shot 預測新受試者、新語言與新任務的大腦反應,解析度較同類模型高約 70 倍,模型、程式碼與展示皆以 CC BY-NC 4.0 釋出。

    閱讀文章 ↗

  33. AI for Science

    MIT Wave-Former:用 Wi-Fi 訊號與生成式 AI 看穿牆壁重建 3D 物體

    MIT Media Lab 團隊發表 Wave-Former,結合毫米波無線訊號與生成式補形,重建完全被遮蔽的日常物體 3D 形狀,準確度較現有最佳方法提升近 20%,論文將於 CVPR 2026 發表。本文解析其原理、訓練資料策略與機器人應用。

    閱讀文章 ↗

  34. AI for Science

    英國首見全面評估:NHS 乳癌篩檢導入 AI 多找出 10.4% 癌症

    2026 年 3 月 13 日,Glasgow 團隊在 Nature Cancer 發表 GEMINI 研究分析 NHS Grampian 乳癌篩檢:導入 AI 工具 Mia 後檢出率提高 10.4%、讀片工作量可減少逾 30%、通知時間從 14 天縮到 3 天。

    閱讀文章 ↗

  35. Machine Learning

    LeCun 的 AMI Labs 籌得 10.3 億美元種子輪:押注世界模型

    Yann LeCun 創辦的 AMI Labs 完成 10.3 億美元種子輪,估值 35 億美元,寫下歐洲史上最大種子輪紀錄。團隊押注 JEPA 世界模型路線,主張 LLM 的幻覺問題難以根除,首個合作夥伴是數位醫療公司 Nabla,並承諾開源程式碼。

    閱讀文章 ↗

  36. AI

    Rhoda AI 走出隱身:4.5 億美元 A 輪押注機器人基礎模型

    2026 年 3 月 10 日,Rhoda AI 結束 18 個月隱身,宣布 4.5 億美元 A 輪與 17 億美元估值,並發表以數億支網路影片預訓練的機器人智慧模型 FutureVision,採 Direct Video Action 架構,鎖定工廠產線等非結構化環境。

    閱讀文章 ↗

  37. LoRA

    Sakana AI 發布 Doc-to-LoRA 與 Text-to-LoRA:一次前向傳遞生成 LoRA 配接器

    Sakana AI 開源 Doc-to-LoRA 與 Text-to-LoRA 兩個超級網路研究:前者把整份文件壓進不到 50 MB 的 LoRA 配接器,後者用一句任務描述即時產生配接器。本文解析架構、實測數字與限制。

    閱讀文章 ↗

  38. Open Source

    Guide Labs 開源 Steerling-8B:把可解釋性做進模型本身

    2026 年 2 月 23 日,Guide Labs 開源 80 億參數的 Steerling-8B,把約 13 萬個概念的結構層直接蓋進模型架構,每個 token 都能回溯到輸入、概念與訓練資料,用更少算力勝過 LLaMA2-7B。可解釋性從事後分析變成工程問題。

    閱讀文章 ↗

  39. Machine Learning

    World Labs 募資 10 億美元:李飛飛的空間智慧賭注升級

    2026 年 2 月 18 日,李飛飛創辦的 World Labs 宣布募資 10 億美元,NVIDIA、AMD、Autodesk、Fidelity 等參投,Reuters 報導估值約 50 億美元。資金將投入世界模型與 Marble 3D 生成產品,把「空間智慧」從研究概念推向可出貨的產品線。

    閱讀文章 ↗

  40. Machine Learning

    OIST 研究:讓 AI「自言自語」再配上工作記憶,學得更快也更會舉一反三

    沖繩科學技術大學院大學(OIST)1 月 28 日發表研究:在主動推論框架上加入多槽工作記憶與「內在語言」機制,讓 AI 在稀疏資料下學會泛化與多工切換,表現明顯提升,為不依賴海量資料集的輕量學習路線提供新證據。

    閱讀文章 ↗

  41. NVIDIA

    NVIDIA Earth-2 開放氣象模型全家桶:整條 AI 天氣預報管線開源

    2026 年 1 月 26 日,NVIDIA 在美國氣象學會年會發表 Earth-2 開放模型家族:Atlas 做 15 天中期預報、StormScope 做 0 至 6 小時臨近預報、HealDA 用 GPU 秒級生成初始場,稱為首個全開源的加速氣象 AI 堆疊。

    閱讀文章 ↗

  42. Machine Learning

    憶阻器訓練新法 EaPU:AI 訓練能耗比 GPU 低近百萬倍

    中國研究團隊在 Nature Communications 提出 EaPU 訓練法,把憶阻器的隨機切換特性轉為機率式權重更新,寫入次數減少逾 99%,訓練能耗比 GPU 低近六個數量級,裝置壽命延長約千倍。本文解析原理、實測結果與距離 LLM 的路還有多遠。

    閱讀文章 ↗

  43. Open Source

    Ultralytics 推出 YOLO26:去 NMS、更快的邊緣視覺模型

    2026 年 1 月 14 日,Ultralytics 發布 YOLO26:原生 NMS-free 端到端偵測、移除 DFL、Nano 版 CPU 推理提速最多 43%,五種尺寸對應邊緣到伺服器,採 AGPL-3.0 與企業雙授權。

    閱讀文章 ↗

  44. AI Infrastructure

    Etched 募得 5 億美元:用 transformer 專用晶片挑戰 NVIDIA

    2026 年 1 月 13 日,Bloomberg 報導 AI 晶片新創 Etched 募得約 5 億美元,由 Stripes 領投、估值約 50 億美元。其 Sohu 晶片採 TSMC 4nm 製程,是專為 transformer 模型設計的 ASIC,直接挑戰 NVIDIA 的通用 GPU。

    閱讀文章 ↗

  45. NVIDIA

    黃仁勳 CES 2026 開場:宣告實體 AI 時代

    NVIDIA 執行長黃仁勳在拉斯維加斯 CES 2026 主題演講宣告「Physical/Embodied AI Era」到來,並介紹下一代 Rubin 平台與自駕相關消息。本文整理演講重點與其對機器人、自駕產業的意義。

    閱讀文章 ↗

2025

3 篇文章

  1. AI

    Waymo進軍亞特蘭大,只能用Uber App叫車

    2025年6月24日,Waymo與Uber在亞特蘭大開通商用機器人計程車服務:約65平方英里市區範圍、數十輛Jaguar I-PACE、只能透過Uber App叫車、票價比照UberX,車上完全沒有人類,與Tesla邀請制試營運形成鮮明對比。

    閱讀文章 ↗

  2. AI

    Tesla 人形機器人 Optimus 負責人 Kovac 離職

    2025 年 6 月 6 日,Tesla Optimus 負責人 Milan Kovac 宣布離職,由 AI 軟體副總 Ashok Elluswamy 接手。Kovac 稱這是人生最難的決定,理由是家庭;此時 Musk 正宣稱 Optimus 要以史上最快速度擴產。本文整理這項人事異動與程式現況。

    閱讀文章 ↗

  3. Open Models

    Hugging Face 釋出 450M 開源機器人模型 SmolVLA

    2025年6月初,Hugging Face 開源 450M 參數的視覺-語言-動作模型 SmolVLA,可跑在 MacBook 或單一消費級 GPU 上,並以非同步推論堆疊把任務完成時間縮短約30%,為低成本開源機器人生態提供基礎模型。

    閱讀文章 ↗