← 所有主題

LLM Training

此主題的繁體中文文章,最新優先。

7 篇文章
繁體中文

2026

6 篇文章

  1. Anthropic

    Anthropic 15 億美元圖書和解案獲批:每本書 3,000 美元

    聯邦法官 Araceli Martinez-Olguin 最終批准 Anthropic 15 億美元圖書侵權和解,約 50 萬本書、每本 3,000 美元;但 AI 訓練資料的版權之戰才剛進入下一輪。

    閱讀文章 ↗

  2. Meta

    Meta 自導式測試時訓練:讓 LLM 自己挑該學的長上下文證據

    Meta AI 提出自導式測試時訓練 S-TTT,先讓模型自行挑選與問題相關的證據段落、再只對這些段落做適應訓練,在 LongBench-v2 與 LongBench-Pro 上帶來最高 15% 的相對準確率提升。

    閱讀文章 ↗

  3. Anthropic

    Karpathy 宣布加入 Anthropic:pre-training 人才流向的風向球

    2026 年 5 月 19 日,OpenAI 共同創辦人 Andrej Karpathy 在 X 宣布加入 Anthropic 的 pre-training 團隊。本文看這項人事的指標性,與人才流向對前沿模型競賽的訊號。

    閱讀文章 ↗

  4. Reinforcement Learning

    David Silver 創辦 Ineffable Intelligence:11 億美元豪賭「超級學習者」

    2026 年 4 月,DeepMind 強化學習主管 David Silver 創辦的 Ineffable Intelligence 以 51 億美元估值募得 11 億美元,目標是打造純靠強化學習試錯、不依賴人類資料的「超級學習者」。本文解析資金、技術賭注與倫敦 AI 樞紐的崛起。

    閱讀文章 ↗

  5. Machine Learning

    內省式擴散語言模型 I-DLM:首次追平同規模自回歸模型

    Together AI 與 UIUC、Stanford 等團隊提出 I-DLM,用內省式跨步解碼讓擴散語言模型邊生成邊驗證,8B 版在 15 項基準追平 Qwen3-8B,AIME-24 大勝 LLaDA-2.1-mini,還能直接跑在 SGLang 上。

    閱讀文章 ↗

  6. AI Infrastructure

    歐盟理事會通過 EuroHPC 修正案,AI 超級工廠取得法律基礎

    2026 年 1 月 16 日,歐盟理事會通過理事會法規 2026/150,把 EuroHPC 聯合企業的任務擴及 AI 超級工廠與量子運算,1 月 20 日生效。本文解析這套算力主權路線的資金架構、採購規則與第一季招標時程對開發者的意義。

    閱讀文章 ↗

2025

1 篇文章

  1. Meta

    Meta 入主 Scale AI 後:OpenAI 終止合作、Google 傳跟進

    2025年6月中旬,Meta 以143億美元入股 Scale AI 並帶走執行長 Alexandr Wang 後,OpenAI 證實逐步終止與 Scale 的資料合作,Reuters 報導最大客戶 Google 也打算切斷關係,AI 資料供應鏈的中立性焦慮全面浮上檯面。

    閱讀文章 ↗