AI Safety

Anthropic 被要求停用 Fable 5 與 Mythos 5:一次關於監管與 AI 安全的警鐘

美國政府以國家安全為由,要求 Anthropic 暫停所有用戶對 Fable 5 與 Mythos 5 的存取。Anthropic 公開回應,質疑此決定的技術依據,並指出此舉可能開創監管先例。本文整理事件始末,並探討對 AI 產品開發者的啟示。

Anthropic 被要求停用 Fable 5 與 Mythos 5:一次關於監管與 AI 安全的警鐘 — 文章封面

2026 年 6 月 12 日,Anthropic 收到美國政府的一紙命令:基於國家安全授權,要求暫停所有外國人士(包括公司內部的外籍員工)對 Fable 5 與 Mythos 5 的存取。Anthropic 別無選擇,只能立即對所有客戶停用這兩個模型。這不是一次普通的產品更新,而是 AI 監管與安全辯論中的一個關鍵時刻。

政府說了什麼,Anthropic 又怎麼回應

根據 Anthropic 的官方聲明,政府並未在信函中說明具體的國安疑慮,僅口頭表示發現了一種「越獄」Fable 5 的方法。Anthropic 事後審查了政府提供的示範,發現該技術僅能找出少數「先前已知、且相對輕微」的漏洞,而且其他公開模型(如 OpenAI 的 GPT-5.5)不需越獄也能發現這些漏洞。

Anthropic 強調,他們在 Fable 5 上市前已與美國政府、英國 AISI 及多家第三方機構合作,進行了數千小時的紅隊測試,結果顯示 Fable 的防護遠優於任何先前部署的模型,且至今無人能找到「通用越獄」——一種能廣泛繞過所有防護的方法。Anthropic 也承認,完美的越獄防護在當前技術下並不存在,因此他們採取「縱深防禦」策略:讓越獄變得狹窄或成本高昂,並搭配嚴密監控。

爭議核心:監管標準與產業影響

Anthropic 的聲明點出一個尖銳問題:如果政府僅憑一個「狹窄、非通用」的越獄就要求召回商業模型,那麼「這個標準若套用到整個產業,基本上會讓所有前沿模型的部署停擺」。他們認為,政府應該有權阻止不安全的部署,但必須透過「透明、公平、清晰、基於技術事實」的法定程序,而這次行動顯然不符合這些原則。

這起事件凸顯了 AI 監管的兩難:一方面,政府有責任防範國家安全風險;另一方面,若監管缺乏明確技術依據,可能扼殺創新,並讓企業無所適從。Anthropic 的立場是,他們已盡力做好安全措施,且該越獄並未造成實際危害,因此政府的決定「基於誤解」。

對產品開發者的啟示

對於正在打造 AI 產品的團隊,這起事件有幾個值得深思的點:

  • 安全不是絕對的:Anthropic 的案例顯示,即使投入大量資源做紅隊測試,仍無法保證零漏洞。開發者應務實看待安全,採用分層防禦,而非追求不切實際的完美。
  • 監管合規是現實成本:Anthropic 為了配合安全監控,已要求客戶資料保留 30 天,這對客戶關係造成實際成本。未來,類似的合規要求可能成為常態,產品設計需提前納入考量。
  • 溝通與透明度至關重要:Anthropic 在第一時間公開聲明,詳細說明技術細節與立場,這有助於維繫客戶信任。面對監管壓力時,清晰的溝通是企業的關鍵資產。

後續觀察

Anthropic 表示將在 24 小時內公布更多細節,並強調會「盡快恢復存取」。這起事件是否會成為 AI 監管的轉捩點,取決於政府是否提出更明確的技術證據,以及產業界如何回應。對開發者而言,這是一個提醒:AI 產品不再只是技術競賽,監管與政策將越來越深地影響產品生命週期。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

分享X電郵