AGENTIC COMMONSAI 產業簡報

繁中EN

主題AI 安全與防護出版 2026-10-07

返回文章列表Claude Mythos

同一顆模型、兩種把關:Mythos 5.1 把「誰能用」和「怎麼用」分開處理

如果你的產品需要最強的網路安全或生物研究能力,現在有一條很明確的分岔路:要嘛走 Anthropic 的驗證計畫申請 Claude Mythos 5.1,要嘛直接用同一顆模型但帶著防護的 Claude Fable 5.1。這是 Anthropic 於 2026 年 9 月 1 日推出 Mythos 5.1、並在 10 月 6 日更新頁面資訊後,目前官方頁面呈現的架構。

一顆模型,兩種出口

根據 Anthropic 的說明,Claude Fable 5.1 與 Claude Mythos 5.1 是同一個底層模型,差別在於安全防護。Mythos 版本只開放給通過驗證的網路防禦者和生命科學研究者,透過 Cyber Verification Program 與 Life Sciences Verification Program 申請;Fable 版本則是帶著防護的廣泛釋出。

10 月 6 日的更新把 Cyber Verification Program 擴展到 Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1 以及未來的模型,代表安全團隊申請進階能力的入口變寬了。另外 Claude Security 現在也跑在 Mythos 5.1 上。

對 builder 來說,這個架構其實回答了一個老問題:能力上限和使用門檻不必綁在同一個產品決策裡。你可以先在 Fable 上驗證產品邏輯,等真的撞到防護牆、且客戶身份夠明確時,再走驗證路線升級。

防護變精準,代表產品空間變大

這代防護有一個值得注意的進展。Anthropic 表示 Fable 5.1 現在可以用來找出原始碼中的軟體漏洞,而生物安全防護誤攔良性請求的頻率,比 Fable 5 剛推出時降低了 85%。同時,雙用途的生物化學研究問題仍會轉交給 Opus 模型處理,而滲透測試、漏洞利用程式產生、基於二進位檔的漏洞掃描這類請求則直接被擋下。

對做開發者工具的人來說,「可以分析原始碼漏洞」這條線被明確放開,意味著以往在 Fable 5 上會被攔下來的 code review、安全掃描類產品想法,現在有一個合法的落點。如果你想過在 agent 工作流裡接安全審查這一步,值得重新測一次。

不過要看清 benchmark 的細節。Anthropic 公布的成績多以 Fable 5.1 為準,且是在防護開啟的狀態下測的——在被防護介入的任務上,Fable 5.1 和 Fable 5 在 OSWorld 2.0 拿零分,網安任務由 Opus 4.8 接手、生物任務由 Opus 5 接手,Anthropic 也明說這可能壓低了兩代 Fable 的分數。換句話說,公開數字反映的是「含防護的真實體驗」,對評估反而更誠實。

定價與資料保留,先算清楚再接

Mythos 5.1 定價是每百萬輸入 token 10 美元、輸出 50 美元。使用它預設要接受 30 天的資料保留政策,用於安全監控——這對有合規要求的客戶是硬性條件,提案前先確認對方能接受。

從今年 6 月的路線也能看出節奏:6 月 9 日 Mythos 5 只給少數通過審核的夥伴,6 月 12 日一度全面暫停可用,7 月 1 日在美國政府批准後恢復對部分美國組織的存取,9 月再推出 5.1。能力越強,發佈的流程和政治因素越多,這是今年高階模型市場的現實。

你的選擇其實很簡單

一般產品用途,直接從 Fable 5.1 開始,測試防護會攔下哪些場景;真正的防禦性安全或生命科學客戶,才需要帶著對方走驗證申請。這和我之前在Anthropic 把網路安全的模型存取拆成三級裡提到的判斷一致——分級存取已經是 Anthropic 的固定模式,這次只是把同一顆模型的多種形態攤得更開。實際動手前,先讀附帶的 system card 裡的安全測試結果,再決定要不要把產品押在這條線上。

參考來源

AGENTIC COMMONS由 PHLEGON LABS 經營
分享X電郵
支持我們

相關閱讀

  1. Fable 5.1 與 Mythos 5.1 同模型:快取讀取降 75%

    Anthropic 同日發布 Fable 5.1 與 Mythos 5.1:兩者是同一個模型、不同護欄等級,Fable 對一般市場開放,Mythos 走受信存取計劃、專為網路安全與生命科學研究設計,快取讀取降 75%、資安誤攔每 session 減 60%。

    Claude Fable 5.1

  2. Sonnet 5.5 把帳單往下壓 30%:模型分層策略該重算的一張表

    Anthropic 於 2026 年 9 月 28 日發布 Claude Sonnet 5.5,速度快 30%、多數工作便宜最多 30%,高流量 agent 的成本結構需要重算。

    Anthropic

  3. 當 Claude Code 被拿來勒索:產品開發者該從 Anthropic 8 月威脅報告讀到什麼

    Anthropic 8 月威脅報告揭露 Claude Code 被用於自動化勒索、北韓假員工與 AI 生成勒索軟體,本文拆解對產品開發者的三個訊號。

    Anthropic