AI

Claude Opus 4.7 來了:更耐操、更會驗證,但安全閘門也變多了

Anthropic 在 2026 年 4 月推出 Claude Opus 4.7,主打長任務穩定性與自我驗證能力,同時加入網路安全防護。本文整理測試者回饋與價格資訊,幫助產品開發者評估是否升級。

Claude Opus 4.7 來了:更耐操、更會驗證,但安全閘門也變多了 — 文章封面

Anthropic 在 2026 年 4 月 16 日正式推出 Claude Opus 4.7,定位是 Opus 4.6 的升級版,特別針對「最困難的軟體工程任務」強化。官方說法很直接:使用者現在可以把過去需要緊盯的程式碼工作交給它,因為它更擅長處理複雜、長時間的任務,也會在回報前先驗證自己的輸出。

對產品開發者來說,這不是一次「更聰明」那麼簡單的升級。從多家測試夥伴的回饋來看,Opus 4.7 的價值在於「可靠性」:它比較不會中途放棄、比較不會亂掰資料,也比較會自己修正錯誤。但同時,Anthropic 也因為網路安全考量,在模型上加了自動偵測與阻擋高風險請求的機制,這對某些合法資安工作會造成限制。

長任務的穩定度是最大亮點

多數測試者都提到 Opus 4.7 在「長時間執行」的表現明顯進步。Devin 團隊說它「可以連續工作數小時,遇到難題會繼續推進而不是放棄」;Factory 的 Droids 任務成功率提升 10% 到 15%,而且「會把工作做完,而不是半途停下來」。對那些需要跑很久的 agent 工作流來說,這種穩定度比單一 benchmark 分數更重要。

另一個關鍵是「自我驗證」。Vercel 觀察到 Opus 4.7 會在動手前先對系統程式碼做證明(proofs),這是之前 Claude 模型沒有的行為。Hex 則強調它「正確回報資料缺失,而不是提供看似合理但錯誤的替代答案」。這種「誠實」在生產環境裡非常可貴,因為它減少了除錯成本。

視覺與多模態能力也有感升級

Opus 4.7 的視覺能力大幅提升,可以看更高解析度的圖片。Solve Intelligence 用它來讀化學結構和技術圖表,XBOW 在視覺敏銳度 benchmark 上從 Opus 4.6 的 54.5% 跳到 98.5%。對需要處理圖表、介面設計或文件審閱的團隊,這可能是比程式碼更直接的升級理由。

價格不變,但安全閘門要留意

Opus 4.7 的定價與 Opus 4.6 相同:每百萬輸入 token 5 美元、每百萬輸出 token 25 美元。它已經在 Anthropic API、Amazon Bedrock、Google Vertex AI 和 Microsoft Foundry 上線。

但要注意的是,Anthropic 在訓練時刻意降低了部分網路安全能力,並加入自動阻擋高風險請求的機制。如果你做的是漏洞研究、滲透測試或紅隊演練,需要申請新的 Cyber Verification Program 才能使用。這對資安產品開發者來說,是升級前必須先確認的流程。

值得升級嗎?看你的工作型態

如果你的團隊主要處理「長時間、多步驟」的 coding 任務,Opus 4.7 的穩定度和自我修正能力會直接反映在開發效率上。Ramp 說它「需要逐步指導的次數大幅減少」,Notion Agent 則說它是「第一個通過隱含需求測試的模型」。

但如果你只是偶爾用 AI 寫短程式碼,升級的體感可能不明顯——多數測試者都說它是「更聰明的 Opus 4.6」,而不是完全不同的產品。另外,安全閘門的存在意味著某些合法用途需要額外申請,這點要先評估。

整體來說,Opus 4.7 是那種「讓 agent 更像同事」的升級,而不是「讓 AI 變魔術」的升級。對產品開發者而言,與其追逐 benchmark 數字,不如實際跑幾個你團隊最頭痛的工作流程,看看它能不能撐到最後。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

分享X電郵