2026 年 4 月 8 日,Anthropic 宣布 Claude Managed Agents 進入公開測試。這組組合式 API 把雲端代理最難自建的部分——沙箱執行、狀態與記憶、權限、排程——收進託管層,開發者只定義任務與工具。計價採用量制:標準 token 費率外,每小時運轉中的 session 加收 0.08 美元。
換句話說,「跑一個生產級代理」從基礎設施專案變成一組 API 呼叫。早期客戶 Notion、Sentry、Atlassian、Rakuten、Asana 與 Vibecode 宣稱,從原型到上線從數個月縮短到數天到數週。
測試版內建了什麼
核心是一個由 Anthropic 維運的 orchestration harness,負責決定何時呼叫工具、如何管理 context、如何從錯誤中恢復。周邊配套包含:
- 安全沙箱與工具執行,附帶身分驗證與 scoped permissions
- 可連續自主運行數小時的長時 session,斷線後進度不流失
- 跨 session 的內建記憶,以及搭配保險庫憑證的排程部署
- 多代理協作與 outcome 模式(兩者目前為 research preview)
- Claude Console 內的 session 追蹤、分析與逐次工具呼叫除錯
入口有四個:官方文件、Console 的 quickstart、新 CLI,以及 Claude Code 內建的 claude-api Skill。
大腦、雙手、工作階段:架構拆解
工程團隊用作業系統式的比喻說明架構:「大腦」是 Claude 加上 harness;「雙手」是執行動作的沙箱與工具;「工作階段」則是一份 append-only 的事件日誌。三者介面分離,可以獨立失敗、獨立替換。
早期版本把三者塞進同一個容器,沙箱掛掉就無法復原。改版後沙箱被建模為工具呼叫:容器死亡視為一次工具錯誤,harness 可重新拉起。harness 本身無狀態、可隨時重啟,取回事件歷史後從最後一個事件繼續——官方甚至說它「不知道沙箱是容器、手機,還是 Pokémon 模擬器」。
另一個重點:session 不等於 context window。harness 可先對事件日誌做壓縮、修剪或 prompt-cache 最佳化,再決定餵給模型什麼。
安全模型:憑證不進沙箱
憑證隔離是整個設計的關鍵。執行 Claude 產生程式碼的沙箱,永遠接觸不到憑證:Git token 只在沙箱初始化(克隆儲存庫、設定 remote)時消耗;MCP 的 OAuth token 存放在外部保險庫,經由專屬 proxy 存取,harness 全程看不到。配合 scoped permissions、identity management 與 execution tracing,構成治理基礎。
效能與計價
實測數字:容器只在需要時供應,省去前置設定,p50 的首 token 延遲下降約 60%,p95 下降超過 90%。任務成功率方面,內部測試顯示比標準 prompting loop 最多高出 10 個百分點,而且任務越難提升越大。計價是標準 token 費率,加上每小時 0.08 美元的 session 運轉費。Sentry 的 AI/ML 工程資深總監 Indragie Karunaratne 表示,全託管的執行環境讓該整合在數週內完成,不必自行維運代理基礎設施。
開發者該怎麼看
三個務實觀察。第一,它與 Claude Code 互補而非取代:本地與雲端託管各有場景,託管層省的是運維,不是全部控制權。第二,計價讓「代理閒置」變成顯性成本,長時任務要精算 session-hour 的帳。第三,託管代理基礎設施正在商品化——它落在Vercel 的三層 Agentic Infrastructure中「建構代理的平台」那一層,差別只在誰付運維成本。
參考來源
- Claude Managed Agents: get to production 10x faster — Claude
- Scaling Managed Agents: Decoupling the brain from the hands — Anthropic Engineering
- Claude Managed Agents bring execution and control to AI agent workflows — Help Net Security
本文由 AI 協助自上述來源整理,經人工審核後發布。
