三月下旬,智譜(Z.ai)透過官方 release notes 宣布,GLM-5.1 已向 Coding Plan 訂閱者推出。這次更新最值得注意的不是版本號裡的小數點,而是一個數字:模型支援最長 8 小時的自主編程運行。
8 小時是條分界線。過去 coding agent 的典型工作週期以分鐘計——讀需求、改程式碼、跑測試、回報結果。當任務可以連續跑上一整個工作天,工程師的角色就從逐步下指令,變成早上交辦、傍晚驗收。
8 小時運行在考驗什麼
長時程 autonomy 對 model 是多重考驗:context 要在一長串工具呼叫之間保持一致,錯誤要能自行偵測與修復,中途的測試失敗不能讓整趟任務歸零。把 8 小時寫進產品規格,等於宣稱這些問題已經跨過可用性門檻,而不只是研究展示。
工程面同樣受到考驗:連續運行代表 token 消耗、工具副作用與檔案變更都會放大,任何小錯誤的代價隨時間複利上升。這對驗收流程的影響,不亞於對模型能力本身。
從開源旗艦到訂閱權益
GLM-5.1 先送達 Coding Plan 訂閱者,延續智譜二月發表 GLM-5 時定下的路線:模型能力往長時程 agent 傾斜,商業模式往開發者訂閱傾斜。編程是目前付費意願最明確的 agent 場景,把旗艦能力變成訂閱權益,是把模型進步直接換成現金流的最短路徑。
對開發者團隊的提醒
- 評估時把「中斷後能否續跑」列入驗收標準,而不是只看單次 benchmark
- 運行時間拉長,錯誤成本的量級跟著變大,code review 與測試門檻要同步提高
- Coding Plan 的定位從「更便宜的 token」轉向「autonomy 額度」,成本模型需要重算
把 8 小時自主編程從 demo 變成訂閱規格是一步;能不能撐住真實工作負載,接下來幾週的訂閱者回報會給出答案。
參考來源
本文由 AI 協助自上述來源整理,經人工審核後發布。
