AI Safety

Patch the Planet:用 AI 幫開源維護者補洞,而不是增加負擔

OpenAI 推出 Patch the Planet 計畫,結合 AI 與人工審查,協助開源專案修補漏洞。本文整理其運作方式、初步成果,以及對維護者與產品開發者的啟示。

Patch the Planet:用 AI 幫開源維護者補洞,而不是增加負擔 — 文章封面
本頁內容6 個段落
  1. 為什麼需要這個計畫?
  2. 初步成果:從幾週縮短到一天
  3. 更廣泛的發現:從核心到瀏覽器
  4. 對產品開發者的啟示
  5. 限制與下一步
  6. 參考來源

開源軟體是現代軟體供應鏈的基石,但維護者往往被漏洞報告淹沒,資源有限。OpenAI 在 2026 年 6 月 22 日推出「Patch the Planet」計畫,試圖用 AI 加速漏洞發現,同時確保修補工作不會變成維護者的新負擔。

這個計畫由 OpenAI 的 Daybreak 團隊主導,並與安全顧問公司 Trail of Bits 合作。核心概念很直接:讓 AI 模型(包括 GPT-5.5-Cyber 和 Codex Security)協助分析程式碼、開發修補程式,但所有發現都先經過資安工程師的人工審查,確認有效後才交給維護者。OpenAI 強調,這不是要取代維護者的決策,而是提供工具和流程,讓維護者能更有效率地處理安全問題。

為什麼需要這個計畫?

AI 讓漏洞發現的速度大幅提升,但「發現」不等於「修復」。維護者現在可能收到更多報告,但時間和人力並沒有增加。Patch the Planet 的設計目標是「減少負擔,而不是增加負擔」。

具體做法是:在每個專案開始前,先與維護者討論需求,決定要聚焦在漏洞驗證、修補開發、CI/CD 改進,還是長期安全工程。然後,研究人員會調查潛在漏洞、驗證問題、開發或改進修補程式、支援測試,並透過專案既有的管道協調揭露。

初始參與的專案包括 cURL、NATS Server、pyca/cryptography、Sigstore、aiohttp、Go 專案、freenginx、Python 和 python.org。這些都是網路、加密、軟體供應鏈和語言基礎設施的關鍵元件,影響範圍廣泛。

初步成果:從幾週縮短到一天

Trail of Bits 的工程師在 19 個開源專案上全職使用 Codex 和 GPT-5.5-Cyber,已經發現數百個安全問題,並合併了數十個修補程式。更重要的是,他們建立了一系列可重複使用的安全基礎設施,包括 fuzzing harness、歷史 CVE 分析管道、差異測試系統、威脅模型和擴充的測試套件。

幾個早期案例顯示了 AI 的實際效益:

  • 一天內建立 fuzzing lab:工程師用 Codex 的 /goal 模式,搭配 GPT-5.5-Cyber,在不到一天內建立了一個覆蓋數十個入口點、變體建置和多平台的 fuzzing lab。Trail of Bits 估計,手動建立同樣的 lab 通常需要至少幾週。
  • 變體漏洞分析管道:團隊建立了一個系統,能吸收歷史 CVE、提取漏洞模式、搜尋相關程式碼缺陷,並透過專門的評判代理過濾結果。這讓多年的漏洞歷史變成可重複的搜尋策略,特別適合找出已知漏洞的變體。
  • 差異測試從幾個月縮短到幾天:不同實作在相同輸入下應該表現一致,若不一致可能代表有 bug。Codex 自動產生和迭代 shim 程式碼,讓多個實作可以互相 fuzz,並比較行為差異。團隊在幾天內就得到高信號的候選結果,而傳統方法需要數週或數月。

這些成果的關鍵在於「人工審查」:Trail of Bits 的工程師在每個發現提交給維護者之前,都會手動重現證據、檢查專案文件、去除重複、重新評估嚴重性,並優先處理確認的漏洞。這一步驟至關重要,因為 AI 模型雖然能發現漏洞,但也會產生大量誤報,如果直接丟給維護者,只會讓問題更嚴重。

更廣泛的發現:從核心到瀏覽器

除了上述專案,Daybreak 團隊也在其他關鍵軟體上進行了測試,成果涵蓋整個軟體堆疊:

  • Linux Kernel:GPT-5.5-Cyber 在超過 3000 萬行程式碼中識別出安全相關元件,並動態驗證,產生了 8 個核心指標資訊洩漏 PoC 和 24 個本地權限提升漏洞利用。
  • OpenBSD:模型發現了一個存在 23 年的 use-after-free 漏洞,可能讓非特權使用者提升到 root 權限。
  • FreeBSD:研究人員用 Codex 找到並驗證了多個本地權限提升漏洞,並確認了 34 個漏洞。
  • dnsmasq:Codex Security 獨立識別了四個後來被修復的 CVE 對應的漏洞模式。
  • HTTP/2 Bomb:Calif 用 Codex 發現了一種影響 NGINX、Apache、IIS 和 Pingora 的 DoS 技術,估計超過 88 萬個網站受影響。
  • 瀏覽器:在 Chrome 的 V8 引擎中發現並回報了 5 個可利用漏洞;在 Safari 的 WebKit 中一週內發現超過 10 個;Firefox 的 WebAssembly 漏洞在 Pwn2Own Berlin 前兩天被修補。

這些數字說明了 AI 在漏洞發現上的潛力,但也提醒我們,真正的價值在於後續的驗證和修補流程。

對產品開發者的啟示

Patch the Planet 對產品開發者和 AI 工具使用者有幾個值得注意的點:

  1. AI 是加速器,不是替代品:AI 可以大幅縮短漏洞發現和修補的時間,但人工審查仍然是必要的。這對任何使用 AI 輔助開發的團隊都適用:AI 的輸出需要驗證,特別是在安全領域。
  2. 可重複的工作流程比一次性發現更有價值:Trail of Bits 建立的 fuzzing lab、CVE 分析管道和差異測試系統,都是可以重複使用的資產。這對產品開發者來說,意味著投資於工具和流程,比單次修補更有長期效益。
  3. 維護者的自主權很重要:OpenAI 強調維護者仍然控制修補程式的部署和揭露方式。這提醒我們,即使 AI 能自動化許多步驟,最終決策權仍應保留給人類。

限制與下一步

目前公開的細節仍有限,許多專案特定的發現還在協調揭露中。OpenAI 計畫在修補程式落地後,發布更深入的技術報告,分享個別發現、研究方法、驗證流程,以及防禦者可以應用的教訓。

對於想嘗試類似方法的團隊,可以先從小型專案開始,建立自己的 fuzzing 或漏洞分析管道,並確保有人工審查環節。AI 工具可以加速,但安全的最後一哩路,還是需要人的判斷。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

分享X電郵