← 所有主題指南

AI 代理與工作流

全站 AI Agents 文章總覽:代理的 prompt 設計、生產環境可靠性、工具與 MCP 串接,以及上線後的安全閘門。

179 篇文章
繁體中文

主題簡介

這個主題收集全站談 AI 代理的文章:從單一 agent 的 prompt 寫法,到多步驟工作流、工具呼叫與 MCP 串接,再到把代理放進生產環境的工程決策。

反覆出現的主題很一致:可靠的代理靠的不是更強的模型,而是環境與流程——授權邊界、沙盒、評測與人工審批。這裡的文章多半至少碰到其中一個環節。

必讀精選優先收錄有實際部署經驗的文章;完整時間線收錄此主題全部文章。

必讀精選

6

  1. OpenAI

    GPT-5.6 Prompt 寫法:少寫一點,結果反而更好

    把 OpenAI 官方 GPT-5.6 Sol prompting guidance 整理成繁中實戰指南:意圖理解與精簡機制、三層授權邊界、工具路由與停止條件、PTC 判準,以及 migration 順序與模型家族速覽。

    閱讀 ↗

  2. AI Agents

    Shippy 的生產經驗:可靠 Agent 靠的不是只換一個更強模型

    Ai2 海事 agent Shippy 用四層工程面對高風險決策:soul/skills/config 三層分離、確定性 CLI 包住複雜 API、每 session 獨立沙盒,以及以 live data 評測整個 agent 的 release gate。

    閱讀 ↗

  3. AI SDK 7

    AI SDK 7 不只包裝模型 API:Agent 開始需要真正的生產控制

    AI SDK 7 以統一推理控制、typed Tool Context、三型審批、耐久工作流、Sandbox 抽象與全域 Telemetry,把 TypeScript agent 開發推向生產級。本文從 Adapter 到 Runtime 的架構視角,整理五大面向的設計動機、實驗性邊界與採用順序。

    閱讀 ↗

  4. Vercel Agent

    Vercel Agent 進入 Production:先調查、再提案,批准後才動手

    從 500 錯誤在三分鐘內完成回滾的官方案例出發,拆解 Vercel Agent 的五種實際用法、plan-to-permission 安全模型、Firecracker sandbox 驗證機制,以及 builder 可直接搬走的 production agent 安全設計清單。

    閱讀 ↗

  5. Firecrawl

    Firecrawl 101:Agent 要讀懂即時網頁,其實需要六種不同能力

    以 web context 缺口為主軸,拆解 Firecrawl 六個端點的設計動機與適用場景,附上 research agent 與 enrichment pipeline 兩個可直接套用的 production 模式,以及何時該停在最小組合。

    閱讀 ↗

  6. WebMCP

    WebMCP 遇上 Headless Agent:Firecrawl 如何補上瀏覽器這一環

    WebMCP 提案讓網站直接向 Agent 註冊 developer-defined tools,但 Chrome 官方文件明言目前不支援 headless 呼叫。本文整理 WebMCP 的工具模型與 Chrome 157 時程、headless 限制的根源,以及 Firecrawl interact 如何用雲端真實瀏覽器把 discovery 與執行串成單一 tool call。

    閱讀 ↗

完整時間線

179 篇文章
展開全部 179 篇文章

2026 / 176 篇

  1. 把面試排程交給 agent:Amazon Connect Talent 想解決的招募瓶頸
  2. Muse Spark 把「想久一點」變成可調參數:多代理推理與思考時間懲罰的取捨
  3. 當全球統計資料變成 AI-ready 知識圖譜:UN System Data Commons 對產品團隊的意義
  4. 當 agent 也能改 production:Cloudflare 把 Workers 權限切到單一資源
  5. 把公司資料變成對話:Data agent 如何縮短從問題到答案的距離
  6. Grok 接上 Coinbase:當 agent 能直接動你的交易所帳戶
  7. Hermes Agent:記憶留在本機、會自己長出技能的開源助理
  8. 為代理挑選網頁搜尋 API:先定義任務,再比較六種工具
  9. DevFest 2026 回歸:開發者如何從 800 場實體活動中挑出對自己有用的 agentic AI 內容
  10. 把電子郵件拆成三十個小模型:Fyxer 如何讓 AI 助理值得信賴
  11. 把銀行 API 上線流程拆成七個專責代理:Ninth Wave 在 Amazon Bedrock 上的多代理設計
  12. 當模型開始替你的系統做測試:Perplexity 把 GPT‑6 Astra 放進端到端流程
  13. Fable 5.1 的省錢關鍵不是模型,而是你的快取讀取比例
  14. 把行銷維運寫成程式碼:用 GitHub 把活動從規劃到追蹤自動化
  15. 流程編排的三種執行模型:先決定誰能做決定,再談工具
  16. 把測試證據放進開發流程:Cognition 用 GPT‑6 Astra 讓 Devin 自己驗證成果
  17. 把互動介面塞進對話框之後:MCP Apps 在 AgentCore 上的部署取捨
  18. 當網頁開始對你的代理下指令:Prompt Injection 的實務風險與防線
  19. AI 軟體工廠的關鍵不是代理,而是五道閘門
  20. 把 diff、終端機與瀏覽器收進同一個視窗:Copilot app 對審核流程的實際改變
  21. Muse Spark 1.1 把「工具呼叫」變成產品架構問題:Meta Model API 公開預覽的實務訊號
  22. 別再只看每百萬 token 報價:Amazon Bedrock 上的 OpenAI 模型該怎麼挑
  23. RFI 問卷自動化:把多分頁 Excel 變成可驗證的資料管線
  24. 挑選 AI 語音代理平台:先拆解成本與部署層級,再談功能
  25. 用 AgentCore 把付費數據變成按次計費的投資工作台
  26. 從 Fortran 77 到 C++:AI 代理如何處理 4 萬行物理模擬程式碼的現代化
  27. AI 代理如何把網路間諜活動從「人為指揮」變成「自主執行」
  28. Claude 十一天形式化費馬最後定理:1,300 萬行 Lean 完整證明
  29. 自動化的早期足跡:從 ATE 資料集看 AI 工具的真實樣貌
  30. 用 Amazon Bedrock AgentCore 打造跨 WhatsApp 的點餐助理:文字、語音、通話一條龍
  31. Claude Code 不只是終端機:artifacts、auto mode 與 /design 如何把它變成協作平台
  32. MCP 2.0 無狀態化:一次請求取代兩段式握手,代理工具基礎設施補上最後一塊
  33. Meta Muse Spark 1.3:把「會問問題、知道極限」的代理行為當成主打功能
  34. OpenAI 推出 Astra:第一個觸發 Critical 網路門檻的模型如何安全上架
  35. 用生成式 AI 重整支援營運:AWS 的實務架構
  36. 從澳洲呼叫 OpenAI 模型:Amazon Bedrock 全球跨區域推論的實作重點
  37. 2026 年 Claude Code 與 Codex 實測推薦:12 個 MCP Server 完整比較
  38. BotBase for Operators:讓網站主與機器人營運者不再互相猜測
  39. 生成式 AI 落地:從商業需求出發,而非追逐熱潮
  40. Model Hardware Standard 研究預覽:讓 AI Agent 安全操作實驗室與工廠設備
  41. Google Cloud 推出 Gemini Enterprise for Legal:把 agent 工作流帶進律師事務所
  42. 為 AI Agent 挑選學術搜尋 API:五種工具的取捨與實務考量
  43. NVIDIA AVO 於 ARC-AGI-3 滿分:模型之外的代理系統才是關鍵
  44. Bot Preference Sync:Cloudflare 把 AI 機器人政策寫回 robots.txt
  45. OAuth 不再全有或全無:Cloudflare 推出可自訂的授權範圍
  46. Copilot canvases:把 agentic workflow 從聊天捲動搬上可審視的畫布
  47. 看不見的 Agent 流量:Cloudflare 如何偵測 Shadow MCP 並收回治理權
  48. DeepSeek 開源 Agent Harness:一切皆外掛的開發者預覽
  49. Gemini 3.7 Flash 三週再迭代:寫程式與代理更強、入門價砍半
  50. 從輔助到執行:企業如何讓 AI 真正動手做事
  51. Claude Sonnet 5:把 Opus 級能力帶到 Sonnet 價格帶
  52. Meta 回歸開放權重:30B 的 Muse Glimmer 把本地代理變成現實
  53. 2026 年值得安裝的 ChatGPT 插件:把對話變成工作台
  54. OpenAI 首度無法排除 Astra 達 Critical 網路門檻
  55. Cloudflare AI Search:為你的 Agent 加上一個專屬搜尋引擎
  56. 2026 年企業級網頁爬蟲服務怎麼選:從 Firecrawl 到 Octoparse 的實用比較
  57. 第三方資安測試中,模型為何越界?OpenAI 揭露兩起評估事件
  58. 把問題倒過來問:Agent Cloud 到底是為誰設計的?
  59. Gemini Managed Agents 更新:預設 3.6 Flash、環境鉤子與成本控制
  60. AI 代理逃出評估沙盒入侵 Hugging Face:四天半攻擊的技術時間線
  61. OpenRouter Classifiers:讓每筆 AI 請求自己交代用途與成本
  62. OpenAI 認了:內部評估模型逃出沙盒,駭進 Hugging Face 作弊
  63. Block 開源 Buzz:團隊聊天、AI 代理與 Git 託管共用一條事件流
  64. 把 Claude Code 放到備用 Mac:隔離 Agent 工作站的價值與安全界線
  65. Project Think:Cloudflare 為下一代 AI Agent 打造的新基礎
  66. WebMCP 遇上 Headless Agent:Firecrawl 如何補上瀏覽器這一環
  67. Grok 4.5:勝負各半的 benchmark,與四分之一 token 的效率算盤
  68. LM Studio 推出 Bionic:開源模型專用的本機 AI Agent
  69. Shippy 的生產經驗:可靠 Agent 靠的不是只換一個更強模型
  70. Lyzr 用自家 Agent 談成 1 億美元 B 輪募資
  71. GPT-5.6 Prompt 寫法:少寫一點,結果反而更好
  72. Claude Fable 5 簡評:不是更強的聊天模型,而是長任務的自主工作者
  73. Vercel Agent 進入 Production:先調查、再提案,批准後才動手
  74. Gemini API 的 Managed Agents 更新:背景任務與遠端 MCP 的實務意義
  75. AI 法律新創 Norm 募得 1.2 億美元,躋身獨角獸
  76. Cognition 推出 Devin Security Swarm:代理群驗證漏洞並自動修補
  77. Sourcegraph Agentic Batch Changes 公測:代理自動完成大規模程式碼遷移
  78. Claude 3.7 Sonnet 的「延長思考」:可調控的推理預算與可觀察的思考過程
  79. Gemini Spark 登上 Mac:Google 代理助理接管你的桌面
  80. AWS 投入 10 億美元成立 FDE 組織,把工程師送進客戶現場
  81. Claude Code 六月底連發:組織預設模型上線、MCP 邊界補強
  82. Cloudflare OAuth 全開放:自助式用戶端與零停機引擎升級
  83. General Intuition 募 3.2 億美元:用遊戲數據教 AI 直覺
  84. AI SDK 7 不只包裝模型 API:Agent 開始需要真正的生產控制
  85. OpenRouter MCP:讓 Coding Agent 用即時價格與評測選模型
  86. AWS Lambda 推出 MicroVMs:AI 程式碼的隔離沙箱
  87. MosaicLeaks 基準:研究代理的對外查詢正在洩漏企業機密
  88. Cloudflare 臨時帳號讓 AI 代理免註冊直接部署
  89. Cursor Automations 入門:把 AI 工作流丟上雲端,用 Firecrawl 補上即時資料
  90. Anthropic Project Fetch 第二階段:Opus 4.7 操作機器狗比人快 20 倍
  91. MCP 企業託管授權定案:零接觸 OAuth 讓 AI 代理連上企業工具
  92. Vercel 企業版:讓內部 AI Agent 與應用安全上線的四道預設防線
  93. Salesforce 36 億美元收購 Fin:Intercom 轉型 AI 客服的完局
  94. AI 原生轉型不是導入工具,而是重新設計工作流程:Endava 的實戰經驗
  95. Poke 獲蘋果核准:Messages for Business 首個獨立 AI 代理上線
  96. AI 令網路攻擊更危險,但現有框架可能看不見
  97. Visa 投資 Replit:讓 AI 開發平台原生內建金流
  98. Gemini Spark 實測:雲端 24/7 代理助理能做什麼、卡在哪
  99. OpenRouter Guardrails:不改 code,在 workspace 層為 Agent 裝上成本與安全閘門
  100. Asana 以 7,500 萬美元收購 StackAI,補齊人機團隊執行層
  101. Firecrawl 的 /monitor 是為 AI 代理搭建的網頁變化感知層
  102. Sesame iOS 版上線:四位語音 Agent、平行搜尋與 2027 智慧眼鏡
  103. Robinhood 開放 AI 代理人代客下單與刷卡消費
  104. Runtime(YC P26)上線:把沙盒化 coding agents 開放給整個團隊
  105. Google I/O 2026:Pichai 宣告 agentic Gemini 時代,搜尋 25 年來最大改版
  106. IrisGo 桌面 AI 管家:看一次就學會的主動式代理人
  107. Firecrawl 101:Agent 要讀懂即時網頁,其實需要六種不同能力
  108. NanoClaw 走紅之後:拒絕 2,000 萬美元收購,把 agent 關進容器
  109. 黃仁勳宣稱 Vera CPU 打開 2,000 億美元新市場:agent 晶片戰開打
  110. Anthropic 收購 Stainless:SDK 生成工具收編為自家專用
  111. PwC 將 Claude 推進企業生產:從 10 週縮到 10 天的保險核保,背後是 Agentic 的落地策略
  112. Amazon 推 Alexa for Shopping 取代 Rufus:個人化 AI 購物助理
  113. Thinking Machines 互動模型:把即時對話訓練進模型本體
  114. Medicare ACCESS 給付新制:AI 醫療首次有了可收費的位置
  115. SAP 收購 Prior Labs:四年 11 億歐元打造結構化資料 AI 實驗室
  116. Altara 種子輪 700 萬美元:為物理科學補上資料斷層
  117. Etsy 把商店搬進 ChatGPT:從結帳失敗轉向對話式導購
  118. OpenAI 傳開發 AI Agent 手機:用 Agent 取代 App 的豪賭
  119. 中國否決 Meta 併購 Manus:20 億美元交易踩線被撤
  120. Meta 員工鍵擊成訓練資料:Model Capability Initiative 的隱私爭議
  121. Sierra 收購 Fragment:客服代理平台的第三樁併購與法國佈局
  122. Yelp 春季改版:AI 助理從問答走到訂位點餐一條龍
  123. Google 掃描公開網路:間接提示注入攻擊正在增長
  124. Zapier 推出自動化 Agent 評測集 AutomationBench:前沿模型全數不及格
  125. 當搜尋引擎要服務上千個 AI agent:Exa 用 DAG 管線解決可觀察性難題
  126. Codex 更新:從寫 Code 到幫你操作電腦
  127. Cloudflare Agent Cloud 引入 OpenAI 模型:企業部署代理的新基建
  128. Vercel 表態 IPO 就緒:AI Agent 部署潮成為營收引擎
  129. Gartner:2028 年 25% 企業 GenAI 應用每年至少 5 次資安事件
  130. Claude 進軍金融服務:Anthropic 推出整合數據與分析的一站式方案
  131. ServiceNow AI 定價重構:Foundation、Advanced、Prime 三級方案迎戰企業 ROI 難題
  132. A2A 協定滿一週年:150 家組織、五種 SDK 與 v1.0 穩定規格
  133. 企業 AI 的下一個階段:從 Copilot 到公司級 Agent 平台
  134. Claude Cowork 正式版上線:桌面 Agent 補齊企業治理配套
  135. DeepSearchQA 實測:Ultra 準度勝 GPT-5.4,成本僅 43%
  136. Web Search 與 Deep Research:2026 年 Agent 的資料層已經變成基礎設施
  137. Bluesky 推出 Attie:用 Claude 打造自己掌控的演算法
  138. GLM-5.1 送進 Coding Plan:Z.ai 把 8 小時自主編程變成訂閱規格
  139. Shield AI 募 20 億美元、估值翻倍至 127 億,收購 Aechelon 深耕軍用自主
  140. Accenture 攜手 Anthropic 推出 Cyber.AI:Claude 當資安營運的推理引擎
  141. Google RSAC 2026:用 Gemini 情報與 AI Agent 追上 22 秒的攻擊
  142. Visa Agentic Ready 登場:歐洲 21 家發卡行實測 AI 代理付款
  143. NVIDIA 開源 Nemotron 3 Super:120B 混合 MoE 模型瞄準 Agent 推論吞吐
  144. 三月 Pixel Drop:Gemini 學會在 App 裡訂生鮮、叫車、買咖啡
  145. Claude Code Remote Control 上線:手機遙控本機代理的新工作流
  146. VAST Data 新引擎:讓 AI OS 自己治理、自己學習
  147. Notion 3.3 Custom Agents 登場:會排程、會觸發的 AI 隊友
  148. NIST 啟動 AI Agent 標準倡議:互通與安全決定代理普及速度
  149. 阿里巴巴開源 Qwen3.5:397B 參數、201 種語言的 Agent 時代模型
  150. Grok 4.20 公測:四個代理人先辯論再回話
  151. Matt Shumer「有大事正在發生」:5,000 萬瀏覽的 AI 文與論戰
  152. Cadence ChipStack 超級代理:前端晶片設計驗證的全代理工作流
  153. Deep Research 接上任何 MCP:ChatGPT 研究代理轉向可信來源
  154. 16 個 Claude 代理寫出 C 編譯器:兩週、10 萬行、2 萬美元
  155. 微軟 Cyber Pulse 報告:八成財星 500 大企業已在跑 AI 代理
  156. Moltbook:AI agent 專屬社群一週 160 萬帳號,資料庫漏洞外洩 150 萬組金鑰
  157. GPT-5.2 寫下 METR 時間視野新紀錄:6.6 小時的 Agent 門檻
  158. OpenAI 推出 Frontier 企業代理平台:讓 AI 同事接入系統做事
  159. ElevenLabs 募資 5 億美元、估值 110 億:語音 AI 轉向企業代理
  160. 國際 AI 安全報告 2026 登場:百位專家點名自主代理風險
  161. 從 Clawdbot 到 OpenClaw:爆紅開源代理一週二改名,安全疑慮升高
  162. Chrome 版 Gemini 推 Auto Browse:代理式瀏覽走進月更節奏
  163. Claude 對話即應用程式:Anthropic 推出 MCP Apps 互動連接器
  164. 新加坡率先推出 Agentic AI 治理框架:四道防線框住自主代理人
  165. Notion 3.2 登場:手機 AI、自選模型與企業分析
  166. 阿里巴巴升級通義 App:AI 助理直接幫你點餐、訂行程
  167. Skild AI 融資 14 億美元:一顆通用機器人大腦的豪賭
  168. Salesforce 新版 Slackbot 正式上線:企業代理的前門
  169. Anthropic 推出 Labs:前沿實驗室的產品實驗場
  170. Anthropic 推出 Claude Cowork:給不寫程式的人用的 GUI Agent
  171. Cursor CLI 更新:模型、規則與 MCP 管理走進終端機
  172. CrowdStrike 收購 SGNL:把每個 AI Agent 都當成特權身分來防護
  173. Allianz 攜手 Anthropic:Claude 進駐 15.6 萬人的保險巨頭
  174. 美國戰爭部發布 AI 加速戰略:七大衝刺專案打造 AI 優先戰力
  175. 微軟加入 AI 購物戰局:Copilot Checkout 登場
  176. Lenovo Qira 登場:跨裝置個人 AI 超級代理的環境智慧藍圖

2025 / 3 篇

  1. AI店長Claudius搞砸商店,Anthropic公開實驗教訓
  2. Anthropic 紅隊報告:16 模型模擬中高比例勒索
  3. Amazon 賈西內部信:AI 效率將縮減白領職缺