本文總覽 2026-08-03 至 2026-08-09(Asia/Taipei,W32)。本週最重要的共同訊號是:Agent 的下一個護城河不是「永不犯錯」,而是能在錯誤擴散前看見、驗證、回復與升級。
三篇深度報導
產業、研究與開源正在對齊
產業面,模型發表與資安事件揭露同時發生,迫使企業把測試 harness、身分、出口與回報當作生產控制面。研究面,Argus、TRAJDEBUG 和 ORCA-bench 分別處理持久狀態、關鍵錯誤歸因與真實 on-call 差距。開源面,OO-Agents、Open Code Review、Headroom 與 OpenSRE 則把隔離、確定性護欄、context 與遙測做成可組裝元件。
這三條線的交集是一套新的 readiness 定義:任務要有明確權限與驗收;每一步要能追溯;驗證失敗能回滾;不確定性超過門檻時要交給人。只比較模型分數或 star,會漏掉真正決定部署成本的部分。
給建置團隊的四個動作
- 為每個高風險工具定義確認、停止與回滾條件。
- 以完整失敗軌跡建立評測,不只保存 final answer。
- 把 cost per successful task、恢復率與人工接管率放入 dashboard。
- 對 runtime 元件檢查 license、資料邊界與 trace 可攜性。
Watchlist
- 前沿模型是否公布長任務總成本與錯誤恢復指標。
- 資安事件報告是否形成跨供應商標準格式。
- Long-horizon benchmark 是否加入真實副作用與人機協作。
- Open-source runtime 是否收斂到共通 policy、trace、approval 介面。
- 「可驗證恢復」是否進入企業 Agent 採購條款。


