Microsoft Agent Governance Toolkit 強制接管每個 tool call,prompt 安全 26.67% 失敗率催生 runtime 硬攔截
Microsoft 釋出 Agent Governance Toolkit,將 AI agent 安全管控從 prompt 層移至應用層:每個 tool call 與 agent 訊息在發出前先過政策引擎審查,預設拒絕任何出錯狀況。
Microsoft 釋出 Agent Governance Toolkit,將 AI agent 安全管控從 prompt 層移至應用層:每個 tool call 與 agent 訊息在發出前先過政策引擎審查,預設拒絕任何出錯狀況。根據釋出資訊,純靠 prompt 要求 agent 守規矩的失敗率達 26.67%,Toolkit 宣稱可將違規率降至 0%。
工具包宣稱政策檢查耗時 0.012ms,功能涵蓋每個 agent 配備量子安全身份、行為信任評分(滿分 1000 分)、四層特權環境沙盒、防竄改稽核日誌與緊急終止開關,附帶 992 項合規測試,原生接入 LangGraph、CrewAI、AutoGen、Semantic Kernel,覆蓋 EU AI Act、SOC 2、HIPAA,以開源方式釋出。須注意:0%、0.012ms、992 測試、quantum-safe identity 等數字,均來自單一聚合帳號推文,尚未獲 Microsoft 官方查證,口吻偏行銷,請自行驗證。
對做 agent 的工程師而言,真正的訊號在於架構方向的重力位移:prompt-based safety 的侷限已被量化。這意味著硬性管控往執行層下沉幾乎是必然走向,理論上 prompt 最終只剩最外層的軟約束,而未來企業 agent 合規的競爭點,看起來將落在誰的 runtime 攔截層先成為業界標準。


