行情

AgentDoG 1.5 是什麼?上海 AI Lab 開源輕量 Agent 安全護欄、稱超越 GPT-5.4

6 月 28 日,上海人工智慧實驗室發布 AgentDoG 1.

AgentDoG 1.5 是什麼?上海 AI Lab 開源輕量 Agent 安全護欄、稱超越 GPT-5.4

AgentDoG 1.5 是什麼?上海 AI Lab 開源輕量 Agent 安全護欄、稱超越 GPT-5.4

6 月 28 日,上海人工智能實驗室發布 AgentDoG 1.5,這套框架只用 1000 個樣本就能對齊 0.8B 到 8B 參數的小模型,小模型不需額外訓練就能即時攔截 AI agent 的高風險行為。論文、模型與訓練資料同步全面開源,含 Hugging Face 模型庫與程式碼專案。這套方案理論上讓安全層作為獨立元件貼著 agent 跑,不必每次拉大模型推論,差異直接反映在部署成本與延遲上。

AgentDoG 1.5 靠一個資料引擎驅動:系統自動過濾並標注高風險行為樣本,再用這批資料對齊小模型,讓它辨識 agent 在複雜任務鏈中可能踩到的安全邊界。根據團隊官方說法,AgentDoG 1.5 在複雜 agent 安全測試上的表現超越 GPT-5.4;相較於靠大模型做安全監督的方案,Docker 容器部署成本降低幅度達 100 倍,規模較小的工程團隊也能把安全護欄部署進自有基礎架構。上述兩項數字均為團隊自行報告,目前尚無獨立第三方復現,工程上,這個缺口值得留意。

這個缺口換個角度問才更有意義:AgentDoG 1.5 想解決的問題到底有多普遍?當工程師把 AI agent 推上生產環境,「沒有人持續盯著的情況下能不能信任這個 agent」幾乎是所有人的第一道問題。AgentDoG 1.5 如果數字站得住,看起來給出了一條路:一個夠小、能貼著 agent 跑、成本低到能長期部署的安全層。已在跑多 agent 工作流、又沒辦法為每個 API 呼叫掛大模型監督的工程團隊,這個方向有直接參考價值;數字可不可靠,得等獨立評測跟上才能確認。

標籤

#agentdog 1.5#上海人工智慧實驗室#ai agent 安全#agent guardrail#開源安全模型

繼續閱讀

查看全部 →
NewsAI 快訊

什麼是 Looped Transformer?GPT-6 Astra 的循環深度與隱藏思維鏈解析

上週,OpenAI 發布 GPT-6 Astra,ARC-AGI-3 得分達 99.9%,前代 GPT-5.6 Sol 同基準測試集只有 7.8%;3D 算圖、數學與程式碼任務的進步幅度格外突出

DeltaMedia 編輯部8 分鐘
NewsAI 快訊

Omen Alpha 是什麼模型?价格、速度實測與 flash 級編碼模型對比

匿名模型 Omen Alpha 5 天登上 OpenCode 呼叫榜第七,flash 定價下速度換智力的取捨浮上檯面

DeltaMedia 編輯部2 分鐘
NewsAI 快訊

GPT-6 Astra 需求塞爆!OpenAI 主管示警:Pro 訂閱恐被迫喊卡

OpenAI 核心產品負責人 Thibault Sottiaux 於 2026 年 9 月 9 日在 X 平台發文明示警,GPT-6 Astra 的使用者需求已超出公司歷史部署經驗,若情況持續,可能不得不暫時暫停新的 Pro 訂閱。

DeltaMedia 編輯部7 分鐘
NewsAI 快訊

神秘模型 Omen Alpha 憑極速低價橫掃榜單,實測卻爆邏輯短板引發效能爭議

Omen Alpha 上線 5 天後仍居 OpenCode 呼叫量榜單第七,在免費模型 Muse Spark 1.3 Contributor 的競爭下展現強大吸引力,其身分成謎引發社群熱議。

DeltaMedia 編輯部5 分鐘