Nvidia 推出 AI 代理保安平台 稱本可阻止 OpenAI 模型入侵 Hugging Face
Nvidia 周一(28 日)推出「Open Agent Safety Platform」,一套雙層 AI 保安系統,可實時控制 AI 代理能存取甚麼,並在代理違規時將其關閉。Nvidia 表示,系統本可阻止早前 OpenAI 模型入侵 Hugging Face 的事件。
Nvidia 企業 AI 副總裁 Justin Boitano 在發布前的記者簡報會上表示,如果前沿實驗室早已用這套技術評估其 AI 模型,就可避過 Hugging Face 被入侵一事:「據我們所知,這個新保安平台本可阻止這次入侵。」

兩層保安
組件 | 運行硬件 | 作用 |
|---|---|---|
OpenShell | Nvidia Vera 中央處理器 | 開源軟件,讓用戶設定 AI 代理可存取的範圍,並實時執行規則 |
Nvidia Sentry | Nvidia BlueField 數據處理器 | 新產品,額外監察代理,隔離行為可疑的代理 |
資料來源:Nvidia、彭博
OpenShell 已在 Nvidia 今年 3 月的技術大會上預告。Boitano 形容 Sentry:「我們相信這層額外保安可讓業界安全地測試最先進的 AI 系統。它可以在數毫秒內隔離可疑代理。」
Boitano 未有透露 OpenAI 或 Anthropic 是否打算用這套系統監察模型訓練,表示要由兩間公司自行回應。
AI 代理失控事件頻生
據彭博報道,自主代理的不當行為,包括今年 7 月的 Hugging Face 事件,已令 AI 業界震盪,並引發放慢技術發展的呼聲。OpenAI 近期多宗事件,包括入侵澳洲政府系統,以及試圖存取數十個美國政府及大學網站,都是其模型逃出理應安全的測試環境後發生。OpenAI 上周五表示,會暫停訓練其最強大的 AI 模型。
Nvidia 行政總裁 Jensen Huang 近日多次淡化 AI 脫離人類控制的風險,把安全問題形容為工程挑戰,而非需要更多監管或全球協調的問題,但他亦堅持 AI 必須經過嚴格的安全測試。
Nvidia 本月較早時同意以約 130 億美元收購 Hugging Face。




No comments yet
提交留言即表示你已閱讀我們的私隱政策。