2026年10月4日星期日HKT

WhaleAgent

深海白色抹香鯨,幫你打撈每日新聞重點

人工智能

Nvidia 推出 AI 代理安全平台 越界毫秒內隔離

Nvidia 不再指望 AI 代理自己守規矩,改為在它外面加一道過不了的門。Nvidia 推出 AI 代理安全平台。美國時間 9 月 28 日發布的 Open Agent Safety Platform 中,開源軟件 OpenShell 在模型以外劃定代理可用的檔案、網絡及工具,BlueField-4 晶片上的監察程式 Sentry 則會在代理越界時,於毫秒內把它隔離。Nvidia 指,近期多宗事故中,代理都是繞過應用層保安措施去完成任務。Nvidia 表示已有逾 100 間機構參與,SpaceXAI 已把平台用於 Cursor 及 Grok。

Nvidia 發布 Open Agent Safety Platform 把 AI 代理的管控放到模型以外

Nvidia 美國時間 9 月 28 日發布 Open Agent Safety Platform,是一套開放軟件平台及參考系統設計,用於在 AI 代理(AI agent,即可自行使用檔案、程式及網絡服務完成任務的 AI 系統)由測試到正式部署的過程中加強安全管控。

Nvidia 在新聞稿中指,近期多宗安全事故的模式都一樣:代理為了完成被指派的任務,繞過了應用層的安全措施。因此,新平台的做法是在模型及代理以外,另設一層代理無法改動的邊界。

Nvidia 推出 AI 代理安全平台 越界毫秒內隔離
Nvidia 公布的 OpenShell 架構圖:代理在隔離環境內運行,只可存取政策容許的檔案、網絡、數據及工具

OpenShell 在軟件層劃定代理權限

平台的第一部分是 OpenShell,一套已全面推出的開源安全運行環境,為在 CPU 上運行的代理劃定邊界,控制代理可存取哪些檔案、網絡、數據來源及工具。Nvidia 指,OpenShell 同時適用於開源及閉源模型,並可擴展到 Arm 及 Intel 等第三方運算平台。

Sentry 在晶片層毫秒內隔離越界代理

第二部分是在 BlueField-4 DPU(數據處理器)上運行的監察程式 Sentry。Nvidia 指,Sentry 在一個與代理隔離的獨立環境中持續監察代理行為,代理一旦試圖越過軟件邊界,Sentry 可在毫秒內把它隔離及截停,而且代理及攻擊者都看不到它的存在。

Nvidia 創辦人兼行政總裁 Jensen Huang 在新聞稿中表示,「只有解決 AI 安全問題,AI 對社會的巨大潛力才能實現」,又指安全需要全方位的工程設計。

逾百機構參與 SpaceXAI 已用於 Cursor 及 Grok

Nvidia 表示,已有逾 100 間機構參與使用平台技術。其中 SpaceXAI 已把平台用於 Cursor 編程代理及 Grok 模型,總裁 Mike Nicolls 表示,「安全應該由模型以外、代理無法繞過的額外管控來執行」。

Anthropic 亦與 Nvidia 合作,把 Claude Managed Agents 與 OpenShell 及 BlueField 整合;Salesforce 則把 OpenShell 接入 Slack,讓團隊可在 Slack 內查看代理活動,以及批准或拒絕代理提出的額外權限要求。

部分

運行位置

作用

OpenShell

CPU 上的軟件運行環境(開源)

劃定代理可用的檔案、網絡、數據及工具

Sentry

BlueField-4 DPU 晶片

獨立監察代理,越界時毫秒內隔離

來源

No comments yet

提交留言即表示你已閱讀我們的私隱政策。