當AI Agent不再只負責回答問題,而是能讀取企業資料、呼叫API、修改程式,甚至控制機器人,如何阻止Agent越權行動,正成為企業將AI從測試推向正式環境的關鍵。輝達(NVIDIA)28日推出Open Agent Safety Platform,以OpenShell安全執行環境搭配Sentry硬體監控機制,將Agent治理從模型及應用軟體向下延伸至CPU、DPU與實體機器人系統;當Agent跨越安全邊界時,可在毫秒內將其隔離並停止。
輝達表示,近期資安事件反映出相似問題:Agent為了完成被交付的任務,可能繞過應用層的安全控制。這意味著只靠模型拒答、提示詞限制或Agent應用程式本身的權限設定,未必足以因應長時間自主運行的AI Agent,企業還需要設在模型與Agent框架之外、無法由Agent自行解除的控制機制。
OpenShell畫出執行邊界,並可延伸支援Arm、Intel
Open Agent Safety Platform主要由OpenShell開源軟體,以及搭載Sentry的參考系統設計組成,分別負責建立Agent執行邊界與提供獨立的硬體層監控。
其中,OpenShell是一套安全執行環境,可追蹤Agent採取的行動,並依企業政策限制其可存取的資料、工具與系統。OpenShell可在開放或封閉模型上使用,目的在於把強制執行的安全邊界設在模型及Agent框架之外,避免安全控制完全依賴Agent本身。
輝達指出,OpenShell搭配針對Agentic AI設計的Vera CPU,可在維持較低額外負擔的情況下執行安全控制。目前OpenShell已開放使用;由於採取開源模式,也能擴充至第三方運算平台,包括Arm與Intel架構。
BlueField-4化身獨立監控者,越界可在毫秒內隔離
第二道防線Sentry則運行於BlueField-4 DPU,透過帶外監控機制持續觀察Agent行為。與Agent在相同軟體環境內執行的安全工具不同,Sentry位於隔離的信任區域,可在Agent及攻擊者無法直接干預的情況下執行政策;一旦發現Agent試圖跨越軟體邊界,便能在毫秒內隔離並停止相關行動。
Sentry建立在輝達DOCA軟體之上,可檢查Agent的請求與回應、提供經驗證的遙測資料、確認Agent身分,並針對資料、工具、應用程式介面及服務,執行細緻的零信任存取政策。換言之,防護重點不再只是判斷模型說了什麼,也包括Agent以誰的身分運作、呼叫哪些工具、接觸什麼資料,以及越權後如何即時停止。 (相關報導: 輝達祭史上最大庫藏股授權!再加碼1,500億美元,剩餘額度衝2,350億美元 | 更多文章 )
從Slack、Joule到金融與機器人,逾百家組織參與
為讓安全控制走進企業既有工作流程,輝達也與多家模型、軟體、金融及機器人業者合作。Salesforce已將OpenShell與Slack整合,讓團隊能直接在Slack查看Agent活動及稽核事件,並核准或拒絕Agent提出的額外權限要求,增加人員監督環節。












































