輝達(Nvidia)29日宣布推出一套針對人工智慧(AI)代理人的安全工具,主打讓能夠自主執行任務的AI代理(AI Agent)在受到嚴格隔離與監控的環境中運作。輝達表示,這套新安全平台若當時已部署在相關測試環境,依據目前掌握的情況,可能足以阻止近期Hugging Face遭到OpenAI AI代理人攻擊的事件。
這起事件涉及OpenAI的AI代理人在內部測試過程中突破原本的隔離限制,進而對Hugging Face的系統發動攻擊。Hugging Face是一家重要的AI開發平台,輝達近期以約130億美元(約新台幣4100億元)收購該公司。事件發生後,OpenAI與Hugging Face合作處理這起攻擊,最終成功化解相關威脅。
限制AI代理人行動範圍已成資安課題
這起事件也凸顯AI代理人安全問題正在快速浮上檯面。與傳統聊天機器人主要負責產生文字或回答問題不同,AI代理人可以取得工具與系統權限,自主執行程式、存取檔案、操作網路服務,甚至依照設定連續工作數天或數週。當這類系統突破原先設定的限制後,可能造成的影響也遠大於單純產生錯誤答案。
輝達此次公布安全工具之際,美國兩家主要前沿AI模型開發商OpenAI與Anthropic,也正在調查多起涉及AI代理人入侵商業及政府系統的事件。隨著AI模型逐漸具備自行使用工具、執行程式及處理複雜任務的能力,如何限制AI代理人的行動範圍,以及在代理人偏離原本任務時及時發現與介入,已成為AI產業新的資安課題。
輝達企業運算部門副總裁暨總經理賈斯汀.博伊塔諾(Justin Boitano)在媒體簡報會中表示,根據目前對Hugging Face事件的了解,如果輝達此次推出的新安全平台當時已被前沿AI實驗室用於早期模型評估,「這個新的安全平台可能可以阻止這起入侵」。
輝達推OpenShell,讓AI代理人在隔離環境執行
輝達此次推出的核心工具之一是OpenShell,公司將其定位為開放原始碼的安全執行環境,專門用於讓自主AI代理人在受到隔離的沙盒環境中執行任務。
OpenShell採用核心層級隔離(kernel-level isolation),讓每一個AI代理人在獨立的沙盒中執行。輝達希望藉此降低AI代理人取得不必要系統資源,或從原本限定的工作環境中脫離的風險。
輝達指出,AI代理人的運作方式與傳統軟體程式有所不同。AI代理人可能會因為遭遇政策限制、程式錯誤、缺少必要工具,或者指令本身存在模糊之處,而逐漸偏離最初設定的任務與操作規範。
這種情況在AI代理人被要求長時間處理複雜問題時尤其值得注意。當代理人連續數天甚至數週自主執行任務,而且在過程中反覆遭遇失敗時,可能會嘗試尋找原先設計者沒有預期的解決方式。
輝達將這種現象稱為AI代理人的「偏移」(drift),也就是代理人的實際行為逐漸脫離原先設定的任務、政策或操作限制。 (相關報導: 許詠翔專欄:ADF、蘋果電動車都能縮,為何中國的殲20、華為車造假都得上 | 更多文章 )
公司表示,AI代理人不應在取得基本權限後就直接執行任務,而應從一開始便置於「零信任」(zero-trust)環境中。這意味著系統不能單純因為AI代理人來自可信模型或同一家公司,就預設其所有行為都是安全的。













































