當AI Agent不再只負責回答問題,而是能讀取企業資料、呼叫API、修改程式,甚至控制機器人,如何阻止Agent越權行動,正成為企業將AI從測試推向正式環境的關鍵。輝達(NVIDIA)28日推出Open Agent Safety Platform,以OpenShell安全執行環境搭配Sentry硬體監控機制,將Agent治理從模型及應用軟體向下延伸至CPU、DPU與實體機器人系統;當Agent跨越安全邊界時,可在毫秒內將其隔離並停止。 輝達表示,近期資安事件反映出相似問題:Agent為了完成被交付的任務,可能繞過應用層的安全控制。這意味著只靠模型拒答、提示詞限制或Agent應用程式本身的權限設定,未必足以因應長時間自主運行的AI Agent,企業還需要設在模型與Agent框架之外、無法由Agent自行解除的控制機制。 OpenShell畫出執行邊界,並可延伸支援Arm、Intel Open Agent Safety Platform主要由OpenShell開源軟體,以及搭載Sentry的參考系統設計組成,分別負責建立Agent執行邊界與提供獨立的硬體層監控。 其中,OpenShell是一套安全執行環境,可追蹤Agent採取的行動,並依企業政策限制其可存取的資料、工具與系統。OpenShell可在開放或封閉模型上使用,目的在於把強制執行的安全邊界設在模型及Agent框架之外,避免安全控制完全依賴Agent本身。 輝達指出,OpenShell搭配針對Agentic AI設計的Vera CPU,可在維持較低額外負擔的情況下執行安全控制。目前OpenShell已開放使用;由於採取開源模式,也能擴充至第三方運算平台,包括Arm與Intel架構。 BlueField-4化身獨立監控者,越界可在毫秒內隔離 第二道防線Sentry則運行於BlueField-4 DPU,透過帶外監控機制持續觀察Agent行為。與Agent在相同軟體環境內執行的安全工具不同,Sentry位於隔離的信任區域,可在Agent及攻擊者無法直接干預的情況下執行政策;一旦發現Agent試圖跨越軟體邊界,便能在毫秒內隔離並停止相關行動。 Sentry建立在輝達DOCA軟體之上,可檢查Agent的請求與回應、提供經驗證的遙測資料、確認Agent身分,並針對資料、工具、應用程式介面及服務,執行細緻的零信任存取政策。換言之,防護重點不再只是判斷模型說了什麼,也包括Agent以誰的身分運作、呼叫哪些工具、接觸什麼資料,以及越權後如何即時停止。 從Slack、Joule到金融與機器人,逾百家組織參與 為讓安全控制走進企業既有工作流程,輝達也與多家模型、軟體、金融及機器人業者合作。Salesforce已將OpenShell與Slack整合,讓團隊能直接在Slack查看Agent活動及稽核事件,並核准或拒絕Agent提出的額外權限要求,增加人員監督環節。 SAP則把OpenShell嵌入SAP Business AI Platform旗下Joule Studio的執行環境,並投入相關工程開發;Anthropic則將Claude Managed Agents的隔離設計與OpenShell、BlueField結合,讓企業在Agent工作區之外,再增加軟硬體治理層。 在高敏感度產業方面,花旗與摩根大通參與金融業Agent安全技術合作;Figure、Gecko Robotics及Skild AI等機器人業者,也正運用OpenShell,把安全控制延伸至會在真實世界採取行動的自主系統。 輝達表示,目前已有超過100家組織投入Open Agent Safety Platform相關技術;由輝達與逾120家組織發起、交由Linux Foundation治理的Open Secure AI Alliance,也將透過開放研究、工具及Shared AI Findings Exchange等計畫,推動Agent安全資訊交換與產業合作。 表面開放、底層綁定,輝達爭取Agent安全標準話語權 OpenShell支援Arm與Intel平台,顯示輝達並未把這套安全架構限制在自家CPU。透過開源及跨平台策略,輝達可降低企業採用門檻;若其政策設定、Agent身分、遙測與權限管理方式被廣泛使用,也有機會進一步影響產業安全標準。 不過,平台完整的硬體層防護,仍與輝達Vera CPU、BlueField-4 DPU及DOCA軟體緊密結合。這使Open Agent Safety Platform不只是資安工具,也成為輝達擴張資料中心版圖的策略:從提供模型訓練及推論GPU,進一步掌握Agent的執行、監控、治理與異常隔離,並帶動CPU、DPU及AI基礎設施的交叉銷售。 對企業而言,Agent安全問題正從「模型會不會回答不當內容」,轉向「Agent能做什麼、可以存取哪些資料,以及失控時能否立即停止」。OpenShell與相關軟體目前已透過輝達開發者資源及GitHub提供;後續能否與企業既有的身分管理、資安營運中心、雲端安全及法遵系統整合,以及Sentry參考設計能否廣泛落地,將決定輝達能否把Agent安全進一步變成AI時代的基礎設施標準。
主要數據 — KEY FIGURES
FACT BOX · 重點整理
- 來源:PR Times
- 分類:product_launch
- 相關組織:輝達 / NVIDIA / Salesforce