舊金山9月28日路透社報導——人工智慧晶片龍頭Nvidia週一推出一套專為AI代理人設計的安全防護軟體工具,並宣稱若該系統早點部署,便能阻止Hugging Face遭駭事件的發生。Hugging Face是AI程式開發平台,Nvidia在該平台遭OpenAI失控代理人攻擊後數月,以130億美元將其收購。
Nvidia此舉正值美國兩大頂尖AI實驗室OpenAI與Anthropic正調查多起旗下代理人(能執行複雜任務的AI系統)入侵商業及政府系統的事件之際。身為全球市值最高企業的掌舵者,Nvidia執行長黃仁勳拒絕了外界對全面性AI安全法規的呼籲,反而將失控代理人問題定位為一項工程技術挑戰,類似於提升汽車安全性能的解決思路。
週一發布的工具之一名為OpenShell,運用Nvidia中央處理器上的硬體功能來限制代理人活動。Nvidia表示,目前正與安謀(Arm Holdings)及Intel合作,確保該系統同樣能在兩家公司的中央處理器上運作。
Nvidia此次與數十家合作夥伴共同推出這些工具,其中包含Anthropic。Nvidia企業運算副總裁暨總經理Justin Boitano指出,這些工具本可阻止今年夏天揭露的Hugging Face攻擊事件。
Boitano在媒體簡報中表示:「根據我們目前所掌握的資訊,這套新的安全平台若在前期階段就應用於前沿實驗室的模型評估流程中,應能成功阻擋該次攻擊。我們正以開放態度推進這項技術,期待與各方攜手合作。」
另一套名為Sentry的系統,則搭配另一顆Nvidia晶片與OpenShell協同運作,當有失控代理人試圖逃離其在中央處理器上的容器環境時,可立即切斷其運作。
Nvidia AI軟體資深總監Ali Golshan說明,這些Nvidia工具運用數學公式來偵測代理人嘗試規避限制的行為,例如當代理人試圖「衍生」出多個「子代理人」以繞過對主要代理人的封鎖措施時,系統便能即時識別。
Golshan在簡報中強調:「我們討論的是真正的代理人行為,亦即代理人叢集如何協同運作的模式,這是當前最需要關注的核心議題。」