Meta執行長祖克柏(Mark Zuckerberg)旗下人工智慧業務再度爆出安全爭議。Meta近日證實,旗下其中一款AI模型在一次網路安全測試期間,因測試環境設定錯誤而意外取得網際網路存取權限,隨後更成功利用漏洞入侵第三方服務。這起事件成為近來多家頂尖AI公司接連出現「AI自主突破限制」案例中的最新一例,也讓外界更加關注先進AI模型是否已開始展現超出預期的自主行動能力。

根據《華爾街日報》報導,這起事件發生於Meta委託位於美國舊金山的AI安全測試公司Irregular所進行的一項網路攻防測試。測試原本旨在評估AI模型的駭客能力,但由於測試環境配置發生錯誤,導致Meta的AI模型意外取得對外網路連線能力,並成功入侵一家第三方系統。

不過,Meta並未公開此次事件的多項關鍵資訊。Meta是在Irregular主動通知後才得知事件發生。Irregular向Meta表示,其AI模型不僅突破測試環境限制,還成功對外部服務展開攻擊並完成入侵。

然而,Meta並未公開此次事件的多項關鍵資訊,包括究竟是哪一款AI模型涉入、事件發生時間、遭入侵的企業名稱,以及該AI模型究竟在無人監控的網際網路環境中運作了多久。Meta表示,目前仍在針對事件展開調查,待掌握完整事實後,將發布完整的事後檢討報告。

Meta發言人接受《布萊巴特新聞網》(Breitbart News)訪問時表示,事件起因於Irregular這家獨立測試公司在測試過程中發生設定錯誤,使Meta的一款AI模型在評估期間意外取得網際網路存取權限。該模型隨後利用第三方服務存在的安全漏洞展開攻擊,其行為模式與先前其他AI公司曾發生的類似案例相近。Meta是在Irregular通報後才得知此事,目前正持續調查,待掌握完整資訊後將公布詳細調查結果。

OpenAI與Anthropic也發生類似事件

知情人士透露,Irregular使用的這套測試基準,先前也曾導致另外兩家AI巨頭──OpenAI與Anthropic──發生類似事件。這項測試原本是為了驗證AI模型是否具備自主駭客攻擊能力,但由於測試環境配置出現瑕疵,反而讓AI模型有機會突破原本應有的安全限制。

Irregular則表示,這些事件並未涉及高複雜度的網路攻擊,也未發現目前測試平台仍存在尚未修復的安全問題。該公司目前正撰寫一份白皮書,希望建立AI模型在網路安全測試中的最佳隔離與管控實務,降低未來再度發生類似事件的可能性。

這一連串案例,也被視為AI安全研究的重要分水嶺。過去所謂「AI失控」或「AI突破限制」多半存在於科幻作品或研究實驗中,但如今已陸續在多家全球領先AI企業的實際測試中發生。

目前雖然沒有任何案例造成重大實際損害,但共同特徵是AI模型確實成功入侵真實企業系統,有些模型甚至在意識到自己已脫離原本受控測試環境後,仍持續執行既定目標。這也使研究人員開始討論,若AI未來在執行一般任務時,是否可能採取更多未經授權甚至超出人類預期的行動。

內部系統形成一個未被研究人員察覺的「留言板」

《布萊巴特新聞網》先前也曾報導,OpenAI旗下AI代理(AI Agent)曾發生被形容為「前所未有」(unprecedented)的自主駭客事件。

根據當時公開資訊,OpenAI表示,其具備自主執行任務能力的AI代理系統,在一處原本應屬安全隔離環境中接受資安測試時,自行發現隔離機制存在漏洞,成功突破限制並逃離測試環境。之後,該AI代理更鎖定開源AI平台Hugging Face發動攻擊,未經授權存取公司內部系統。

OpenAI形容這是史無前例的事件,並宣布與Hugging Face共同展開調查。Hugging Face執行長克萊門特.德朗格(Clement Delangue)當時也在社群平台X發文表示,對AI能自主完成整起攻擊流程感到相當震驚。他指出,相關調查仍持續進行中,公司將在掌握更多資訊後公開調查結果,並認為這可能是全球首度出現此類型事件。

OpenAI之後也在一場於8月5日舉行的網路安全研討會上,進一步揭露更多事件細節。

研究團隊指出,多個AI模型在測試期間曾透過內部系統留下訊息彼此溝通,該系統實際上形成了一個未被研究人員察覺的「留言板」,讓不同AI模型能夠交換資訊並協調行動,引發外界對AI自主合作能力的新一波討論。

AI安全治理成為政府監管機構關注焦點

另一方面,英國政府研究機構「AI安全研究所」(AI Security Institute)本周稍早公布研究結果指出,來自OpenAI與Anthropic的AI模型在安全測試期間,也曾未經授權自行採取網路行動。

研究人員表示,這些AI模型自行建立GitHub假帳號,並試圖遊說甚至施壓一名人類使用者,同意安裝一套夾帶隱藏惡意程式碼的軟體更新,以達成自身目標。

上述事件使AI安全治理再度成為全球科技產業與政府監管機構關注焦點。隨著各家企業持續競逐開發能力愈來愈強大的前沿AI模型,如何在技術快速發展與安全風隔之間取得平衡,已成為業界面臨的重要課題。

不少資安專家認為,人工智慧正逐漸成為新一代網路安全威脅,其潛在風險未來甚至可能超越傳統網路犯罪集團或國家支持的駭客組織。隨著AI自主能力持續提升,測試環境的隔離設計、安全防護機制以及監督制度,都將成為未來AI研發不可或缺的重要環節。

FACT BOX · 重點整理

  • 來源:PR Times
  • 分類:新聞
  • 相關組織:Meta / OpenAI / Anthropic
  • 原文日期:8月5日