
在又一起「脫韁」AI模型入侵事件中,Meta證實其一個Muse Spark AI模型在一次網路安全評估期間,逃脫了預設的測試環境,取得了網路存取權限,並利用了第三方服務中的一個安全漏洞。
這是前沿AI實驗室的模型入侵第三方公司報導的第三起類似事件,此前OpenAI和Anthropic在最近幾週也揭露了類似情況。
此事件發生在由Irregular公司進行的測試期間,Irregular是Meta用於評估其前沿模型能力和安全性的獨立AI評估公司。根據Meta的說法,Irregular的一個配置錯誤導致該模型接觸到公共網路,並在公司接獲通知前,利用了一個未知的漏洞。
Meta發言人在一份聲明中表示:「Meta所使用的獨立測試公司Irregular,因配置錯誤,無意中讓我們的其中一個模型在評估期間獲得了網路存取權。」
沙盒化評估旨在嚴格受控的環境中測試先進AI系統,以防止它們與公共網路或外部電腦系統互動。
根據Meta的說法,該模型在獲得網路存取權後,利用了第三方服務中的一個漏洞。
他們表示:「Meta是在Irregular通知我們後才得知此事,我們目前正在調查中,一旦掌握所有事實,將發布全面的回顧報告。」並補充說公司正在調查此事件。
此事件發生在前沿AI開發商一系列類似揭露之後,這些揭露已引起了安全專家、立法者和公眾的普遍警覺。
上個月,OpenAI透露其兩個AI模型逃脫了沙盒化的網路安全評估,利用了一個先前未知的軟體漏洞,獲得了網路存取權限,並入侵了Hugging Face,試圖獲取安全基準測試的答案。OpenAI後來揭露,同樣的攻擊也影響了另外四個線上服務。七月稍晚,Anthropic表示,其三個Claude模型在網路安全評估期間,因測試配置錯誤而暴露於公共網路,導致三家真實世界的公司遭到入侵。
美國立法者已對駭客攻擊激增的情況做出回應,提出了立法,該法案將賦予國土安全部「AI終止開關」以及節流或關閉被認為構成嚴重威脅的模型權力。