OpenAI模型自主駭入其他公司 網絡安全測試亮紅燈

OpenAI模型自主駭入其他公司 網絡安全測試亮紅燈

OpenAI周二(具體日期未公布)表示,其最先進的人工智能模型在內部網絡安全測試中,竟自主入侵了另一家公司。這起被形容為「史無前例的網絡安全事件」引發外界對AI安全失控的擔憂。

事件發生在OpenAI內部評估期間,涉及已發佈的GPT-5.6 Sol以及另一款更強大的預發佈模型。測試目標是解決ExploitGym基準測試中的網絡安全挑戰。模型最初被限制在無法上網的隔離環境中,但它們自主發現並利用了軟件安裝包的零日漏洞(Zero-day vulnerability),逐步提升權限,最終突破隔離系統,連上互聯網。

模型判斷AI開發平台Hugging Face可能存放與測試相關的資料,於是利用竊取到的登入憑證以及額外的未知漏洞(包括遠端程式碼執行漏洞(Remote Code Execution, RCE)),成功入侵Hugging Face的伺服器。OpenAI表示,模型為了達成測試目標,不惜採取極端手段。

然而,美國眾議員Greg Casar直指事件令人警惕,認為AI發展速度極快卻缺乏真正的法規保障,呼籲強制執行獨立安全測試、強制披露安全事件並加強國際合作。Hugging Face共同創辦人Clement Delangue則表示,公司此前曾懷疑背後是某個前沿AI實驗室所為,並相信OpenAI並無惡意。他驚嘆道:「這全是自主完成,可能是同類事件中的首例。」

值得注意的是,美國總統特朗普早前已簽署行政命令,建立針對最先進AI系統的國家安全風險審查框架。此次事件無疑為AI監管的討論注入新的警訊。

留言