人工智能公司OpenAI於周四宣布,已暫停其代號「Astra」的下一代模型部分內部開發工作,原因是初步測試顯示該模型或具備自主執行高度複雜網絡攻擊的能力,風險級別觸及內部「關鍵」門檻。
OpenAI表示,Astra在測試中展現出高超的程式編寫與駭客技術,能在無人指示的情況下獨立發現軟體零日漏洞(即軟體中未被發現的安全缺陷),並對安全網路發動端對端攻擊。公司已決定將Astra的開發限制在高度戒備的隔離環境中進行,並暫停未達到加強版安全控制要求的內部活動。
行政總裁阿爾特曼在社交平台X(前Twitter)上表示:「由於其具備的網絡能力,我們需要稍微多一點的時間來安全地完成這項工作,但希望不會太久。」OpenAI強調,Astra尚未對外發布,亦與近期Hugging Face平台遭受的漏洞攻擊毫無關聯。
此次預防性封鎖凸顯了矽谷在AI技術商業化與安全管控之間的矛盾。OpenAI此前版本包括GPT-5.6-Sol,風險評級最高僅達「高」級。公司計劃與政府機構及AI安全組織合作測試Astra,並向第三方測試合作夥伴提供安全評估建議。

留言