人工智能開發商OpenAI於2026年8月8日宣布,暫緩推出其下一代人工智能模型Astra,原因是該模型的網絡攻擊能力可能過於危險。OpenAI表示,最新的內部評估顯示Astra在「智能體編程和網絡安全方面取得重大進展」,無法排除其具備「關鍵網絡能力」的風險。
OpenAI指出,Astra觸發了其「準備框架」中更嚴格的準則,該準則要求對可能造成嚴重傷害的前沿人工智能能力保持警惕。框架中的網絡安全部分規定,對於可能「製造大規模網絡攻擊和漏洞利用新風險」的模型,OpenAI將實施額外保障措施。
據了解,「嚴重」門檻的定義是具備在無人干預下,識別並開發針對多個加固的現實關鍵系統的功能性零日漏洞(即尚未被公開及修補的系統漏洞),或設計並執行端到端的新型網絡攻擊策略的能力。OpenAI表示,在部署Astra前將加強保障和安全控制,包括限制相關工作,並使用隔離測試環境、限制網絡和工具存取,以及增加沙盒執行(即在受控環境中運行可疑程式)和監控能力。
OpenAI稱,將與相關政府機構及人工智能安全組織合作測試Astra。公司表示:「我們致力於與政府、安全機構和民間社會合作,確保像Astra及其後續模型這樣的前沿能力,能為全人類的利益被負責任且廣泛地部署。」
Astra此前未正式公布,但OpenAI近期在闡述數學進展的文章中分享了新模型細節。Astra以約2000美元(按Sol應用程式介面費率計算)解決了數學和理論計算機科學領域的10個開放問題。

留言