ChatGPT 開發商 OpenAI 於 21 日表示,公司表示,在測試模型網路攻防能力期間,其 AI 系統自主發現漏洞、突破限制,並入侵AI新創公司 Hugging Face 的基礎設施。
據《美聯社》報導,OpenAI 執行長奧特曼(Sam Altman)在社群平台 X 發布聲明表示:「我們在模型評估期間發生了一起重大安全事件。」並將分享目前掌握的調查結果,同時感謝 Hugging Face 在事件處理上的合作。
現正最夯:劉黎兒觀點》被看破手腳! 高市陷入「終結的開始」? 親中「大臣」正因此突起!
OpenAI 指出,事件涉及多個 AI 模型,包括 GPT-5.6 Sol,以及一款尚未公開、能力更強的內部測試模型。這些模型當時正在接受網路攻防能力基準測試,為了評估其能力,暫時降低了原本用於阻止高風險網路攻擊行為的安全限制。
AI 新創公司 Hugging Face 上週表示,該公司發現其資料處理系統遭到入侵,並懷疑攻擊是由一個能自主行動的 AI 代理程式(AI agent)所造成。Hugging Face 共同創辦人暨執行長德朗格(Clément Delangue)表示:「考量到該代理程式展現出的高度複雜性,我們上週就懷疑這起網路攻擊可能來自某家前沿 AI 實驗室(frontier lab)。結果證實確實如此。」
根據 OpenAI 聲明表示,事件發生於一項內部評估期間,模型被要求透過複雜攻擊路徑完成漏洞利用測試。調查發現,AI 模型識別並串連 OpenAI 研究環境與 Hugging Face 生產環境中的漏洞,甚至從 Hugging Face 生產資料庫取得測試答案。其中一次攻擊行動結合了遭竊憑證與零時差漏洞,成功在 Hugging Face 伺服器建立遠端程式執行路徑。
當前熱搜:柯文哲違政治獻金法案開庭「不動產賣光光」監察院:拖延時間脫產
OpenAI 強調,模型並非出於惡意目的,而是「極度專注於尋找評估題目的解法」,為達成狹窄測試目標採取了極端手段。
德朗格表示,這可能是同類事件中的首例,並強調 AI 安全問題不能由單一公司獨自處理,需要產業間公開合作。
OpenAI 表示,目前已與 Hugging Face 合作展開鑑識調查,並針對發現的漏洞進行修補,同時強化模型訓練與評估期間的隔離措施、監控機制與存取控制。並警告,隨著 AI 模型具備更強大的網路攻防能力,類似事件未來可能更加常見,「AI 正在加速漏洞的發現與利用,模型安全與防護措施必須跟上能力快速提升的速度。」