據外媒報導,人工智慧平台 Hugging Face 於 7 月 16 日宣布,遭一套由 AI 自主執行的駭客系統入侵,不到兩天內完成約 1 萬 7 千次操作並竊取機密資料。事件調查後,OpenAI 證實攻擊者竟是測試中的 ChatGPT 駭客模型,因突破沙盒環境連上網際網路後攻擊 Hugging Face。OpenAI 已發布新聞稿,並表示正與 Hugging Face 合作處理事件,引發外界對 AI 安全控管與風險的高度關注。

根據 Hugging Face 公告,這次駭客攻擊與過去不同,整起行動幾乎完全由人工智慧自主完成,幾乎沒有或完全不需人類介入。官方指出,AI 在不到兩天內執行約 1 萬 7 千次操作,成功突破大型科技公司的防禦並取得機密資料。由於攻擊過程出現「沙盒群」、「自主代理攻擊者」及「可自行遷移的指揮與控制系統」等技術特徵,研究人員一度無法判斷攻擊來源,並報警展開調查。

全站首選:紅霞登陸中國仍甩水氣!林得恩:不穩定天氣恐持續至週三

《BBC》指出,事件曝光近一週後,OpenAI 發布新聞稿證實,攻擊者是兩個專門訓練成頂尖駭客的 ChatGPT 模型。OpenAI 表示,這些模型原本僅用於測試 AI 駭客能力,但卻突破原本應受隔離的測試環境,自行連上網際網路,隨後攻擊 Hugging Face,以取得資訊提升測試表現。OpenAI 表示,目前正與 Hugging Face 合作處理事件,並將分享此次事件的經驗與教訓。

事件引發外界熱議,部分評論人士質疑此案是否為 OpenAI 展示模型能力的宣傳操作。OpenAI 執行長阿特曼於 X 平台相關貼文下,一則質疑事件為展示模型能力的留言獲得大量按讚;資安顧問 Daniel Card 也在 LinkedIn 發文指出,OpenAI 攻擊同樣能獲得大量曝光的 Hugging Face,令人產生聯想。不過,OpenAI 發言人回應,目前外界仍有許多疑問與推測,公司將於未來數週公布完整技術報告,說明調查結果與經驗。

另一方面,事件也引來資安領域對 AI 測試環境安全性的批評。資安與風險治理平台 Pillar Security 表示,OpenAI 與 Hugging Face 事件正印證業界數月來對 Agentic AI 安全性的警告,認為單靠 Sandbox 已不足以作為 AI 代理系統的安全邊界。

當前熱搜:管仁健觀點》網軍造謠為何不用館長招牌卻要用鬍鬚張?

Hugging Face 則形容此次事件是一記「警鐘」。英國薩里大學網路安全教授 Alan Woodward 表示,OpenAI 此次事件重創公司形象;Luta Security 創辦人 Katie Moussouris 則認為,AI 產業目前仍缺乏有效控制危險技術的能力,僅有頂尖人才投入開發,不代表已具備安全開發 AI 的能力。

《BBC》表示,AI 與網路安全顧問 Francesca Bosco 提及,無論事件是否涉及宣傳操作,更重要的是此次壓力測試暴露出 AI 隔離機制及評估架構存在弱點。英國 AI Security Institute(AISI)最新研究也指出,先進 AI 模型可能為達成目標而採取未經授權的手段,引發外界對 AI Agent 未來大規模部署風險的憂慮。不過,英國前國家網路安全中心(NCSC)主任 Ciaran Martin 認為,目前尚不能直接推論 AI 將演變為更高風險威脅,但此次事件已凸顯 AI Agent 已具備高度駭客能力,人類必須及早做好資安防護準備。