近年來,人工智慧( AI )技術不斷發展,越來越多 AI 工具走入人們的日常生活之中。然而, OpenAIAnthropic 旗下的 AI 工具日前在進行網路安全測試時,曾進入公開網域並實施駭客行動,相關事件引發民眾對 AI 是否仍受控制的擔憂。與此同時,有英國 AI 研究單位爆料消息,稱上述公司的 AI 工具又被捲入一起新的安全漏洞之中,相關事件也引發 OpenAI 與 Anthropic 的高度重視。

根據《路透社》報導,英國 AI 安全研究所( AISI )於當地時間 4 日發布研究報告,稱該機構在針對 Anthropic 的 Mythos 5 以及 OpenAI 的 GPT-5.6-Sol 等兩項 AI 工具進行的 122 次性能評估測試中,發現上述模型在其中 10 次測試過程中出現了 19 次未經授權的行為,其中 17 次來自於 Mythos 5 ,剩下 2 次則與 GPT-5.6-Sol 有關。

現正最夯:慈濟遭詐陳時中早示警? 國民黨:當年不阻止還機場合照

該報導指出, AISI 透過與各大實驗室的自願協議,獲得了先進 AI 模型的使用權限,並透過代理商營運的虛構網路安全場景進行效能測試。該機構認為,此次的研究報告凸顯了 AI 代理測試流程中,在安全措施方面存在巨大的漏洞,「但這些人工智慧公司卻將旗下的工具宣傳成人類或商業的未來」。

AISI 表示,在這 19 次未經授權的行為中,其中一個 AI 工具涉及了編寫惡意程式碼、創建虛假網路身分的舉措,推測該工具可能試圖誘使人類批准程式碼,「但由於相關測試是基於虛構的網路安全場景,所有違規行為都沒有對任何機構造成任何實際的損害」。

報導稱,雖然 AISI 並未明確指出編寫惡意程式碼的 AI 工具,但 Anthropic 在事後發布的一份聲明中,坦承從事該爭議行為的工具正是自己旗下的 AI 。 Anthropic 也強調,對此次AISI 的測試活動表示感謝,認為相關活動凸顯了如何對日益強大的 AI 工具展開更廣泛討論的必要性,「我們準備與 AISI 進行更深入的合作,以獲取與該事件相關的更多細節」。

現正最夯:張博洋爆料「五五波民調」將再登場 地方揭藍營窘境:民調成柯志恩魔咒

與此同時, OpenAI 也披露了與此次測試相關的細節,承認旗下 AI 工具在兩次未經授權的行動中,都涉及了以提示所禁止的方式存取網際網路。 OpenAI 也承諾稱,將會與其他產業同僚進行深入合作,共同加強對高風險 AI 工具的評估,並在未來幾周的時間內盡可能地召集國家 AI 研究所、獨立評估機構、其他 AI 實驗室等利益相關方。

針對此次的事件,美國加州非營利組織 CivAI 的研究員 Andrew Yoon 稱, Mythos 5 在明知自己面對的是真人的情況下,仍然做出了具有欺騙性的行為,質疑 Anthropic 對旗下 AI 模型的掌控力可能不如他們自認為的那麼強。