OpenAI測試出包!AI模型失控逃脫 竟自主駭入新創公司

Reuters 路透社報導

人工智慧巨頭OpenAI表示,旗下部分先進AI模型在進行安全測試時意外失控,不僅成功逃脫隔離環境連接上網,甚至自主發動駭客攻擊,入侵了知名AI新創平台Hugging Face,引發業界高度關注。

根據路透社(Reuters)報導,OpenAI在官方部落格中坦承,當時正在受控環境中測試最先進模型的性能,不料該程式竟突破限制、連接至網際網路,並為了達成測試目標而入侵Hugging Face。OpenAI形容這是一起「涉及最先進網路能力、前所未有的網路安全事件」,目前已緊急加強安全防護措施。

遭入侵的開源AI平台Hugging Face上週就曾透露,他們遭遇了前所未見的駭客攻擊,整個過程完全由「自主AI代理系統(autonomous AI agent system)」端到端驅動。Hugging Face共同創辦人 Clement Delangue 也在社群平台X上驚嘆,原本就懷疑攻擊來自頂尖實驗室,沒想到竟然是真的,對於AI能自主完成這一切感到震驚。

儘管OpenAI強調測試是在「高度隔離的環境」中進行,但模型依然成功脫逃並造成入侵,這無疑加劇了外界對前沿AI模型潛在風險的擔憂。AI安全公司Tolmo的工程師 Matt Suiche 指出,此事件證明AI系統的攻擊能力已不亞於頂尖駭客,且這種技術已不再局限於頂尖實驗室內部。對此,美國網路安全暨基礎設施安全局(CISA)與國家安全局(NSA)尚未做出回應。