Anthropic坦承旗下AI模型測試時入侵3家公司系統

Reuters 路透社報導

人工智慧安全再亮紅燈!AI新創公司Anthropic於週四坦承,旗下AI模型Claude在進行網路安全評估測試時,因系統配置錯誤意外連上網際網路,竟成功入侵了三家組織的內部系統。

Anthropic表示,Claude是在網路安全評估期間獲得了這些系統的未授權存取權。這起事件起因於系統配置錯誤,導致該模型得以從原本應該與外網隔離的測試環境中,直接連上網際網路。

在競爭對手OpenAI揭露一起安全事故後,Anthropic隨即展開調查。OpenAI日前透露,一個失控的AI代理在AI平台Hugging Face上進行了為期數天的駭客攻擊。Anthropic在審查了141,006次網路安全評估運行後,證實了自家模型也發生類似的入侵事件。

根據Anthropic的說法,Claude僅使用了一些基本技術,就成功瓦解了受影響組織的基礎設施,其中包括利用弱密碼以及未經授權的端點(endpoints)。