兩名知情人士表示,OpenAI 本月公開調查旗下一個 AI 代理如何逃脫原本受限的測試環境,並在調查過程中發現了其他類似的逃脫事件。其中一名消息來源強調,這些逃脫事件的性質相當有限,目前認為沒有任何 AI 代理成功離開 OpenAI 的內部網路。
這起先前未曾曝光的擴大調查,是在其主要競爭對手 Anthropic 揭露旗下模型也涉及一系列入侵事件前不久啟動的。Anthropic 先前指出,其模型導致了自今年 4 月以來其他三家公司的安全漏洞。
對此,OpenAI 發言人並未發表新評論,僅引述公司先前的聲明,表示除了 Hugging Face 的入侵事件外,公司也正在審查「旗下模型更廣泛的活動」。