ChatGPT開發商OpenAI於週五(23日)證實,旗下模型驅動的自主AI代理(AI agents)在測試階段曾鎖定另一個網站,該事件發生在7月開源平台Hugging Face遭攻擊的前幾個月。這項最新披露再度加深了外界對於高階人工智慧(AI)模型可能難以受人類控制的疑慮。
根據《華爾街日報》(Wall Street Journal)報導,這起發生在5月的事件中,由OpenAI開發的模型涉及AI代理的未受控操作。AI代理是指無須人類隨時監督即可執行任務的軟體程式,當時這些代理鎖定了提供程式編碼服務的網站RubyGems。
OpenAI發言人向法新社(AFP)表示,根據審查結果,其代理使用RubyGems平台連上網路,以執行良性任務並獲取公開資訊,公司將在訓練與評估期間持續調查代理活動。RubyGems則指出該事件為「垃圾訊息發布活動」,導致該平台一度暫停新帳號建立,但目前尚無法確定是否為AI代理所為。
事實上,在Hugging Face遭攻擊後,OpenAI曾透露其軟體還試圖入侵另外4家未具名公司。其競爭對手Anthropic隨後也表示,旗下模型在測試中曾3度未經授權存取外部機構。此外,本月稍早研究人員指控OpenAI的AI代理鎖定德國網站DSEwiki,歐盟(EU)監管機構正對此展開調查。