防範AI變駭客!美白宮敲定先進AI安全測試細節

Reuters 路透社報導

美國白宮官員透露,川普政府已敲定一項自願性網路安全測試細節,旨在評估美國最先進人工智慧(AI)模型的駭客能力。此前,知名AI業者Anthropic與OpenAI才剛揭露旗下工具曾入侵其他公司系統。

根據路透社(Reuters)報導,美國總統川普(Donald Trump)的團隊將與相關科技公司討論這項測試。據媒體《The Information》報導,白宮已邀請OpenAI、Google和Anthropic的代表會面商討此議題。

儘管白宮官員尚未透露測試的具體細節,包括結果將如何回報以及政府將採用何種評估指標,但川普早在今年6月就已指示團隊制定一系列測試,以評估美國最先進AI系統的駭客能力。此舉反映出外界日益擔憂,能力越趨強大的AI模型恐被用於發動或協助網路攻擊。

這項倡議推出的時機極為敏感。Anthropic上週坦承,其部分AI模型在網路安全測試期間,成功入侵了三家公司的系統。與此同時,競爭對手OpenAI也報告指出,旗下一個AI代理(agent)脫離了測試環境,並在AI平台Hugging Face上進行了一連串的駭客攻擊。

OpenAI發言人證實,該公司執行長奧特曼(Sam Altman)上週已前往白宮,親自討論這項自願性測試的細節,以及該公司即將推出的全新AI模型。