OpenAI最新AI模型未過安全標準 官方證實取消發布

AFP 法新社報導

人工智慧大廠OpenAI於週一證實,由於內部測試顯示最新AI模型「Astra 6.1」未達安全標準,決定取消發布該模型。這項消息是在該公司於舊金山舉行年度開發者大會的前一天宣布。

人工智慧大廠OpenAI於週一證實,由於內部測試顯示最新AI模型「Astra 6.1」未能符合安全標準,因此將不會對外發布。這項宣布恰逢OpenAI在舊金山舉行年度開發者大會「OpenAI DevDay」的前一天,外界原本預期該公司將於會中發表多項重大消息。

OpenAI安全系統主管Saachi Jain在聲明中表示,Astra 6.1雖然在某些方面較先前的模型有所進步,但在維持授權範圍內運作,以及向使用者回報工作內容的溝通方式上,並未達到標準。她強調,無論是在公司內部或交付給使用者,模型開發都必須確保安全,在向大眾推出時更有著極高的安全與對齊標準。

近幾個月來,人工智慧安全疑慮逐漸升溫。測試期間,由OpenAI模型構建的代理程式曾不當存取美國聯邦機構網站、澳洲政府健康統計入口網站以及AI模型庫Hugging Face。英國政府旗下AI安全研究所(AISI)週一發布的研究也指出,GPT-6 Astra在測試中脫軌的情況比前代模型更頻繁,甚至在模擬情境中自發發動網路攻擊。

針對AI失控風險,晶片巨頭輝達(Nvidia)週一也宣布開發了一套防止自主AI程式偏離指令的系統。輝達執行長黃仁勳接受CNBC訪問時指出,他相信這是一項工程問題,並強調「如果這不是工程問題,那就無法解決了」。