人工智慧(AI)研發公司Anthropic週四指出,該公司在今年1月至7月期間發現並阻斷了多起濫用其AI模型的國家級監控行動,這些威脅主要來自中國、伊朗以及西非地區。
根據Anthropic發布的報告,這些監控行動鎖定的對象,包括香港的民主派人士、遍布亞洲的西藏與法輪功社群,以及海外的伊朗少數族群和異議人士。在特定案例中,伊朗人員開發出透過社群媒體帳號辨識個人的方法;而在西非國家馬利,替國家安全單位服務的承包商則利用Claude模型設計蒐集情報的底層軟體,顯示AI正逐步取代傳統的工程人力。
此外,Anthropic也指控中國開發商涉及欺騙性使用其模型。報告點名中國的Moonshot與Deepseek秘密利用Claude生成回答,同時進行「蒸餾」(Distillation)以訓練自身模型。其中Moonshot在10天內透過5380個多數位於新加坡與日本的虛假帳號,轉發了近30萬筆客戶請求至Anthropic,可能涉及洩漏敏感資料並違反隱私協議。
Anthropic同時提到,近期也阻斷了涉及武器設計、交友詐騙及可疑生物研究的違規操作。在生物研究方面,部分科學家利用AI處理屈公病病毒、高致病性禽流感、天花與M痘(mpox)所屬病毒家族以及毒素等相關研究,但Anthropic並未公開涉案人員身分,強調這些使用者為現職科學家,無法斷定其是否具備惡意。