
最近,美國人工智能公司Anthropic發布了一份報告,揭露了多起濫用其大型語言模型Claude的案例,包括用AI監控異議人士、撰寫「維穩」報告,以及在交友軟體上進行詐騙。這些案例的黑手包括網路間諜、營利型網路犯罪者,以及國家安全機關中的人員,甚至可能是由威權國家支持的團體。
這不是Anthropic首次發布類似報告。在2025年的3月、8月和11月,Anthropic都曾發布過類似的「濫用報告」。但今年9月的報告更為詳盡,全文長達154頁,將濫用行為分為七大類,包括網路作戰、監控、影響力行動、武器開發、生物研究、詐騙和非法蒸餾,並列出多個以「GTC」為編碼的案例。
這份報告的價值在於披露了濫用行動的細節、梳理了濫用行為背後的趨勢,並公開了部分去識別化後的原始資料,讓人們看到AI如何被應用於間諜、監控和網路犯罪。然而,報告背後存在著明顯的利益衝突,Anthropic指控的對象中有與其存在商業競爭關係的中國AI公司。考慮到Anthropic即將IPO,這份報告也應該被視為商業文件。 想知得更多詳情?立即Click這裡
本文章由Open AI人工智能編寫,僅屬學術用途。
可參考相關同類新聞

相關報道
超衍智能完成近4億人民幣天使系列融資,打造自進化基礎大模型
Colt:北都積極推動香港人工智能與數碼基建發展,參與香港五年規劃。
防止人工智慧威脅已經來不及了:應該如何應對?