路透9月10日 - Anthropic周四表示,在過去八個月中,該公司已挫敗了數起涉嫌惡意 使用其Claude模型的事件,其中包括一起涉嫌與俄羅斯有關的網絡間諜活動,以及一些中國人工智能公司試圖提取和 複製Claude功能的行徑——該公司指控這些公司有此意圖 。
Anthropic在其最新的《威脅情報報告》中指出,網絡犯罪分子和受國家支持的黑客越來越多地利用人工智能,不僅用於輔助任務,還用於策劃和執行大量網絡攻擊,並補充說,在這些行動中,人類往往只是監督者,而非實際操作者。
「大多數行動……都是通過AI直接執行或協調而實現的。AI的應用已超越了聊天機器人簡單的問答,而是涉及利用多代理框架來執行」任務,Anthropic表示。
Anthropic稱,在此期間,該公司挫敗了其描述的來自七家中國 實驗室的攻擊 。Anthropic點名的實驗室包括科技巨頭阿里巴巴 9988.HK, BABA.N、Moonshot、DeepSeek和小米。
Anthropic稱,與阿里巴巴有關聯 的操作者發動了該公司所稱 的最大規模「非法蒸餾」攻擊,據稱旨在提取Claude模型的能力,並利用這些能力來改進這家中國科技公司的Qwen模型。
Anthropic稱,在 2026年5月至 7月期間, 該公司觀察到超過1.51億次被歸因於阿里巴巴的 交互,其中來自其描述為 欺詐性的3,500 多個賬戶的 交互量達到峯值,日均近300萬次。
「蒸餾」是指利用更大、更昂貴的模型的輸出結果來訓練較小的AI模型,以此降低訓練新AI工具的成本。
Anthropic指控稱 ,Kimi聊天機器人開發者Moonshot和DeepSeek並未進行批量查詢,而是將實時客戶 對話(其中有時包含敏感信息)通過Claude進行轉發, 並將其響應作為訓練數據使用。
Anthropic稱,一個其作案手法與 總部位於俄羅斯的威脅行為體「午夜暴風雪」(Midnight Blizzard)相符 的黑客組織,據稱針對烏克蘭政府、軍事和外交目標實施了網絡釣魚、酒店Wi-Fi劫持以及WhatsApp賬戶接管行動,並在幾乎每個階段都使用了AI技術。
據稱, 該組織利用人工智能構建了一個系統,該系統能 自動檢測其惡意軟件何時被安全防禦系統標記,並不斷重寫代碼,直至再次規避檢測。