
AI資安威脅已經跨過一條重要界線。Anthropic 9月10日公布最新《Threat Intelligence》威脅情報報告,揭露過去8個月攔截多起涉及Claude模型的惡意行動,最重要的發現不是駭客「拿AI幫忙寫程式」,而是人工智慧開始被接進多代理框架,從釣魚、惡意程式修改、突破防毒偵測,到竊取帳號與情報蒐集,在攻擊鏈裡自行完成愈來愈多步驟,人類操作者反而逐漸退到後方,負責下達目標與監督。
Anthropic表示,公司這段期間阻斷的行動同時來自國家背景駭客、網路犯罪集團,以及企圖大量取得Claude能力的中國AI實驗室。公司點名阿里巴巴、Moonshot AI、DeepSeek、小米等7家中國相關AI實驗室或其操作帳戶;其中規模最大的一起,是Anthropic歸因於阿里巴巴相關操作者的「非法蒸餾」行動。
從今年5月至7月,Anthropic觀察到超過1億5100萬次Claude交互,最高一天逼近300萬次,使用超過3500個Anthropic認定為欺詐的帳戶,目的被指是大量抽取Claude能力,再用來強化阿里巴巴Qwen模型。阿里巴巴截至報導發布時沒有立即回應。
所謂「蒸餾」本身並不是非法或異常技術。AI公司經常使用能力較強的大模型產生資料,再訓練成本較低的小模型;真正的爭議在於,競爭者若透過假帳號、大量自動查詢或繞過服務限制,把另一家公司模型的能力成批抽走,就可能用遠低於自行訓練前沿模型的成本,複製競爭對手的推理、編碼與專業能力。
Anthropic今年2月就曾揭露DeepSeek、Moonshot與MiniMax約2萬4000個欺詐帳戶、超過1600萬次交互;9月公布的新資料顯示,規模已經從千萬級暴增到上億級。
更敏感的是Moonshot與DeepSeek的做法。Anthropic指控,兩家公司相關操作並非單純製造大量測試題詢問Claude,而是把真實使用者與自家聊天機器人的對話轉送給Claude,再把Claude的回答當成模型訓練資料,其中部分使用者對話可能含有敏感資訊。
這使問題不只有智慧財產權,也碰到使用者資料究竟是否在不知情的情況下,被送進另一家美國AI公司的系統。這些內容目前屬Anthropic的調查與歸因,並非司法機關完成認定的事實。
俄羅斯駭客把AI接進幾乎整條攻擊鏈
另一條更直接涉及國家安全。Anthropic表示,一個作戰手法與俄羅斯駭客組織Midnight Blizzard高度一致的集團,利用Claude對烏克蘭政府、軍方及外交部門展開網路間諜行動。Midnight Blizzard是微軟使用的追蹤名稱,美國政府過去已把這個組織與俄羅斯對外情報局SVR連結。
這批攻擊不只讓AI協助產生釣魚信。Anthropic調查發現,攻擊者把AI用在釣魚、旅館Wi-Fi劫持、WhatsApp帳戶接管及惡意程式修改等不同階段,甚至建立一套自動化機制:一旦惡意程式遭安全軟體辨識,系統就讓AI重新改寫程式碼,再反覆測試,直到可以避開防毒偵測。
換句話說,AI開始承擔過去必須由具有專業技能的駭客一輪又一輪手動完成的工作。
Anthropic威脅情報主管Jacob Klein指出,真正令人警戒的是模型能力在一年之內快速跳升。過去若要利用AI最佳化無人機或飛彈控制軟體,模型能力仍有限;現在前沿模型已明顯更擅長這類工作。
Anthropic這次也發現中國、俄羅斯與葉門相關操作者利用Claude協助傳統武器軟體開發,範圍包括槍械、飛彈、武裝無人機、炸彈與其他彈藥,以及相關瞄準、控制系統、情報蒐集與武器採購。
報告還點名近來極活躍的網路犯罪集團ShinyHunters相關行動。Anthropic表示已偵測並中止部分關聯帳戶。
這些案例共同指向一個變化:AI降低的不只是寫惡意程式的門檻,而是讓攻擊者可以同時操作更多目標、更快修改攻擊方式,並讓原本需要一整個駭客團隊才能完成的工作,被少數操作者搭配多個AI代理大量執行。
真正的威脅是「人變成監工」
Anthropic在報告中形容,惡意使用AI已經超過傳統「聊天機器人問答」,開始出現由多個AI代理彼此分工執行任務的框架。
人類角色也跟著改變:不是每一步親手入侵,而是設定攻擊目標、查看結果,再讓AI完成偵察、修改工具、尋找漏洞與規避防禦。
這和Anthropic今年6月整理逾1萬3000筆AI惡意活動時得到的結論一致——未來區分高風險與低風險攻擊者的關鍵,可能不再是駭客本人的技術有多強,而是他能不能有效「指揮一群AI代理」。
這份報告公布的時機也非常敏感。美國政府9月8日才公開指控包括DeepSeek、Moonshot AI與阿里巴巴在內的中國AI公司,利用蒸餾方式「工業規模」取得美國模型能力;美中又正討論在9月中旬建立首次專門的AI安全對話,其中一項議題就是AI自主代理發動跨境網攻。
也就是說,AI已不只是下一輪科技產業競爭,而開始同時成為美中科技戰、情報戰、軍事軟體與國家級網路攻防的新戰場。
真正需要警戒的已不是「駭客會不會用AI」。這件事早已發生。
Anthropic最新報告揭露的新階段,是AI開始能替駭客自行完成更長、更複雜的攻擊流程,人類從實際操作者退到指揮與監督位置。一旦模型能力、網路存取權限與多代理協作繼續進步,未來網路攻擊的速度、規模與自動化程度,都可能遠超過現有資安體系按照「一群人攻擊另一群人」所設計的防禦方式。

