
美中AI競爭8日突然從晶片管制進入「模型能力遭大量抽取」的新戰場。美國國家安全局(NSA)、聯邦調查局(FBI)及網路安全暨基礎設施安全局(CISA)聯合發布資安警告,直接點名DeepSeek、月之暗面(Moonshot AI)、阿里巴巴、MiniMax、階躍星辰(StepFun)與Z.AI等6家中國AI公司,指控這些企業自2024年底以來,對美國最先進AI模型進行「工業規模」的知識蒸餾。
美國政府的指控非常具體。聯合報告指出,6家公司透過數百萬次請求與互動,抽取數十億個token,目標涵蓋Anthropic的Claude、OpenAI的GPT、Google的Gemini及xAI的Grok等模型。報告甚至寫道,這些活動「很可能是在中國政府知情情況下」進行。不過這是美國情報與安全機關的判斷,目前並非經法院認定的事實。
DeepSeek拿來訓練R1、V3 阿里巴巴用來強化Qwen
報告指控DeepSeek自2024年底便有組織地針對美國模型抽取推理能力、法律專業、軟體工程及Agent功能,用來訓練R1與V3;阿里巴巴則被指利用Claude與GPT等模型改進Qwen系列的程式設計、客服對話、虛擬角色及Agent能力。
月之暗面、MiniMax、階躍星辰與Z.AI也被逐一列出。美方甚至主張,Z.AI到今年年中已從GPT及Claude系列模型蒸餾數十億token,用來發展推理能力。
需要區分的是,「知識蒸餾」本身並不是非法或罕見技術。AI產業本來就會讓較小模型學習大型模型產生的資料,以降低訓練成本。美國這次指控的重點,是中國企業被指以大規模、自動化方式繞過使用限制,系統性取得原本受到限制的模型能力,並違反供應商使用條款。NSA也明確承認蒸餾本身是正常而有用的AI研究方法。
美方指還用「轉接站」躲避追蹤
聯合報告描述的手法包括大量購買高階訂閱帳戶、利用假帳號、第三方API聚合平台,甚至透過俗稱「轉接站」的灰色API代理市場,繞過美國模型業者的地區限制與追蹤機制。部分公司還被指使用提示注入、越獄及試圖抽取模型推理資訊等方法。一旦某個管道遭封鎖,系統便自動切換到其他來源。
美國三個安全機關認為,這種模式可讓中國AI公司不用承擔相同規模的算力、電力與基礎研究成本,就快速縮短與美國前沿模型的技術差距,進而強化軍事、網攻與關鍵基礎設施相關能力,因此要求美國模型業者、雲端平台及API服務商建立跨公司情報共享與異常行為偵測機制。
時間點尤其敏感。這份報告在川普與習近平預定本月會面前幾週公開,美中原本就準備討論AI安全與科技管制議題。過去美中AI戰的焦點主要是NVIDIA晶片、先進製程與設備能不能出口中國;現在華府把「模型能力本身」也正式納入國安範圍,美中科技戰正在從限制中國取得算力,進一步走向限制中國取得美國AI模型的知識與能力。
(圖片來源:AI生成)










