美Anthropic報告稱中國AI公司蒸餾美國大模型,中國發現蒸餾安全隱患,國內數據被洩露,包括利用美國AI模擬攻台。
美國人工智能公司Anthropic九月十日發布《檢測與打擊AI濫用》威脅報告,在中美雙方都產生巨大影響。美國驚呼自己的AI能力被「抽走」,而中國則發現,蒸餾國外模型存在巨大安全隱患——有人把監控錄像交給自以為在用的 Kimi,但請求被轉到 Claude;另有公安系統、境外數據庫憑證等被轉發,乃至模擬攻台都被傳至美國AI來分析。中國高層震怒之際,不但發文要求重視AI安全,更開始調查AI公司洩密情況。
Anthropic報告稱識別並阻斷了針對Claude模型的多起「未經授權蒸餾」活動,並以高置信度將其中一部分歸因於七家中國實驗室或企業。被點名的是:阿里巴巴通義實驗室(Qwen)、月之暗面(Moonshot AI,Kimi)、深度求索(DeepSeek)、智譜、小米、商湯,以及MiniMax。
蒸餾本身並非新概念。業內通行做法是:用更強模型的輸出去訓練更小、更便宜的模型,以降低訓練成本,但大規模蒸餾閉源模型而彎道超車,在業界仍有爭議。
按Anthropic的報告,規模最大的一波與阿里巴巴相關。二零二六年五月至七月,可歸因交互超過一點五一億次,峰值接近每日三百萬次,賬號池超過三千五百個。目標不是閒聊,而是系統蒸餾Opus的思維鏈。報告還稱,部分代理網絡同時為其他實驗室「帶流量」。
月之暗面則採取另一種方法:不是只刷假賬號,而是把本應走Kimi的用户請求轉給Claude,再把回答以Kimi的口吻交回用户。報告稱五月至七月相關交互超過兩千三百萬次;其中一個十天窗口裏,約五千個賬號轉發了近三十萬條真實請求。Anthropic威脅情報負責人後來對媒體說,用户「無從得知自己與Kimi的對話被轉給了Claude」。
DeepSeek被指採用相近手法;智譜被描述為搭建思維鏈提取與「清洗」流水線;小米被指把MiMo上已有的對話和編程會話回放給Claude;商湯被寫成向第三方數據商購買Claude對話記錄;MiniMax則被指通過表面關聯不強的殼公司運營中轉,且該通道主要提供Anthropic與OpenAI模型。
以上均為Anthropic單方歸因與技術研判,被點名企業多數未作逐條公開回應。蒸餾、代理、評測、中轉在全球AI產業裏並不罕見,爭議在於規模、是否告知用户、以及數據最終落在何處。
同期,美國國家安全局、聯邦調查局與網絡安全和基礎設施安全局也發布聯合提示,指部分中國公司對美方前沿模型開展「工業級蒸餾」,點名名單與Anthropic不完全重合,另有階躍星辰(StepFun)等。兩邊口徑接近,證據標準仍是美方機構與廠商自己的日誌與歸因。
中國政府對數據安全非常重視,這次AI蒸餾引發的洩密震動高層。九月十三日,《中國網信》雜誌公眾號刊發國家安全部部長陳一新署名文章《全面築牢人工智能安全屏障 推動人工智能健康有序發展》。文章把人工智能稱作全球科技競爭的主戰場、大國戰略博弈的新賽道,同時列出六類風險:系統性影響政治安全環境、顛覆性升級網絡攻防、規模性放大竊密洩密、壟斷加劇發展失衡、衝擊社會治理、改變軍事鬥爭形態。
與本次報告最直接咬合的,是第三條:規模性放大竊密洩密風險。陳一新寫到,國內部分用户安全意識不足,使用境外人工智能產品處理敏感信息並向境外輸出數據,造成境內數據大規模外洩。文章要求加快構建風險防治體系,堅持黨管互聯網、黨管數據,以高水平安全推動產業有序發展。
台十二目標被模擬攻擊
這篇署名文章沒有具體點名,但是這次Anthropic的報告,明確指出中國AI公司把國內用户的機密信息路由到境外模型來分析,而國內用户毫不知情。報告提到,一名據其評估位於中國、與國防軍工研究相關的使用者,用 Claude 的對話、編程和智能體工具,迭代開發一套約十六個模塊的中文電子戰/防空壓制軟件(分析雷達、地空導彈陣地、指揮所、通信節點,評估干擾效果並給目標排序)。項目進行到中途,對方把模擬的默認場景改成了台灣境內十二個目標,報告點名的類型包括:指揮掩體、預警雷達站、愛國者與天弓陣地、主要空軍基地、一處區域作戰指揮部。Anthropic的標記內容顯示,該行為體與包括解放軍軍事科學院在內的研究機構有關聯;相關賬號已被封禁。報告沒有聲稱這套軟件已實戰部署。
報告在社交媒體上引爆後,不但引發外界質疑中國AI公司的模型能力,中國也有網友要求追究數據洩露問題。有傳聞指月之暗面公司高層被帶走調查,月之暗面官方正式闢謠並表示已第一時間向公安機關報案。

