0
| 本文作者: 高允毅 | 2026-06-25 23:02 |

作者丨高允毅
編輯丨馬曉寧

01
短短四個月,四家中國頂級AI公司被Anthropic接連點名,且沒有停手的跡象。
這一次,輪到阿里。
2026年6月10日,Anthropic向美國參議院銀行委員會遞交了一封信,矛頭直指阿里Qwen團(tuán)隊。報告披露了一串?dāng)?shù)字:從4月22日到6月5日,整整45天,阿里相關(guān)運營者利用2.5萬個賬號,完成了2880萬次交互。
這是Anthropic迄今公開的最大規(guī)模“模型蒸餾”數(shù)據(jù)。
2880萬次對話是什么概念?放一個行業(yè)參照:目前主流的高質(zhì)量SFT(監(jiān)督微調(diào))數(shù)據(jù)集,規(guī)模通常在數(shù)十萬到幾百萬條之間。2880萬次針對核心能力的定向交互,足以在特定任務(wù)域內(nèi),低成本“提純”出一個極具競爭力的專用模型。
這引起了Anthropic的高度警惕。在他們看來,對方的行為目標(biāo)極其精準(zhǔn),刀刀直指其最新旗艦?zāi)P?Mythos Preview 的核心底牌,軟件工程與智能體推理能力。
Anthropic在信中將其定性為“迄今為止,中國公司試圖搭美國頂尖實驗室便車的最大規(guī)模嘗試”。
梳理時間線可以發(fā)現(xiàn),Anthropic的反擊正在顯著升級。
2026年2月23日,Anthropic發(fā)布了一篇博客文章《Detecting and Preventing Distillation Attacks》,公開點名三家中國AI實驗室:DeepSeek、月之暗面(Kimi)、MiniMax(稀宇科技)。
報告顯示,約2.4萬個中國相關(guān)賬號對Claude發(fā)起了超過1600萬次交互,其中MiniMax超1300萬,月之暗面超340萬,DeepSeek超15萬。
從1600萬次到2880萬次,規(guī)模在翻倍,Anthropic的反擊,也從2月份的“技術(shù)曝光”,升級到6月份“政治施壓”。
而這次的收信人,銀行委員會主席蒂姆·斯科特(Tim Scott)和首席成員伊麗莎白·沃倫(Elizabeth Warren),可以說是美國政壇里專門負(fù)責(zé)“對外經(jīng)濟(jì)制裁”和“對內(nèi)金融監(jiān)管”的兩個狠角色。

02
Anthropic的應(yīng)對策略,從一開始就不是打官司,而是推動立法。
據(jù)彭博社報道,信件遞交后,美國參議員比爾·哈格蒂和安迪·金迅速跟進(jìn)。他們計劃推動一項修正案并納入《國防法案》:對任何“不當(dāng)獲取美國AI模型輸出以訓(xùn)練競爭系統(tǒng)”的中國公司,實施嚴(yán)厲制裁或直接列入黑名單。
事實上,不僅是在白宮,整個硅谷也在結(jié)成防御同盟。Anthropic、OpenAI 和谷歌已經(jīng)暗中聯(lián)手,開始共享關(guān)于違規(guī)數(shù)據(jù)抓取的情報。
在海外媒體報道中,美國官員曾做出過一個估計,這種未經(jīng)授權(quán)的“工業(yè)級”蒸餾活動,每年給硅谷實驗室造成的損失高達(dá)數(shù)十億美元,直接威脅著Anthropic即將到來的天價IPO。
所以,借由這一次次越發(fā)嚴(yán)厲的指控,Anthropic真正想拿到的,不只是一家公司的商業(yè)維權(quán),而是要在美國政界與產(chǎn)業(yè)界確立一條新的絕對紅線:用API輸出訓(xùn)練競爭模型,就是越界違法。
而在這場全方位的圍堵中,美國政府的技術(shù)封鎖也在急劇收緊,與前段時間業(yè)內(nèi)轟轟烈烈的“Fable 5 與 Mythos 5 緊急下架”事件暗中呼應(yīng)。
與國會山上的劍拔弩張不同,在開發(fā)者聚集的Reddit等技術(shù)論壇上,面對Anthropic的控訴,技術(shù)圈的反應(yīng)堪稱群嘲。
最經(jīng)典的就是“賊喊抓賊”的戲碼。有人指出,Anthropic 自己就是靠“偷數(shù)據(jù)”起家的。早期訓(xùn)練模型時,它因抄襲并非法下載數(shù)百萬冊受保護(hù)的書籍,曾陷入美國歷史上規(guī)模最大的 AI 侵權(quán)盜版案,最終被迫吞下 15 億美元的天價和解金。
連馬斯克都曾在今年2月份公開貼臉開罵,在Anthropic指控中國的 DeepSeek、月之暗面(Kimi)以及 MiniMax發(fā)起蒸餾攻擊,直指 Anthropic 才是北美最大的“偷子”,偽善又虛偽。


還有網(wǎng)友直接翻出了業(yè)內(nèi)的著名回旋鏢,此前 Anthropic 發(fā)布的 Claude 4.8 模型在回答,透露自己其實是“由阿里巴巴開發(fā)的Qwen模型”。“業(yè)內(nèi)互相洗數(shù)據(jù)、抄來抄去早已是常態(tài),你身上流著通義千問的血,回過頭來告阿里抄襲?”

還有網(wǎng)友表示,如果是正常的付費使用,那和其他普通用戶的區(qū)別在哪,這只能算商業(yè)違約,怎么到了國會嘴里就變成‘惡意網(wǎng)絡(luò)攻擊’和‘危害國家安全’了?”

更有技術(shù)流網(wǎng)友對 Anthropic 的高管能力表示鄙視:“遇到技術(shù)漏洞不想著怎么提升自家的 AI 防御層和反抓取能力,天天只知道跑去和特朗普政府打小報告。”
最讓人啼笑皆非的卻是一位重度用戶的哀嚎:“我真正關(guān)心的只有 Fable 5 還能不能回來?Anthropic 現(xiàn)在一邊和白宮打小報告哭訴模型被抄,一邊又希望模型解禁。照這個趨勢看, Fable 5 大概是回不來了。”



03
再看技術(shù)層面,整場指控的核心落在一個詞上:“對抗性蒸餾”。
什么是對抗性蒸餾?簡單來說,就是借別人的腦子,替自己省錢。
原本,“蒸餾”是AI訓(xùn)練中的正常操作:用一個已有的強(qiáng)大模型當(dāng)“老師”,讓它回答問題,然后把“老師”的答案拿過來,訓(xùn)練一個更輕量的“學(xué)生”模型。學(xué)生模型只學(xué)到了老師回答問題的能力,但訓(xùn)練成本只有老師的一小部分。
Meta 的 LLaMA 早期版本用 ChatGPT 的輸出來訓(xùn)練自己,這在行業(yè)里不是秘密。
而 Anthropic 控訴的“對抗性蒸餾”,則是將這套思路發(fā)揮到了極致。不需要自己花幾十億美元買算力、自己做數(shù)據(jù)標(biāo)注,只需要持續(xù)、大量地向目標(biāo)模型發(fā)送精心設(shè)計的問題,把它的高質(zhì)量回答批量保存下來,就擁有了一個現(xiàn)成的訓(xùn)練樣本庫。
這可省了一大筆錢。按Claude的公開API定價粗算,2880萬次交互的費用,哪怕按企業(yè)折扣計,也要幾百萬美元。但與從零開始訓(xùn)練一個具備同等軟件工程能力的大模型相比,這筆數(shù)字可能只是預(yù)算單上的零頭。
這就是Anthropic憤怒的主要原因,對方跳過了多年的技術(shù)積累和巨額投入,用幾百萬美元的調(diào)用成本,拿到了價值數(shù)十億美元的能力。
而Anthropic在報告中特意強(qiáng)調(diào)另一個問題,直指“安全”。
AI模型的核心能力分為兩種,訓(xùn)練方式截然不同:
一種是“干活能力”,比如寫代碼、做數(shù)學(xué)題、寫文案......只要給足標(biāo)準(zhǔn)答案,模型就能快速學(xué)會,這部分能力是可以被“蒸餾”的。
另一種是“安全對齊”,比如知道不該泄露用戶隱私、不該協(xié)助犯罪、不該輸出危險內(nèi)容。這些安全規(guī)則不是靠反復(fù)刷題學(xué)來的,而是通過一套極其精細(xì)的“行為矯正”訓(xùn)練建立起來的。每一次模型試圖越界,就會被訓(xùn)練師懲罰并矯正。
但蒸餾的過程,只復(fù)制成功,不復(fù)制拒絕。
在導(dǎo)出的2880萬次對話里,那些被系統(tǒng)攔截、拒絕回答的高危問題,全被過濾掉了。結(jié)果就是,學(xué)生模型只學(xué)會了頂級的能力,卻沒學(xué)到“什么不該說”。一旦部署到真實世界中,能力越強(qiáng),失控的結(jié)果也會越嚴(yán)重。

04
而在“對抗性蒸餾”的暗面,則涉及到“API安全”。
這次Anthropic能檢測出這25000個異常賬號,其實依賴的是“行為模式分析”,即找“破綻”。比如這些賬號的注冊時間過于集中、IP地址在地理位置上異常扎堆、提問的內(nèi)容高度相似,且請求頻率快得根本不像人類。
但這只是初級防御。當(dāng)下,部分頂級AI實驗室,已經(jīng)在落地一種更具殺傷力的武器,叫"輸出指紋"技術(shù)。它如同“隱形水印”,它會在模型的每一次輸出中嵌入統(tǒng)計學(xué)層面的隱性標(biāo)記,只要有人拿這些內(nèi)容去訓(xùn)練新模型,日后一經(jīng)檢測,就能被精準(zhǔn)溯源追蹤。
然而在真實的工程世界里,防御天然滯后于進(jìn)攻。
所謂“道高一尺,魔高一丈”。今天你封禁了25000個賬號,明天對方就可以用無數(shù)個不同的虛擬信用卡和動態(tài)代理IP,分散注冊;你通過分析查詢模式來抓機(jī)器賬號,對方就可以在代碼里刻意加入像真人一樣的停頓和廢話來做偽裝;你種下隱形的“輸出指紋”,對方就能通過二次改寫、翻譯和增噪,把這些指紋徹底“洗”掉。
這場貓鼠游戲沒有技術(shù)終局,只有成本的此消彼長。
但如果制裁清單落地,游戲規(guī)則就變了。到那時,這就不再是一個單純的“反爬蟲”或“API攻防”的技術(shù)問題,“誰的模型訓(xùn)練數(shù)據(jù)來自哪里”,將直接成為極其嚴(yán)苛的監(jiān)管審查對象。
對所有在LLM工程鏈條上工作的人來說,這個結(jié)果將直接決定未來的合規(guī)邊界:哪些數(shù)據(jù)來源是合法的?哪些模型的行為會被秋后算賬?又有哪些公司,會因為訓(xùn)練數(shù)據(jù)“來路不明”而直接被列入致命的黑名單?
這才是 Anthropic 真正的野心所在——在廢墟上建立一套由它定義、并由政治力量執(zhí)行的全球 AI 新秩序。
參考鏈接:
https://www.bloomberg.com/news/articles/2026-06-24/anthropic-accuses-alibaba-of-illicitly-accessing-its-ai-models
https://www.reddit.com/r/ClaudeAI/comments/1uexovy/anthropic_allegations_of_unauthorised_access_by/


上車,雷峰網(wǎng)(公眾號:雷峰網(wǎng))帶你看遍全球 AI 頂會精華
可獨家暢覽:
專家演講PPT
大會報告全文
熱門論文解讀
學(xué)術(shù)新星訪談

掃描上方二維碼
或點擊「閱讀原文」關(guān)注專區(qū)。
雷峰網(wǎng)原創(chuàng)文章,未經(jīng)授權(quán)禁止轉(zhuǎn)載。詳情見轉(zhuǎn)載須知。