美國AI公司指責中國競爭對手非法蒸餾其技術

Ariel Davis

開發人工智慧系統的美國公司正在大聲抱怨,指責他們的中國競爭對手在不公平地抄襲其技術,並正懇求官員們採取措施予以應對。
6月10日,Anthropic 致信 參議員蒂姆·史考特和伊麗莎白·沃倫,指責中國科技巨頭阿里巴巴利用一種被稱為「蒸餾」的技術,祕密抄襲其人工智慧技術。
據《紐約時報》看到的這封信函顯示,與其他中國公司一樣,阿里巴巴在通過數萬個未經授權的帳戶使用Anthropic的技術。隨後,它利用收集到的數據訓練自己的AI系統。Anthropic請求這兩位的議員共同探討如何遏制中國的模型蒸餾。兩人領導著一個即將就AI舉行聽證會的參議院委員會。
「這些蒸餾攻擊是以非法、系統化且工業級的規模進行的,旨在從各家前沿實驗室中竊取美國的AI能力,並將其重新包裝為自己的成果,」Anthropic在給兩位參議員的信中寫道,這裡所指的是處於人工智能開發最前沿的公司。
專家表示,中國在人工智慧開發方面僅落後美國大約六個月。Anthropic和其他美國公司辯稱,如果沒有蒸餾技術的幫助,中國會落後得更遠,這可能會影響到商業規劃、藥物研究、大規模監控以及軍事武器等AI的核心應用領域。
隨著中國初創公司智譜AI(Z.ai)發布了一款 實力幾乎與美國頂級系統齊平 的AI模型GLM-5.2,他們的抱怨變得愈發迫切。該模型在網路安全應用方面可與美國系統相媲美,而這一領域正是美國AI公司和川普政府強調的對地緣政治至關重要的領域。
但究竟什麼是「蒸餾」?難道只有中國公司在這麼做嗎?以下是相關解析。
絕非如此。蒸餾技術在科技行業普遍存在 已超過十年。谷歌的一個小型研究團隊在2010年代初期 首次開發了這項技術 ,以此 來構建更高效的AI系統。
通過蒸餾,研究人員可以從一個特別強大的系統中收集數據,並利用這些數據來構建一個可以在更便宜的硬件上運行的系統。
曾參與開發該技術的前谷歌研究員傑弗里·辛頓表示,第一個AI模型本質上是在向第二個模型示範如何表現。他說:「可以把一個模型看作老師,另一個看作學生。」
人工智慧先驅傑弗里·辛頓曾是在谷歌AI蒸餾技術的開發人員之一。
人工智慧先驅傑弗里·辛頓曾是在谷歌AI蒸餾技術的開發人員之一。 Chloe Ellingson for The New York Times
沒錯。但一些公司利用蒸餾來模仿其他AI實驗室構建的技術。它們經常複製開源技術的行為——開源技術是指任何人都可以 免費使用、修改和複製 ,且基本上不受限制的系統。
這正是各家實驗室在開源其系統時所希望推動的。其核心理念是,由於人工智慧能夠更快速地發展,每個人都能從中受益。
當其他公司利用蒸餾來模仿其專有系統(即非開源技術)的行為時,Anthropic、OpenAI和其他AI實驗室就會感到惱火。這些系統通常是它們最強大的系統。
根據服務條款,Anthropic和OpenAI不允許對其領先系統進行蒸餾。但對這些系統進行蒸餾的現象依然屢見不鮮。
今年4月,伊隆·馬斯克在加利福尼亞州奧克蘭的一場聯邦審判中作證時, 承認了 他的AI公司xAI存在這種做法。當律師詢問xAI是否曾對OpenAI的技術進行過蒸餾時,馬斯克回答道:「AI公司 一般都會蒸餾其他AI公司的技術。」
伊隆·馬斯克在加利福尼亞州奧克蘭的聯邦法院,他於4月在此承認xAI使用了蒸餾技術。
伊隆·馬斯克在加利福尼亞州奧克蘭的聯邦法院,他於4月在此承認xAI使用了蒸餾技術。 Jason Henry for The New York Times
專門從事商業祕密訴訟的貝克-里德-萊登律師事務所合伙人薩拉·蒂什勒表示,目前這一點還不明確。
一些法律學者辯稱,這種做法違反了2016年出台的《保護商業祕密法》,該法律允許企業就商業祕密被竊取提起訴訟,但法院尚未對此做出明確裁決。
版權法並不一定適用,因為蒸餾是為了複製系統的行為,而不是逐字逐句地複製文本。
中國公司具體在做什麼也並非完全透明。它們很可能以與美國公司(如xAI)極為相似的方式對專有模型進行了蒸餾。
然而,中國的蒸餾舉動在Anthropic、OpenAI等美國公司中引發了深得多的擔憂。
大約18個月前,中國初創公司DeepSeek向矽谷展示了它能以 比許多美國同行低得多的成本構建出高效的AI ,這引發了矽谷的震動。OpenAI很快便 指責DeepSeek 蒸餾了其技術。
今年2月,Anthropic指責DeepSeek和另外兩家中國初創公司從其系統中不當獲取了大量數據。Anthropic表示,這些初創公司 利用了大約24000個帳戶 ,與其Claude聊天機器人進行了超過1600萬次對話,這些對話可用於向它們自己的聊天機器人傳授技能。
Anthropic指責DeepSeek以及另外兩家中國初創公司竊取了其大量的專有數據。
Anthropic指責DeepSeek以及另外兩家中國初創公司竊取了其大量的專有數據。 Eric Helgas for The New York Times
Anthropic密切監控著人們對其系統的使用情況。該公司表示,某些重複性的行為表明,與中國有關聯的帳戶正在從其專有模型中竊取數據。
Anthropic聲稱,多家中國公司利用了一個帳戶網路來接入其系統。Anthropic指出,每家中國公司都利用這些數據來幫助訓練它們自己的技術。
Anthropic、OpenAI和谷歌表示,它們正在 共享信息 ,以便共同打擊這種行為。但這很難杜絕。如果Anthropic封禁了過多的帳戶,最終可能會把合法的用戶也拒之門外。
蒂什勒指出,即使美國法律確實禁止非法蒸餾,也很可能對中國境內的行為產生不了什麼影響。
「這種行為有太多是發生在美國境外了,」她指出。「通過美國法院來解決這一問題將會極其困難。」
(《紐約時報》於2023年對OpenAI和微軟 提起訴訟 ,指控其在人工智慧系統相關的新聞內容上存在版權侵權行為。這兩家公司均否認了這些指控。)
Anthropic5月在舊金山展示AI智能體Claude Cowork。
Anthropic5月在舊金山展示AI智能體Claude Cowork。 Jason Henry for The New York Times
Anthropic呼籲國會通過立法,允許「在美國政府與領先的前沿實驗室之間,以及前沿實驗室彼此之間開展更深入的合作,以打擊蒸餾攻擊」。
該公司還表示,美國政府應當加大力度限制中國獲取訓練AI技術所需的專用電腦晶片。世界上最強大的晶片均由美國公司設計,聯邦政府一直在利用 出口管制 來遏制這些晶片流入中國。沒有這些晶片,進行蒸餾也會變得很困難。
阿里巴巴拒絕就Anthropic致兩位參議員的信函發表評論。麻薩諸塞州民主党參議員沃倫同樣拒絕置評。南卡羅來納州共和黨參議員史考特未回應置評請求。
許多專家認為,打擊中國的蒸餾行為不會有什麼效果,而且單憑蒸餾技術是無法構建出像智譜AI那樣頂尖的AI系統的。
另一些人則認為,隨著各大公司開始構建旨在充當 AI智能體(agent) 的系統,蒸餾技術的重要性將會降低。訓練這些智能體(即能夠利用其他軟體來執行任務的數字助手)的難度極大,很難通過蒸餾來複制。
AI研究實驗室Adaption的首席執行官薩拉·胡克表示,蒸餾「對下一個AI時代來說將不再那麼重要」。

Ryan Mac自洛杉磯、Eli Tan自舊金山、Steve Lohr自紐約對本文有報導貢獻。

Cade Metz 撰寫有關人工智慧、無人駕駛汽車、機器人、虛擬現實和其他技術新興領域的新聞。

翻譯:紐約時報中文網

點擊查看本文英文版。

Menu