白宮官員宣稱,月之暗面(Moonshot AI)的 Kimi K3 模型是由 Anthropic 的 Claude Fable 模型「蒸餾」(distillation)而來,並進一步於泰國,運用 NVIDIA GB300 進行訓練。
「我們握有情資顯示,月之暗面為開發 K3 模型,對 Anthropic 的 Fable 進行蒸餾」,白宮科技政策辦公室(Office of Science and Technology Policy,OSTP)主任 Michael Kratsios 表示。
「為達成此事,他們開發出一套精密的內部平台,用於針對美國各款模型進行大規模的蒸餾行為,讓他們能快速在多種存取方式之間切換,規避偵測。」Michael Kratsios 進一步表示,「月之暗面同時已取得配備 GB300 的伺服器,並曾於泰國使用 GB300,可能是為了訓練 AI 模型。」
由於 Anthropic 曾在今年 2 月揭露月之暗面以蒸餾手法,非法擷取 Claude 模型能力,如此戲劇性發展似乎不令人意外。但關鍵是由政府高層釋出 2 個重要訊號,點名最新 Kimi K3 由 Claude 蒸餾而來,並運用頂尖的 NVIDIA GB300 進行訓練。
Michael Kratsios 指出,美國強力支持 AI 自由且公平的發展,其中包括一個橫跨先進模型、專用系統、開源框架及開源權重模型的蓬勃發展生態系。用於打造更小型、更具效率模型的正當 AI 蒸餾行為,在這個開放創新生態系中扮演著相當重要的角色。「然而,目的在竊取美國專有技術、並損害美國研究成果的大規模、隱匿的產業級蒸餾行為,是不被接受的」,他說。
月之暗面之所以能規避偵測,是透過多種存取方式之間快速輪替,同時不斷向 Anthropic 的模型發出查詢請求。不只如此,月之暗面運用 NVIDIA GB300 強大能力,使其蒸餾行為的效率進一步提升。
綜合近期報導,中國各家 AI 實驗室有對美國先進模型進行蒸餾的傾向,似乎讓川普政府內部激起怒火,業界自有不同做法防範蒸餾,而政府層級還未有沒有明確措施遏止。Michael Kratsios 的說法意味著川普政府對此事越來越重視,可望有進一步行動。
(首圖來源:Kimi.ai)






