Kimi K3 被白宮點名「偷師」Claude!開源權重 7/27 還會上架嗎?免費用戶受影響嗎?(2026 完整解析)

0
19 人次

Kimi K3 被白宮點名「偷師」Claude!開源權重 7/27 還會上架嗎?免費用戶受影響嗎?(2026 完整解析)

前陣子才公開的 Kimi K3(史上最大的 2.8 兆參數開源模型),最近的新聞真的是一波接一波:先是紅到暫停新付費訂閱,這兩天又直接登上國際頭條——不過這次不是因為跑分,而是因為美國白宮親自出面點名

白宮科技政策辦公室(OSTP)主任在 2026 年 7 月 22 日公開指控:Kimi K3 是靠「大規模、隱蔽的工業級蒸餾」抄襲 Anthropic 的 Claude Fable 模型做出來的,甚至還用了被禁止出口到中國的高階 NVIDIA 晶片。消息一出,AI 圈吵翻天,因為不少專家覺得這說法「時間上根本兜不攏」。

這件事聽起來像是大公司跟政府之間的恩怨,但其實跟我們一般用戶很有關係:Kimi 免費版還能不能用?說好 7/27 要上架的開源權重還會來嗎?美國真的會禁掉中國的開源模型嗎?阿正老師這篇就帶大家把整件事看懂。



一、發生什麼事?白宮的兩大指控

先快速交代背景:Moonshot AI(月之暗面)在 7/16 發布 Kimi K3,2.8 兆參數、跑分衝到全球第三,只輸給 Claude Fable 5 Max 跟 GPT-5.6 Sol Max,紅到官方一度暫停新付費訂閱。結果就在 7/22,美國白宮科技政策辦公室(OSTP)主任 Michael Kratsios 在 X 上發文,直接對 Moonshot AI 開砲。

image_78CC8C12

指控主要有兩點:

第一,「工業級蒸餾」偷師 Claude。Kratsios 聲稱 Moonshot 打造了一套內部平台,可以對美國的 AI 模型進行系統性「蒸餾」(distillation),還會快速切換不同的存取方式來躲避偵測。他的原話是:「大規模、隱蔽的工業級蒸餾,目的是竊取美國專有技術、傷害美國研究,這是不可接受的。」美國財政部長 Scott Bessent 也跟進放話,說「我們在許多中國模型上發現了美國大型語言模型的浮水印」——不過所謂「浮水印」到底是什麼,官方並沒有說明。

第二,使用禁運晶片。Kratsios 同時指控 Moonshot 取得了被禁止出口到中國的 NVIDIA 高階 AI 晶片(Grace Blackwell 300),並在泰國使用搭載 GB300 的伺服器進行訓練。

值得注意的是,Anthropic 今年稍早確實曾公開指控 Moonshot、DeepSeek 與 MiniMax 系統性蒸餾它的模型,並表示發現了超過 340 萬次透過假帳號進行的 Claude 對話,「與正常使用模式明顯不同,屬於刻意的能力萃取」。不過針對這次的 Fable 蒸餾指控,Anthropic 本身並未回應媒體查詢;Moonshot 也沒有回應關於訓練過程的提問;Kratsios 亦未提供美國政府是怎麼得知這些資訊的細節。

⚠️ 這起事件的背景,是美國政府內部正在討論是否禁止中國的開放權重模型(目前僅為外媒報導的討論階段,尚未有任何正式政策,後續發展待確認)。所以這不只是「罵一罵」而已,後面可能牽動實際的政策。

二、什麼是「蒸餾」?為什麼美國這麼在意

「蒸餾」(distillation)這個詞在 AI 圈其實不是髒話,而是一種常見的技術:簡單說,就是用一個強大模型(老師)的回答,來訓練另一個模型(學生)。做法上通常是大量對目標模型提問、收集它的回答(有時還會要求模型展示思考過程),再把這些問答資料拿去做「監督式微調」(SFT),讓學生模型學會老師的本事。

老師模型經由大量問答資料訓練學生模型的模型蒸餾流程示意圖

這也是為什麼有時候你會看到某些第三方模型「自稱是 Claude」的趣聞——因為它是吃 Claude 的回答長大的,連「禮貌跟口頭禪」都一起學走了。

但要注意的是,蒸餾並不是中國廠商的專利。馬斯克今年 4 月就在法庭作證時承認,自家 SpaceXAI 曾蒸餾 OpenAI 的模型來開發 Grok,還說這在業界很普遍(這段故事阿正老師在 Grok 4.5 那篇也提過)。蒸餾跟「合成資料集」之間的界線,本來就相當模糊。美國政府真正在意的,其實是「蒸餾+禁運晶片+開源釋出」三件事加在一起:等於用美國的技術跟硬體,做出一個免費開放全世界下載的競爭對手。

三、專家怎麼看:兩週就能「抄」出全球第三的模型?

有趣的是,這次多位美國 AI 研究者反而站出來替 Kimi K3「說話」——不是說 Moonshot 完全清白,而是認為「靠蒸餾 Fable 做出 K3」這個說法在技術上站不住腳。TechCrunch 在 7/23 的報導訪問了幾位專家,理由大致有三個:

image_5BEBB0C8

1. 時間根本不夠。Laude Institute 研究員、Snorkel AI 共同創辦人 Braden Hancock 直接點出:Claude Fable 5 是 7 月 1 日才恢復全球開放的(這段停用 19 天又回歸的故事,可以看阿正老師之前寫的這篇),而 Kimi K3 在 7 月 16 日就發布了。「你不可能在兩週內蒸餾那麼多資料、訓練一個模型、然後發布它。」

2. 蒸餾的效果越來越有限。Allen Institute for AI 的研究員 Nathan Lambert 認為,隨著中國模型逼近最前沿、訓練方式轉向強化學習(RL),單靠監督式微調的蒸餾效益正在遞減:「如果蒸餾真有這麼神,大家早就都能靠 GLM 或 K3 的資料輕鬆追上它們了,但事實並非如此。」要複製 Fable 等級的能力,需要的是大規模強化學習基礎設施,靠呼叫別人家的 API 來做「不但貴到瘋掉,速度也慢到不切實際」。

3. 低估了中國團隊的實力。Hancock 也提醒:「美國人普遍低估了這些中國團隊的技術能力。Moonshot 的創辦人之一是 CMU(卡內基美隆大學)的博士,這些是真材實料的研究者。」

當然,專家們也普遍同意:過去的前沿模型「可能」對 Kimi 的訓練有貢獻(畢竟 Anthropic 上半年那份 340 萬次對話的指控是有憑有據的公開文件),只是「K3 = 蒸餾版 Fable」這種說法太過簡化。至於禁運晶片的部分,則是另一條完全獨立的戰線,黑市晶片確實存在(5 月才有美國伺服器大廠創辦人因走私晶片被起訴),但 Moonshot 是否涉入,目前只有單方面說法。

四、對一般用戶的影響:免費版、訂閱與 7/27 開源權重

講完大人物的戰爭,回到我們最關心的問題:在台灣的一般用戶,到底會受到什麼影響?阿正老師整理成一張表:

項目 目前狀態 受這次事件影響嗎?
kimi.com 免費網頁版/App 正常可用(用量上限動態調整) 目前沒有影響
新付費訂閱 因算力不足暫停中、分批重開 與本事件無關(是自己太紅)
API/OpenRouter 未見暫停或封鎖報導 待確認
7/27 開源權重上架 Hugging Face 官方原訂 7/27 前上架 截稿前未見變更公告(待確認)

簡單說:目前你能用的 Kimi,一樣都能用。真正需要觀察的是兩件事:一是美國「禁止中國開放權重模型」的討論會不會變成真的政策(若成真,影響的主要會是美國境內的雲端平台與企業採用,一般台灣用戶從 Hugging Face 下載權重或用 kimi.com 網頁版,短期內不受直接約束);二是 7/27 的開源權重上架會不會因為這波政治壓力生變,這點就要等官方消息了。

⚠️ 老話一句:Kimi 是中國服務,對話內容會經過中國伺服器、也有內容審查,工作機密與個人敏感資料不要餵進去。這點跟這次的政治新聞無關,是本來就該注意的事。

另外提醒一下,就在今天(7/24)晚上 11:59(台灣時間),DeepSeek 的舊模型 deepseek-chat/deepseek-reasoner 也要正式退場了,有在用 DeepSeek API 的朋友記得看阿正老師這篇的遷移教學。七月最後一週的開源 AI 圈,真的熱鬧到不行。

五、阿正老師的總結與建議

這次事件與其說是技術新聞,不如說是 AI 版的地緣政治連續劇:美國政府一邊討論要不要禁中國開源模型,一邊由官員出面定調「中國模型 = 偷來的」;而技術圈的專家則普遍認為指控過於粗糙。夾在中間的我們,把它當成一個觀察指標就好——開源 AI 的黃金時代,正開始受到政治力的實質干擾

阿正老師點評:以使用者的角度,阿正老師會建議「照常用、但留後路」:Kimi K3 免費版該怎麼用就怎麼用,但重要工作流程不要押在單一模型上。想要不受政治風向影響的本地方案,可以參考 Bonsai 27BOllamaLM Studio,模型抓回自己電腦,誰都禁不掉。

你怎麼看這場「蒸餾」羅生門?

你覺得 Kimi K3 是真本事還是站在巨人肩膀上?如果美國真的禁了中國開源模型,你會改用哪一家?7/27 的開源權重上架有什麼新消息,阿正老師也會持續追蹤。

歡迎在下面留言跟阿正老師分享!

留下回覆

請輸入你的評論!
請在這裡輸入你的名字