張一鳴畀咗兩個理由。第一,佢認為蒸餾係一條「捷徑」,會削弱真正嘅長期科研實力。字節跳動應該由零開始,建立自己嘅基礎模型。第二,佢承認呢個立場可能會令字節跳動短期內落後畀國內對手,好似DeepSeek、Moonshot AI同阿里巴巴嘅通義千問,但佢覺得為咗建立長遠嘅AI實力,呢個代價可以接受。
要完全理解呢個禁令,就一定要知字節跳動幾年嚟點樣為咗TikTok喺美國營運而奮鬥。消息人士話,呢個反蒸餾政策「部分係受字節跳動同美國政府之間複雜嘅關係影響」。
自從2025年1月美國最高法院裁定維持《保護美國人免受外國對手控制應用程式法案》,要求字節跳動出售TikTok美國業務,否則就要面臨禁令之後,字節跳動就一直處於華盛頓嘅嚴密監管之下。最終,公司喺2026年初達成協議,將TikTok美國業務同全球業務分拆。
透過公開放棄蒸餾——呢個愈嚟愈被美國政府視為「工業規模知識產權盜竊」嘅做法——字節跳動可以向美國監管機構展示自己係一個更合作嘅參與者,從而降低對方以AI模型盜竊為由,進一步限制TikTok或實施制裁嘅風險。
呢個舉動正值中美之間圍繞AI蒸餾嘅衝突達到頂峰。最矚目嘅案件就係北京初創公司Moonshot AI同佢嘅Kimi K3模型。
2026年6月至7月,白宮科技顧問Michael Kratsios指控Moonshot AI對Anthropic最先進嘅模型Fable發動「大規模」蒸餾行動,用嚟開發Kimi K3。用戶好快發現Kimi K3嘅表現同Anthropic同OpenAI嘅最佳商用模型不相伯仲。美國財政部隨即威脅要對涉嫌透過蒸餾竊取知識產權嘅中國AI公司展開調查、實施制裁同貿易限制。
中國商務部反擊,指責美國搞「AI霸權主義」,並警告會採取反制措施。
除咗Moonshot AI,DeepSeek同MiniMax等其他中國AI實驗室都被廣泛指控有類似行為。OpenAI向美國國會中國問題委員會表示,DeepSeek員工發展出繞過其存取限制、系統性收集模型輸出嘅方法。Anthropic披露,三個中國AI實驗室——DeepSeek、Moonshot AI同MiniMax——使用超過24,000個虛假帳戶,同Claude進行咗超過1,600萬次對話。路透社一篇報道強調,要從技術上完全阻止呢啲行為係幾咁困難。
雖然公開立場好強硬,但字節跳動呢個指引至少面對三個重大執行挑戰:
冇外部驗證機制: 呢個只係內部、自我監管嘅承諾。字節跳動冇公布任何獨立審計系統、代碼簽署檢查或第三方驗證,去確認佢哋嘅模型係咪真係冇用過蒸餾技術訓練。
技術檢測困難: 正如路透社2025年1月所講,模型發布之後要檢測佢有冇用過蒸餾技術係極度困難嘅。「學生」模型嘅權重唔一定會留下可以追溯到特定美國「教師」模型嘅法證痕跡。
競爭壓力: 字節跳動本身就已經落後DeepSeek同Moonshot等競爭對手。如果呢啲對手繼續快速進步——可能係透過蒸餾技術——字節跳動內部可能會面臨巨大壓力,要靜雞雞放寬政策。呢個政策只係創辦人嘅口頭指令,唔係有法律約束力嘅合約,可以隨時撤銷而唔使公開通知。
目前嘅報道仲未提及任何具體嘅內部控制措施,例如API存取日誌、訓練數據審計或員工保密協議,可以令呢個禁令喺實踐中真正有效執行。
字節跳動嘅「不蒸餾」承諾係一場大賭博。佢將公司定位為美國監管機構眼中更合作嘅參與者,有可能消除一個針對TikTok嘅主要制裁藉口。但同時間,佢亦冒住喺AI能力競賽中落後嘅風險,因為DeepSeek同Moonshot等中國競爭對手正透過各種方式繼續進步。
中美AI衝突短期內好難降溫。隨住美國威脅制裁、中國指責華盛頓搞「AI霸權主義」,字節跳動嘅內部政策可能與其話係技術哲學,不如話係一套地緣政治生存策略。
目前嘅關鍵問題係:字節跳動可以堅持呢個承諾嗎?如果冇人可以真正驗證,呢個承諾又有咩意義呢?