湯森路透正式推出 Thomson,公司首個自有大型語言模型(LLM)。這次行動的重點,唔係全面告別 Anthropic 的 Claude,而係令公司可以自行掌控部分最適合用自家資料及專業知識處理的 AI 工作。711
Thomson 首個正式應用場景,是 CoCounsel Legal 入面的 Tabular Analysis——一項大量處理結構化文件的審閱工作。至於 CoCounsel 其他較廣泛的功能,Claude 預計仍會繼續發揮主要作用。711
4,000萬美元,唔等於只花45萬美元
湯森路透表示,過去超過兩年,已經投資約 4,000萬美元,用於聘請人才及提供運算資源,發展 Thomson。26
至於廣泛流傳的 約45萬美元,其實只代表現時版本最後一次訓練的成本,並唔包括整個項目的其他開支,例如模型研發、資料整理、測試評估、運算資源,以及專業領域專家的參與。26
公司形容,Thomson 的訓練及運行成本只是同類前沿模型的一小部分,而且模型由湯森路透完全擁有及控制。7
官方未點名 Qwen,外界報道提到 Snowdon
湯森路透的正式公告,只將 Thomson 的起點描述為「強大的開源基礎」,並沒有公開點名是哪一個模型。7
不過,外間報道引述公司技術總監的說法,指其基礎模型是阿里巴巴的 Qwen。另有報道指,湯森路透與英國帝國理工學院的合作團隊,曾經將 Qwen 重新調整成一個名為 Snowdon 的中間模型,着重處理倫理、政治取向及安全方面的重新校準,之後再加入專業領域訓練。214
要分清楚的是:Qwen 及 Snowdon 屬於外界報道所描述的研發歷程,並非湯森路透在正式發布公告中確認的名稱。最穩妥的說法,是 Thomson 由一個開源模型基礎開始,再針對湯森路透的專業工作流程進行調整及訓練。7
唔係將整個資料庫一股腦餵入模型
湯森路透表示,Thomson 的訓練資料包括來自 Westlaw、Practical Law、Checkpoint 及 Reuters 的權威內容,並有數百名不同專業領域的專家參與訓練及評估。7
但據報道,目前實際使用的資料少於湯森路透整個內容庫的 10%。2 這反映出公司採取的並非「資料越多越好」路線,而是先揀選可信及有用的專業內容,再配合領域專家和針對具體任務的測試。
對法律、稅務、會計及合規等專業工作而言,模型是否識得一般語言固然重要,但能否配合可信內容、專門工具,以及既定工作流程,往往更加關鍵。
Claude 唔會消失:混合架構才是主菜
湯森路透並無表示會在 CoCounsel 全面取代 Claude。按照公司公布的方向,Thomson 會負責那些其專業訓練、公司內容及專門工具較有優勢的工作;Claude 就會繼續支援平台內不少其他功能,雙方的合作關係亦已經擴大。711
換句話說,CoCounsel 將採用一種混合架構:
- Thomson:處理 Tabular Analysis 等大量、結構化的專業工作。
- Claude 及其他外部模型:負責需要更廣泛前沿模型能力的任務。
- 公司自有模型及資料:用於最重視成本、客製化及營運控制的場景。
對企業採購 AI 來說,這個訊息相當實際:自家擁有模型,唔代表要完全放棄模型供應商。較細、較專門的模型,可以和大型通用模型並存,關鍵在於分配最適合的工作給最合適的模型。
「自己擁有」對比「逐次租用」
湯森路透的理由同時涉及財務及策略。每次使用外部模型,都會產生持續的推理成本,亦令公司受制於供應商的收費、產品路線、服務供應情況及政策。自家模型就需要先投入一筆較大的開發成本,但完成後會成為公司可以掌控的資產。713
因此,4,000萬美元這個數字真正代表的,唔只是一輪模型訓練,而是整套人才、運算、資料處理、評估及專業知識投入。45萬美元的最後訓練費之所以引起注意,正正是因為它遠低於訓練最大型前沿模型通常涉及的成本;但單看這一輪,會低估整個項目的實際投入。26
湯森路透實際上押注的是另一條路:擁有高價值專有資料的企業,未必要由零開始打造一個樣樣皆能的通用模型。企業可以由開源基礎出發,再針對最貼近自身業務的工作加以專門化,從而掌握更多 AI 帶來的價值。
計劃在 Hugging Face 發布較小型版本
湯森路透計劃在 Hugging Face 發布一個較小型的 open-weight 版本,供學術及非商業研究使用,並由法律學者參與外部評估。10
不過,這並不代表正式投入生產的 Thomson 本身會完全開放權重。較準確的理解是,計劃中的版本主要用作研究及評估,讓外部專家有機會測試模型的表現和限制。
目前可以確認,亦要保留的地方
目前較清晰的事實是:湯森路透推出了一個由公司控制的 LLM,為研發投入約4,000萬美元,以精選的專業內容作訓練,並首先部署在法律文件審閱工作流程之中。711
至於 Qwen 基礎、Snowdon 中間模型,以及與帝國理工學院的合作,則是外間報道補充的研發背景,並非公司公開發布公告中逐項列明的內容。214 同樣地,對中國開源模型基礎的安全疑慮,屬於供應鏈及治理層面的問題;現有報道並無證實 Qwen、Snowdon 或 Thomson 發現任何後門。
這次發布的更大意義,在於湯森路透並非要同通用聊天機械人爭市場,而是在測試一個問題:一個以高價值專業知識訓練、只在特定場景使用的模型,能否減少企業對「租用」外部 AI 的依賴,同時在成本及控制權方面帶來更好的回報。