2026 Thomson Reuters自研模型是什麼:Thomson與CoCounsel全解析
Thomson Reuters 發布自研法律模型 Thomson。下文按通稿與 Law.com 分開能核對的數字。
法律與稅務內容商 Thomson Reuters 在 8 月 24 日發出通稿:不再只把別人的旗艦模型接到自家產品裡,而是發布第一份自研大模型,並寫明先落在哪一個功能上。
核心對象是 Thomson。官方寫它從開源底座起步,人才加算力約 4000 萬美元,公司完全持有。Law.com 寫簡報口徑是阿里系 Qwen 3.5。下文按通稿、Law.com 與 Business Insider 分開能對上的數字,不寫成「已全面替代 Claude / GPT」或「已獨立複測超過前沿旗艦」。
官方寫成了什麼
通稿把 Thomson 寫成第一份自研專有 LLM,走「強開源底座 + 中訓與後訓練」而不是從零堆十億美元算力。語料寫 Westlaw、Practical Law、Checkpoint 與 Reuters,並有數百名主題專家從訓練目標設計到終評。截至發布,訓練只用了 Thomson Reuters 內容的不到 10%。官方商標口徑是 Fiduciary-Grade™:面向負有注意義務的專業人士;並寫客戶資料未經明確同意不用於訓練。
能核對的幾條口徑
- 1
底座名字:通稿不寫,Law.com 寫 Qwen 3.5
官方只寫「強開源底座」。Law.com:週一發布版建在阿里子公司開發的開源模型 Qwen 3.5 上;總成本約 4000 萬美元(算力與人員),最終訓練輪約 45 萬美元。Business Insider 另稱 Thomson-1,並寫底座曾以 Snowdon 之名「重新對齊」Qwen。通稿正文沒有 Thomson-1 / Snowdon 這兩個詞。讀法:官方品牌是 Thomson;底座與內部代號以簡報為準。
- 2
第一落點是表格分析,不是整套 CoCounsel 換芯
官方:首個部署在 CoCounsel Legal 的 Tabular Analysis(高通量、結構化文書審閱),面向律所與公司法務的「即將發布」。CoCounsel Legal「按設計仍是多模型」:Thomson 用在優勢最清楚的地方,其餘繼續用其他旗艦。Law.com:表格分析預設 Thomson,客戶可改選其他模型;公司會按表現與價格繼續混用 OpenAI、Anthropic 等。
- 3
小權重將上 Hugging Face,不等於全家開源
官方:將提供「small」版 Thomson,以開源權重形式放到 Hugging Face,供學術與非商用,幫助核驗。Law.com:Hron 說公開小版本用非商用許可,供評估與研究;週一發布版是更大家族的第一代。不要把「小版本非商用權重」讀成生產模型可隨便下載商用。
「與前沿持平」是早期自評
Hasker 的「on par」寫在通稿裡。通稿另寫指令跟隨相對底座有「有意義的提升」,在稠密領域內容上提升更大。評測細節指向「底座的技術報告」。未見第三方按同一協議複跑整表。學者引言(Jonathan H. Choi、Samuel Dahan)是通稿引用,不是獨立實驗室榜。
不要和 Harvey Tenet 疊成同一個模型
Harvey 上週的 Tenet 是 Kimi K3 後訓練、法律代理基準上的研究預覽。Thomson 是內容商自訓、先接文書表格分析。底座、訓練目標、產品座位都不同。Law.com 另寫 LexisNexis 在考慮自研 LLM——那是競爭動態,不是本次發布本身。
新一代 CoCounsel 是另一條產品線
Law.com:上週四新一代 CoCounsel Legal 正式可用,4 月起測試、6 月早鳥。平台更偏自主,用 Anthropic Claude Agent SDK。新功能包括 Westlaw Brief Builder、Workspaces、起草代理與核驗引用的深度研究。這是代理工作流升級,不要讀成「Thomson 已經跑完全部代理」。
| 說法 | 能核對的來源 | 讀法 |
|---|---|---|
| 首個自研 LLM,約 4000 萬美元 | Thomson Reuters 2026-08-24 通稿 | 公司成本聲明,不是審計過的單價表 |
| 底座 Qwen 3.5;終訓約 45 萬美元 | Law.com 8 月 24 日稿(簡報) | 通稿未點名 Qwen;以簡報補底座 |
| 預設接 Tabular Analysis;仍多模型 | 通稿 + Law.com | 即將發布的功能座位,不是全產品換模 |
通稿把「主權」寫成:訓練方式、行為與偏見、跑在哪裡、客戶資訊如何保護,不再只交給第三方。這是產品敘事。部署範圍仍以即將上線的表格分析為準。
# Thomson (official launch 2026-08-24)
owner: Thomson Reuters (TRI)
base: open-source (Law.com: Qwen 3.5)
spend: ~USD 40M talent+compute
final run: ~USD 450k (Law.com)
first seat: CoCounsel Legal / Tabular Analysis
small weights: Hugging Face, academic/non-commercial讀法與界線
- 4000 萬美元 ≠ 從零訓練一個前沿旗艦
- 官方對比的是「前沿實驗室通常數十億美元算力與多年基建」。路徑是開源底座再專業化。Law.com 引 Hron:開源模型能力上來後,才能以遠低於前沿實驗室的價格訓練。數字是專案口徑,不是公開的每百萬 token 價目。
- 學者喜歡某幾題 ≠ 執業許可
- Choi 寫在公司稅法難題上三家都答對,他更偏好 Thomson 的論述與論文連結。Dahan 寫引用品質大體可與前沿競爭,即使在未開加拿大設定的加拿大勞動法題上。這是通稿裡的個人評語,不是律協或法院認證。
- 「即將發布」不是已經全員預設
- 通稿用 upcoming release。管理員仍可選其他模型。把新聞讀成「所有 CoCounsel 任務已切到 Thomson」會超前。
還想核對的問題
Thomson 會替換掉 Anthropic 和 OpenAI 嗎?
官方與 Law.com 都寫不會單模型切換。表格分析預設 Thomson,其餘按任務繼續混用。Business Insider 也寫它會接手部分原先由 Claude 做的活,但不是結束與 Anthropic 的合作。
權重已經可以商用下載了嗎?
通稿寫的是 small 版、Hugging Face、學術與非商用。生產用 Thomson 走產品與即將上線的功能。公開倉庫地址與許可證全文要以實際上架頁為準,通稿沒有給出完整 SPDX。
這和「訓練了 Westlaw 全文」是一回事嗎?
不是。官方寫用了 Westlaw 等權威內容做中訓與後訓練,同時寫至今不到全部內容的 10%。下一步「不是簡單再餵更多資料」,而是新的專業化。具體篇目與授權範圍通稿沒有列清單。