2026 Thomson Reuters自研模型是什么:Thomson与CoCounsel全解析

Thomson Reuters 发布自研法律模型 Thomson。下文按通稿与 Law.com 分开能核对的数字。

法律与税务内容商 Thomson Reuters 在 8 月 24 日发出通稿:不再只把别人的旗舰模型接到自家产品里,而是发布第一份自研大模型,并写明先落在哪一个功能上。

核心对象是 Thomson。官方写它从开源底座起步,人才加算力约 4000 万美元,公司完全持有。Law.com 写简报口径是阿里系 Qwen 3.5。下文按通稿、Law.com 与 Business Insider 分开能对上的数字,不写成「已全面替代 Claude / GPT」或「已独立复测超过前沿旗舰」。

7 月下旬:初步基准公开上周四:新一代 CoCounsel Legal 正式可用8 月 24 日:Thomson 通稿

官方写成了什么

通稿把 Thomson 写成第一份自研专有 LLM,走「强开源底座 + 中训与后训练」而不是从零堆十亿美元算力。语料写 Westlaw、Practical Law、Checkpoint 与 Reuters,并有数百名主题专家从训练目标设计到终评。截至发布,训练只用了 Thomson Reuters 内容的不到 10%。官方商标口径是 Fiduciary-Grade™:面向负有注意义务的专业人士;并写客户数据未经明确同意不用于训练。

$40M
官方:人才 + 算力投入(约)
<10%
官方:已用 TR 内容占比上限
1
官方:首个产品座位(Tabular Analysis)

能核对的几条口径

  1. 1

    底座名字:通稿不写,Law.com 写 Qwen 3.5

    官方只写「强开源底座」。Law.com:周一发布版建在阿里子公司开发的开源模型 Qwen 3.5 上;总成本约 4000 万美元(算力与人员),最终训练轮约 45 万美元。Business Insider 另称 Thomson-1,并写底座曾以 Snowdon 之名「重新对齐」Qwen。通稿正文没有 Thomson-1 / Snowdon 这两个词。读法:官方品牌是 Thomson;底座与内部代号以简报为准。

  2. 2

    第一落点是表格分析,不是整套 CoCounsel 换芯

    官方:首个部署在 CoCounsel Legal 的 Tabular Analysis(高通量、结构化文书审阅),面向律所与公司法务的「即将发布」。CoCounsel Legal「按设计仍是多模型」:Thomson 用在优势最清楚的地方,其余继续用其他旗舰。Law.com:表格分析默认 Thomson,客户可改选其他模型;公司会按表现与价格继续混用 OpenAI、Anthropic 等。

  3. 3

    小权重将上 Hugging Face,不等于全家开源

    官方:将提供「small」版 Thomson,以开源权重形式放到 Hugging Face,供学术与非商用,帮助核验。Law.com:Hron 说公开小版本用非商用许可,供评估与研究;周一发布版是更大家族的第一代。不要把「小版本非商用权重」读成生产模型可随便下载商用。

01

「与前沿持平」是早期自评

Hasker 的「on par」写在通稿里。通稿另写指令跟随相对底座有「有意义的提升」,在稠密领域内容上提升更大。评测细节指向「底座的技术报告」。未见第三方按同一协议复跑整表。学者引言(Jonathan H. Choi、Samuel Dahan)是通稿引用,不是独立实验室榜。

02

不要和 Harvey Tenet 叠成同一个模型

Harvey 上周的 Tenet 是 Kimi K3 后训练、法律代理基准上的研究预览。Thomson 是内容商自训、先接文书表格分析。底座、训练目标、产品座位都不同。Law.com 另写 LexisNexis 在考虑自研 LLM——那是竞争动态,不是本次发布本身。

03

新一代 CoCounsel 是另一条产品线

Law.com:上周四新一代 CoCounsel Legal 正式可用,4 月起测试、6 月早鸟。平台更偏自主,用 Anthropic Claude Agent SDK。新功能包括 Westlaw Brief Builder、Workspaces、起草代理与核验引用的深度研究。这是代理工作流升级,不要读成「Thomson 已经跑完全部代理」。

说法能核对的来源读法
首个自研 LLM,约 4000 万美元Thomson Reuters 2026-08-24 通稿公司成本声明,不是审计过的单价表
底座 Qwen 3.5;终训约 45 万美元Law.com 8 月 24 日稿(简报)通稿未点名 Qwen;以简报补底座
默认接 Tabular Analysis;仍多模型通稿 + Law.com即将发布的功能座位,不是全产品换模

通稿把「主权」写成:训练方式、行为与偏见、跑在哪里、客户信息如何保护,不再只交给第三方。这是产品叙事。部署范围仍以即将上线的表格分析为准。

# Thomson (official launch 2026-08-24)
owner: Thomson Reuters (TRI)
base: open-source (Law.com: Qwen 3.5)
spend: ~USD 40M talent+compute
final run: ~USD 450k (Law.com)
first seat: CoCounsel Legal / Tabular Analysis
small weights: Hugging Face, academic/non-commercial

读法与边界

4000 万美元 ≠ 从零训练一个前沿旗舰
官方对比的是「前沿实验室通常数十亿美元算力与多年基建」。路径是开源底座再专业化。Law.com 引 Hron:开源模型能力上来后,才能以远低于前沿实验室的价格训练。数字是项目口径,不是公开的每百万 token 价目。
学者喜欢某几题 ≠ 执业许可
Choi 写在公司税法难题上三家都答对,他更偏好 Thomson 的论述与论文链接。Dahan 写引用质量大体可与前沿竞争,即使在未开加拿大设定的加拿大劳动法题上。这是通稿里的个人评语,不是律协或法院认证。
「即将发布」不是已经全员默认
通稿用 upcoming release。管理员仍可选其他模型。把新闻读成「所有 CoCounsel 任务已切到 Thomson」会超前。

还想核对的问题

Thomson 会替换掉 Anthropic 和 OpenAI 吗?

官方与 Law.com 都写不会单模型切换。表格分析默认 Thomson,其余按任务继续混用。Business Insider 也写它会接手部分原先由 Claude 做的活,但不是结束与 Anthropic 的合作。

权重已经可以商用下载了吗?

通稿写的是 small 版、Hugging Face、学术与非商用。生产用 Thomson 走产品与即将上线的功能。公开仓库地址与许可证全文要以实际上架页为准,通稿没有给出完整 SPDX。

这和「训练了 Westlaw 全文」是一回事吗?

不是。官方写用了 Westlaw 等权威内容做中训与后训练,同时写至今不到全部内容的 10%。下一步「不是简单再喂更多数据」,而是新的专业化。具体篇目与授权范围通稿没有列清单。

免费开始开会