Что такое Harvey Tenet 2026: дообучение Kimi K3 для юридических агентов

Harvey назвала Tenet первой дообученной open-weight моделью. Ниже отделён официальный пост от Law.com 20 августа.

Юридический техстартап Harvey на этой неделе оформил исследовательское превью в проверяемую техническую заметку: не только арендовать чужой флагманский API, а дообучить open-weight базу под юрработу и опубликовать цифры на своём Legal Agent Bench.

Объект — Harvey Tenet. Официальный пост называет базу Kimi K3, асинхронный RL с Fireworks, длинные агентные юридические задачи. Ниже этот пост и Law.com от 20 августа — не утверждение, что Tenet обошёл Fable 5 или GPT-5.6 по всем доскам.

~2 месяца ранее: план своих юрмоделей~18 августа: Harvey II20 августа: превью Tenet в прессе

Что пишет официальная заметка

Harvey описывает две полугодовые цели: фронтирную юридическую интеллект на открытых весах и системы, чтобы фирмы владели моделями. Tenet — первый дообученный чекпоинт первой линии. Среды копируют LAB: запрос партнёра, клиентское дело, экспертная рубрика. Агент пишет сдачи на диск и оценивается LLM-судьёй.

×2
Официально: завершения LAB hold-out против K3
+9 pp
Официально: all-pass LAB hold-out
0
Официально: без клиентских данных в дообучении

Проверяемые формулировки

  1. 1

    База и оптимизатор названы

    Официально: K3 + Fireworks async RL; политика GSPO. Ablation судей сошлась на Kimi 2.6. Данные: синтетика, открытая юрлитература, эксперты; Mercor и другие по экспертным наборам и ревью синтетики.

  2. 2

    Цифры LAB — против K3, не внешняя лабораторная доска

    Официально: почти 2× hold-out завершений, +20% Contracts; all-pass +9 и +2. Первое на Contracts, второе на LAB. Рисунок ссылается на Vals LAB. Полного стороннего перезапуска таблицы нет.

  3. 3

    Три других трека — не чекпоинт Tenet

    M&A diligence описывает GLM-5.2 в RLM-харнессе после self-distillation, 60,1% прохождения критериев. Review Table тоже GLM-5.2. Firm Knowledge — Qwen3.8-27B с Engram. Доп. дорожки «к продукту», не сам Tenet.

01

Стоимость — Парето, не публичный прайс

Пост пишет более дешёвые open-weight токены и reward shaping против инференс-токенов. Есть график качество–стоимость. В эссе нет публичного прайса за миллион токенов.

02

Open-weight — не публичная скачка весов

Официальный заголовок и Law.com говорят open-weight. Та же страница помечает Research Preview и путь в прод. URL репозитория и полный текст лицензии не записаны как выкладка весов.

03

Оценки стоимости расходятся

Startup Fortune написала около $15,5 млрд; Business Insider — бизнес на $11 млрд. Оба — пресса. Проверяема методическая заметка Tenet, не новый раунд.

ФормулировкаПроверяемый источникКак читать
База K3 + async RL FireworksОфициальный пост HarveyМетодический claim превью
Первое на LAB Contracts, второе на LABHarvey; Law.comОценка вендора; компараторы у Law.com
Без клиентских данныхРаздел обучения HarveyЗаявление компании, не аудит

Пост пишет перенос на невиденные в обучении APEX Agents и Redline Bench. Это их claim обобщения, не судебная сертификация.

# Harvey Tenet (official, research preview)
base: Moonshot Kimi K3
post-train: async RL + Fireworks
optimizer: GSPO
judge: Kimi 2.6
no customer data in post-training

Как читать границы

2× завершений ≠ юридические мнения без человека
Цифры — LAB hold-out и рубрики. Пост также пишет, что знаниевые бенчи не повредили базу. Это не лицензия на практику.
LLM-судья шумит
Награда смешивает тонкие пункты, решённые вопросы и бонус за идеал. Они выбрали Kimi 2.6. Судьи ошибаются.
Memory Harvey II — продукт, не Tenet
Law.com: Harvey II примерно за два дня до Tenet. Startup Fortune: Memory не идёт в обучение моделей. Читать отдельно.

Вопросы для сверки

Tenet уже заменил OpenAI / Anthropic у всех клиентов?

Официальный пост этого не пишет. Это превью; прод-вычисления — следующий шаг. Бизнес Harvey строился на сторонних моделях, так пишут Law.com и Business Insider.

«Первое на LAB» — вывод независимой лаборатории?

Нет. LAB — собственный открытый юрагентный бенч Harvey. Компания заявляет первое на Contracts и второе в целом. Law.com назвала компараторы. Стороннего перезапуска нет.

60,1% diligence — это балл Tenet?

Нет. Этот раздел описывает GLM-5.2 + RLM после self-distillation, техотчёт ещё будет. Не складывать с LAB-цифрами Tenet.

Начать бесплатную встречу