Harvey Tenet 2026 : post-entraînement Kimi K3 et agents juridiques

Harvey a nommé Tenet son premier modèle open-weight post-entraîné. On sépare ici le post officiel de Law.com le 20 août.

La legal-tech Harvey a mis cette semaine un aperçu de recherche dans une note technique vérifiable : ne plus seulement louer l’API fleuron d’autrui, post-entraîner une base open-weight pour le juridique et publier des chiffres sur son Legal Agent Bench.

L’objet est Harvey Tenet. Le post officiel parle d’une base Kimi K3, d’un RL asynchrone avec Fireworks, de tâches juridiques agentiques longues. Suit ce post plus Law.com le 20 août — pas une victoire générale sur Fable 5 ou GPT-5.6.

~2 mois plus tôt : plan de modèles juridiques~18 août : Harvey II20 août : aperçu Tenet dans la presse

Ce que dit la note officielle

Harvey écrit deux buts sur six mois : une intelligence juridique de frontière sur poids ouverts, et des systèmes pour que les cabinets possèdent leurs modèles. Tenet est le premier checkpoint post-entraîné de la première ligne. Les environnements copient LAB : demande de associé, dossier client, rubrique d’expert. L’agent écrit les livrables sur disque et est noté par un juge LLM.

×2
Officiel : complétions LAB hold-out vs K3
+9 pp
Officiel : all-pass LAB hold-out
0
Officiel : aucune donnée client au post-entraînement

Chiffres vérifiables

  1. 1

    La base et l’optimiseur sont nommés

    Officiel : K3 + Fireworks RL asynchrone ; politique GSPO. Ablations de juge : Kimi 2.6. Données synthétiques, juridiques publiques et expertes ; Mercor et d’autres sur les jeux experts et la revue synthétique.

  2. 2

    Les chiffres LAB sont versus K3, pas un board externe

    Officiel : presque 2× de complétions hold-out, +20% Contracts ; all-pass +9 et +2. 1er Contracts, 2e LAB. Une figure cite Vals LAB. Pas de reprise tierce de la table entière.

  3. 3

    Trois autres pistes ne sont pas le checkpoint Tenet

    La diligence M&A décrit GLM-5.2 dans un harness RLM après auto-distillation, 60,1% de critères. Review Table aussi GLM-5.2. Firm Knowledge est un Qwen3.8-27B avec Engram. Pistes à incorporer, pas Tenet.

01

Le coût est un Pareto, pas un tarif public

Le post dit des tokens open-weight moins chers et un reward shaping qui coupe l’inférence. Il montre un graphe qualité–coût. Pas de liste publique au million de tokens dans l’essai.

02

Open-weight n’est pas un téléchargement public

Le titre officiel et Law.com disent open-weight. La même page marque Research Preview et le passage en production. URL de dépôt et licence complète ne sont pas un drop de poids.

03

Les valorisations se contredisent

Startup Fortune a écrit près de 15,5 Md$ ; Business Insider 11 Md$ de logiciel juridique. Les deux sont presse. On peut vérifier la note de méthode Tenet, pas une nouvelle levée.

FormulationSource vérifiableLecture
Base K3 + RL asynchrone FireworksPost officiel HarveyClaim de méthode d’un aperçu
1er LAB Contracts, 2e LABHarvey ; Law.comÉval vendeur ; comparateurs chez Law.com
Pas de données clientsSection entraînement HarveyDéclaration, pas un audit

Le post dit un transfert vers APEX Agents et Redline Bench, non vus à l’entraînement. Claim de généralisation, pas une certification judiciaire.

# Harvey Tenet (official, research preview)
base: Moonshot Kimi K3
post-train: async RL + Fireworks
optimizer: GSPO
judge: Kimi 2.6
no customer data in post-training

Lecture et limites

2× de complétions ≠ avis juridiques sans humain
Les chiffres sont LAB hold-out et rubriques. Les bancs de connaissances n’auraient pas nui à la base. Pas une licence d’exercice.
Un juge LLM est bruyant
La récompense mélange termes fins, questions juridiques et bonus parfait. Ils ont choisi Kimi 2.6. Les juges se trompent.
Memory de Harvey II est un produit, pas Tenet
Law.com : Harvey II environ deux jours avant Tenet. Startup Fortune : Memory ne sert pas à entraîner. À lire à part.

Questions à recouper

Tenet a-t-il déjà remplacé OpenAI / Anthropic pour tous les clients ?

Le post officiel ne le dit pas. Aperçu ; le calcul de production est listé ensuite. L’activité Harvey s’est bâtie sur des modèles tiers, selon Law.com et Business Insider.

« Premier sur LAB » est-il un constat de labo indépendant ?

Non. LAB est le banc agent juridique open-source de Harvey. La société revendique 1er Contracts, 2e au global. Law.com a nommé des comparateurs. Pas de reprise tierce.

Le 60,1% diligence est-il le score de Tenet ?

Non. Cette section décrit GLM-5.2 + RLM après auto-distillation, rapport technique à venir. Ne pas l’empiler sur les chiffres LAB de Tenet.

Démarrer une réunion gratuite