Hy4 previewとは:2026年テンセント770B公開重みと盲検

テンセントが Hy4 preview を出した。770B/49B、内部盲検 2.99/4、preview の欠陥を分けて読む。

2026年9月上旬、テンセント Hunyuan の Hy チームが Hy4 preview を出した。総 770B、トークンあたり活性約 49B の MoE、文脈 1M、重みは Apache 2.0。ニュースはパラメータ数ではなく、公式が書いた内部盲検と、プレビューの欠陥である。

検索語は Hy4 preview770B / 49B。根拠はテンセントの発表、Hugging Face の tencent/Hy4-preview、ThursdAI の 9 月トラッカー。一部の要約は初出を 8月28日とする。公式投稿が書いていない出荷日を作らない。同じ週の別の公開艦隊は K2 Horizon

770B / 49B Apache 2.0内部盲検 2.99 / 4公式は preview

公式が書いた出荷物

旗艦は疎 MoE:総 770B、トークンあたり活性約 49B。骨幹 78 層、第 1 層は密 FFN、残り 77 層はルーティング専門家 256 と共有 1、トークンあたり top-8 に共有を足す。推測復号用の MTP(総 10B、活性約 0.7B)を内蔵。注意は Gated DSA と IndexCache、残差は iHC の 4 ストリーム。語彙 120832、文脈 1M。

2.99/4
内部盲検の平均
2.92
GLM-5.3 対照
2.94
Kimi K3 対照

三つの数字の読み方

  1. 1

    平均の前に SKU を固定する

    公式の提供例は vLLM イメージ vllm/vllm-openai:hy4-preview か SGLang lmsysorg/sglang:hy4-preview、FP8 と 8 方向テンソル並列。推論は high が既定。no_think で直接回答。発表の API 価格は入力 0.834、出力 2.501、キャッシュヒット 0.042 ドル / 百万トークン。WorkBuddy / CodeBuddy は公開後 2 週間無料、Hy3 無料は 9月30日まで延長。

  2. 2

    2.99 は社内盲検

    テンセント内部の専門家 163 人が 203 課題を採点。Hy4 preview の平均は 2.99 / 4.00。GLM-5.3 は 2.92(勝 46.8% / 分 12.8% / 負 40.4%)、Kimi K3 は 2.94(51.2% / 7.9% / 40.9%)。カードと tencent.com は一致する。判定者は社員、尺度は研究室のもの。規制判断でも第三者再走でもない。

  3. 3

    量子化の数字にはリポジトリを書く

    公式カードは AngelSlim を指す。ThursdAI と AngelSlim の GGUF カードは STQ1_0 を約 2.38 bit/weight、約 214GB、非量子化約 1.5TB と書く。コミュニティの量子化であり、Apache 重み自体が小さくなったわけではない。K2 の AA 指数と混ぜない。別の公開重みは Qwen3.8-27B

01

「再帰的自己改善」は割り引く

発表は、モデルが訓練法、データ戦略、評価枠、演算子の自動最適化に関わり、推論スループットが基線比 31.8% 上がったと書く。第三者の再現請求書はない。研究室の叙述として読む。

02

HF の評価行は AA 指数ではない

モデル頁には Apex Agents や Terminal-Bench などの行がある。本稿はそれを検証済みの第三者指数としては扱わない。照合できるのは 770B/49B、Apache 2.0、内部盲検 2.99/4 である。

03

preview は欠陥を自分で書いている

公式は推論が長く、自己検証が過剰で、事前学習と事後学習に余地があると書く。Hy3 preview と同様に「先に出して壊れる所を聞く」方針であり、GA 旗艦宣言ではない。

主張照合できる出典読み方
770B / 49B MoE、文脈 1MHF カード · GitHub Tencent-Hunyuan/Hy4-previewアーキは公式表
盲検 2.99 vs 2.92 / 2.94テンセント発表 · カード Built for Productivity内部専門家であり独立再走ではない
Apache 2.0 重みモデルカード Licenseダウンロード前に LICENSE を読む

テンセント:これは Hy4 の初期版だ。事前学習と事後学習に余地がある。先に出して壊れる所を聞きたい。Hy3 preview はそれで良くなった。

# Hy4 preview · Tencent Hy Team · as of 2026-09
sku: 770B / 49B active     # MoE, 1M context
license: Apache-2.0
layers: 78                 # 1 dense + 77 MoE
experts: 256 routed + 1 shared; top-8
mtp: 10B / 0.7B active     # speculative decode
blind_avg: 2.99/4          # 163 experts, 203 tasks
vs_glm53: 2.92             # 46.8 / 12.8 / 40.4
vs_kimi_k3: 2.94           # 51.2 / 7.9 / 40.9
api_usd_per_m: 0.834 / 2.501 / 0.042

読み方と境界

内部盲検 ≠ 第三者指数
2.99 / 2.92 / 2.94 はテンセント専門家の点。AA Intelligence Index に言い換えず、同週の閉鎖旗艦の自己申告表と優勝を争わせない。
Apache 2.0 ≠ 1 台で 770B
公式例は 8 方向テンソル並列と FP8。AngelSlim の低ビット GGUF は別経路。速度と品質は自分の負荷で測る。
このニュース頁は会議マニュアルではない
公開と評価だけを説明する。短い打ち合わせと白板なら wbmeet で部屋を作り、部屋の作成と参加を見る。

まだ確認したいこと

Hy4 preview は新しい研究室の初回公開か?

違う。テンセント Hunyuan / Hy チームの公開。発表は CodeBuddy、WorkBuddy、Yuanbao、ima との共設計と、Hy3 無料延長も書く。Hy4 はこの世代の preview であり設立日ではない。

2.99 は GLM-5.3 と Kimi K3 を「超えた」意味か?

単独ではならない。平均差は 0.05–0.07、GLM-5.3 への勝率は 46.8%、負率は 40.4%。公式の言葉は slightly ahead。判定者は内部。

214GB 量子化は公式の標準か?

公式カードは AngelSlim と FP8。約 214GB / 2.38 bpw は AngelSlim の GGUF 説明と週次要約に出る。実際に取るファイル名を見る。

公開重みが閉鎖旗艦に並んだ証明か?

ならない。本頁は照合できる公開と内部盲検の言い回しだけを分解する。閉鎖対照には各システムカードと第三者指数が要る。

無料で会議を開始