2026年 DeepMind二重盲検評価とは:Gemini 2.5 Flash Lite解説

DeepMindが機密計算の飛地でGemini 2.5 Flash Liteを二重盲検の安全評価にかけた。重みと問題は非公開、点数も未公表。

独立評価では、重みを渡すか問題を渡すかの二択が普通だった。8月27日、Google DeepMindは暗号飛地でその二択を避けたパイロットを公表した。

対象は DeepMindの二重盲検評価。公式表現は専有のフロンティア級モデルに対する世界初。被検体は Gemini 2.5 Flash Lite(AVERIはFlash-Lite)。以下は deepmind.google とAVERI報告で照合できる事実。未公表の点数は作らない。

7–8月:飛地内で実施未公開問題がTEEへ8月27日:双方が公開

公式が書いたこと

著者はWilliam Isaac、Sol Messing、Kristian Lum。協力はシンガポールAI Safety Institute、OpenMined、AVERI、MLCommons。動機は汚染:問題を先に見れば点数は信頼しにくい。従来はゼロログ契約。今回は暗号と機密計算を足す。

1
公式:初の専有フロンティア二重盲検
0
公開:モデル点数なし
4
名前のある外部相手

照合できる表現

  1. 1

    二重盲検が置き換える交換

    DeepMind:高リスクの外部評価は、評価側が問題を渡す(研究室が先読みしうる)か、研究室が重みを渡す(知財リスク)しかなかった。Confidential Spaceで双方の資産を隠す。評価側は重みを見ず、Googleは問題を見ない。

  2. 2

    AVERIが書いた端到端

    AVERIは2026年7–8月、DeepMind・OpenMined・MLCommonsと初の専有言語モデル二重盲検を実施したと書く。未使用のAILuminate題をAVERIが暗号化し、Google設定の飛地でOpenMinedソフトを共同実行。AVERIが出力を復号して採点。2024年のOpenMined・Anthropic・英AISIはGPT-2の代理。今回は本番モデル。

  3. 3

    危害面と点数の行方

    AVERI注:CBRNE、サイバー攻撃、ヘイト、自傷、暴力犯罪の誘導。TechRepublic等:シンガポールAISIは現地文脈の有害内容も別途。点数は非公開。本サイトの Anthropic TASTEGuidelight と同じで、出典に数字があるときだけ数字を書く。

01

握手ではなくハード隔離

二次報道はA3 Confidential VM、Intel TDX、NVIDIA H100 Confidential GPUを挙げる。重みは暗号化GPUメモリ、問題は暗号化ホストメモリ。遠隔証明で環境を確認する。

02

残る信頼の線も公式が書く

技術報告の転述:一部の専有推論コードは完全検査や許可リストに載せられない。個々のConfidential Space構築は独立再現できない。証明の署名・検証にGoogleサービスが入り、提供者は検証経路に残る。AVERIも、改ざん経路のすべてを塞いだわけではないと書く。

03

規模はまだ1GPU

複数の解説は、1枚のGPU予算に収まる本番級が対象だと書く。規制が厚い大型フロンティアは多GPU化が要る。「Gemini旗艦がすべて封印評価を通過した」とは読めない。

言い方照合できる出典読み方
初の専有フロンティア二重盲検DeepMind 2026-08-27手法の主張であり点数ではない
Gemini 2.5 Flash-Liteと未使用AILuminateAVERIパイロット報告本番モデルでありGPT-2代理ではない
評価側は重みを見ず / Googleは題を見ず双方同じ分割飛地内の共同計算でありファイル交換ではない

DeepMind:監督の前線を更新したい。AVERI:アクセス争いをできるだけ工学にし、監査はモデル評価だけではない。

# DeepMind double-blind eval pilot
# announced 2026-08-27
model: Gemini 2.5 Flash Lite
partners: Singapore AISI, OpenMined, AVERI, MLCommons
box: Google Cloud Confidential Space (TEE)
public_scores: none
prior_proxy: 2024 OpenMined + Anthropic + UK AISI (GPT-2)

読み方と境界

点数なし ≠ 合格でも不合格でもない
公開面が示すのはアーキテクチャであり、Geminiの安全等級ではない。AILuminateの百分率を作らない。
二重盲検 ≠ 全ラボへの法的義務
AVERIはEU GPAI行動規範やイリノイSB 315(2028年から監査)に触れる。今回は任意のパイロットのまま。
会議ツールとは別線
この頁は評価の説明だけ。短い白板が必要なら wbmeet で部屋を作り、作成と参加 を見れば足りる。

確認したい問い

どのGeminiか。

DeepMindは “a Gemini Flash Lite model”。AVERIと二次報道は Gemini 2.5 Flash-Lite / Flash Lite。Ultraや未発表の大型旗艦とは書いていない。

なぜ点数を出さないか。

DeepMindの記事は手法が主題。AVERIは機密報告のみで問題と出力は非公開。二次報道も公開の課題別成績はないと確認する。

2024年の飛地デモとの違いは。

AVERI:2024年はGPT-2と5行の代理基準。2026年は専有の本番モデルと未使用のAILuminate。

独立再現できるか。

技術報告の要約では、個々のConfidential Space構築は独立再現できず、証明はGoogle経路が署名する。公開提出口ではなく、監査可能な構成の演示として読む。

無料で会議を開始