2026年 DeepMind二重盲検評価とは:Gemini 2.5 Flash Lite解説
DeepMindが機密計算の飛地でGemini 2.5 Flash Liteを二重盲検の安全評価にかけた。重みと問題は非公開、点数も未公表。
独立評価では、重みを渡すか問題を渡すかの二択が普通だった。8月27日、Google DeepMindは暗号飛地でその二択を避けたパイロットを公表した。
対象は DeepMindの二重盲検評価。公式表現は専有のフロンティア級モデルに対する世界初。被検体は Gemini 2.5 Flash Lite(AVERIはFlash-Lite)。以下は deepmind.google とAVERI報告で照合できる事実。未公表の点数は作らない。
公式が書いたこと
著者はWilliam Isaac、Sol Messing、Kristian Lum。協力はシンガポールAI Safety Institute、OpenMined、AVERI、MLCommons。動機は汚染:問題を先に見れば点数は信頼しにくい。従来はゼロログ契約。今回は暗号と機密計算を足す。
照合できる表現
- 1
二重盲検が置き換える交換
DeepMind:高リスクの外部評価は、評価側が問題を渡す(研究室が先読みしうる)か、研究室が重みを渡す(知財リスク)しかなかった。Confidential Spaceで双方の資産を隠す。評価側は重みを見ず、Googleは問題を見ない。
- 2
AVERIが書いた端到端
AVERIは2026年7–8月、DeepMind・OpenMined・MLCommonsと初の専有言語モデル二重盲検を実施したと書く。未使用のAILuminate題をAVERIが暗号化し、Google設定の飛地でOpenMinedソフトを共同実行。AVERIが出力を復号して採点。2024年のOpenMined・Anthropic・英AISIはGPT-2の代理。今回は本番モデル。
- 3
危害面と点数の行方
AVERI注:CBRNE、サイバー攻撃、ヘイト、自傷、暴力犯罪の誘導。TechRepublic等:シンガポールAISIは現地文脈の有害内容も別途。点数は非公開。本サイトの Anthropic TASTE と Guidelight と同じで、出典に数字があるときだけ数字を書く。
握手ではなくハード隔離
二次報道はA3 Confidential VM、Intel TDX、NVIDIA H100 Confidential GPUを挙げる。重みは暗号化GPUメモリ、問題は暗号化ホストメモリ。遠隔証明で環境を確認する。
残る信頼の線も公式が書く
技術報告の転述:一部の専有推論コードは完全検査や許可リストに載せられない。個々のConfidential Space構築は独立再現できない。証明の署名・検証にGoogleサービスが入り、提供者は検証経路に残る。AVERIも、改ざん経路のすべてを塞いだわけではないと書く。
規模はまだ1GPU
複数の解説は、1枚のGPU予算に収まる本番級が対象だと書く。規制が厚い大型フロンティアは多GPU化が要る。「Gemini旗艦がすべて封印評価を通過した」とは読めない。
| 言い方 | 照合できる出典 | 読み方 |
|---|---|---|
| 初の専有フロンティア二重盲検 | DeepMind 2026-08-27 | 手法の主張であり点数ではない |
| Gemini 2.5 Flash-Liteと未使用AILuminate | AVERIパイロット報告 | 本番モデルでありGPT-2代理ではない |
| 評価側は重みを見ず / Googleは題を見ず | 双方同じ分割 | 飛地内の共同計算でありファイル交換ではない |
DeepMind:監督の前線を更新したい。AVERI:アクセス争いをできるだけ工学にし、監査はモデル評価だけではない。
# DeepMind double-blind eval pilot
# announced 2026-08-27
model: Gemini 2.5 Flash Lite
partners: Singapore AISI, OpenMined, AVERI, MLCommons
box: Google Cloud Confidential Space (TEE)
public_scores: none
prior_proxy: 2024 OpenMined + Anthropic + UK AISI (GPT-2)読み方と境界
- 点数なし ≠ 合格でも不合格でもない
- 公開面が示すのはアーキテクチャであり、Geminiの安全等級ではない。AILuminateの百分率を作らない。
- 二重盲検 ≠ 全ラボへの法的義務
- AVERIはEU GPAI行動規範やイリノイSB 315(2028年から監査)に触れる。今回は任意のパイロットのまま。
- 会議ツールとは別線
- この頁は評価の説明だけ。短い白板が必要なら wbmeet で部屋を作り、作成と参加 を見れば足りる。
確認したい問い
どのGeminiか。
DeepMindは “a Gemini Flash Lite model”。AVERIと二次報道は Gemini 2.5 Flash-Lite / Flash Lite。Ultraや未発表の大型旗艦とは書いていない。
なぜ点数を出さないか。
DeepMindの記事は手法が主題。AVERIは機密報告のみで問題と出力は非公開。二次報道も公開の課題別成績はないと確認する。
2024年の飛地デモとの違いは。
AVERI:2024年はGPT-2と5行の代理基準。2026年は専有の本番モデルと未使用のAILuminate。
独立再現できるか。
技術報告の要約では、個々のConfidential Space構築は独立再現できず、証明はGoogle経路が署名する。公開提出口ではなく、監査可能な構成の演示として読む。