EVIE-8B是什麼:2026年騰訊ViDoRe文件檢索與評測全解析
騰訊放出 EVIE 兩檔檢索權重。先分 8.41B / 4.61B,再讀 ViDoRe 廠商表與壓縮檔落差。
2026 年 9 月 7 日前後,騰訊 IMA 產品中心與優圖實驗室放出 EVIE-8B 與 EVIE-4.5B:把掃描頁、表格和投影片當圖像檢索,不先抽文字。新聞不在再發明一個聊天旗艦,而在廠商自己的 ViDoRe 表,以及壓縮檔和滿分檔不是同一行。
檢索詞是 EVIE-8B 與 ViDoRe V3。下文依 Hugging Face 的 tencent/EVIE-8B / tencent/EVIE-4.5B 模型卡、GitHub Tencent/EVIE,以及 DataNorth 9 月 7 日綜述來寫。分數是廠商協議,不要寫成獨立實驗室複跑。同月另一份騰訊開源見 Hy4 preview。
官方寫成了什麼
EVIE 全稱 Evidence-Vector-Informed Embedding。兩檔都走 ColQwen3.5 晚交互:一頁存數百個向量,用 MaxSim 打分,而不是壓成一個摘要向量。8B 是教師,雙向注意力,4096 維;4.5B 是學生,單投影 Prefix-MRL。作者卡寫王紫菲(IMA)與溫偉(優圖,通訊)。訓練寫 775,635 對文件-查詢;放出的 a40 是兩臂權重混合(α=0.40)。技術報告寫即將更新。底座家族另見 Qwen3.8-27B。
怎麼讀這三行數字
- 1
先認 SKU,再談 66.75
8B 跑 colpali-engine 或 Sentence Transformers 的 MultiVectorEncoder,示例開 FlashAttention 與雙向注意力。4.5B 可在查詢時把 2048 維截到 1024、512、256、128 或 64,不必換模型。卡上寫 128 維時 ViDoRe V3 從 66.02 落到 65.27。許可 Apache 2.0,涵蓋權重與配套程式碼。
- 2
66.75 是廠商自訂協議
V3 寫 8 個領域 × 6 種查詢語言。8B 均分 66.75,領域從電腦 81.86 到物理 52.11。對照行:webAI-ColVec1.1-8b 65.32,VultronRetrieverPrime-8B 64.26,nemotron-colembed-vl-8b-v2 63.54。V1 nDCG@5 上 NVIDIA 該檔 92.65,EVIE-8B 92.18。皇冠只掛在較新的 V2/V3。
- 3
3.81 GiB 對應另一行分數
HAC 無需再訓練,把約 750 個頁向量收到 32 或 64。卡上預設壓縮是 d64 K32,百萬頁 3.81 GiB。同一張表:未壓縮 4.5B 的 V3 是 66.02;壓縮後 59.58,略低於 tomoro-colqwen3-embed-4b 的 60.16。兩行都在廠商表裡,不要只摘亮點。
晚交互換的是儲存,不是魔術
一頁幾百個向量能保住表格和版式,索引也會脹。Prefix-MRL 切寬度,HAC 切條數。卡承認壓縮與滿分不能同時成立。
138 項不是 AA 指數
四套量表是 nDCG、Recall、MAP、MRR。宏平均寫在卡上,例如 8B 的四榜 nDCG@10 宏平均 79.51。不要把它改貼成 Artificial Analysis Intelligence Index。
論文與顯存數字還沒出
發布說明寫權重、推理與評測套件已開源,架構消融與正式論文「即將更新」。速度與顯存峰值卡上沒有給一張部署帳單。
| 說法 | 能核對的來源 | 讀法 |
|---|---|---|
| 8.41B / 4.61B,Apache 2.0 | HF 模型卡 · GitHub Tencent/EVIE | 架構以官方表為準 |
| V3 66.75 / 66.02 | 模型卡 ViDoRe 對照表 | 廠商協議,不是獨立複跑 |
| 3.81 GiB 與 59.58 | 4.5B 卡 HAC / Prefix-MRL 行 | 壓縮檔另計,不要和滿分混一行 |
騰訊模型卡:完整技術細節、架構消融與正式論文將在後續更新。對照分是否與自家協議同機複跑,卡上沒有承諾。
# EVIE · Tencent IMA / Youtu · as of 2026-09
sku_8b: 8.41B on Qwen3.5-9B, 4096D
sku_45: 4.61B on Qwen3.5-4B, Prefix-MRL 64–2048D
license: Apache-2.0
hf: tencent/EVIE-8B · tencent/EVIE-4.5B
vidore_v3_ndcg10: 66.75 / 66.02
protocol: paired-all-pages-dedup+process_queries+ndcg2r-20260827
hac_index: 3.81 GiB / 1M pages (d64 K32)
compressed_v3: 59.58 (4.5B d64 K32)讀法與界線
- 廠商 ViDoRe ≠ 第三方指數
- 66.75 / 66.02 掛在自訂協議上。不要改貼成 AA Intelligence Index,也不要和同週聊天旗艦的自報榜比皇冠。
- Apache 2.0 ≠ 壓縮後仍是 66.02
- 許可涵蓋商用自託管。3.81 GiB 那一行對應 59.58。表格密集頁比純文字頁更吃聚類損失。
- 新聞頁不是會議說明書
- 只解釋發布與評測。要約短會白板,用 wbmeet 建房,見 如何建立與加入房間。
還想核對的問題
EVIE 是不是又一個聊天大模型?
不是。它是視覺文件檢索器:查詢是文字,文件是頁圖像,輸出是排序後的頁。不要和同月的 Hy4 preview 混成同一套權重。
66.75 能不能當成已經超過所有開源檢索器?
不能單獨當皇冠。它是廠商協議下的 V3 均分。V1 上 NVIDIA 的 nemotron-colembed-vl-8b-v2 更高。對照是否同機複跑未寫明。
3.81 GiB 是不是官方建議的預設部署?
卡把 d64 K32 寫成預設壓縮設定,同時把 66.02 寫在未壓縮滿分檔。部署前用你自己的頁測這兩行。
技術報告已經出來了嗎?
截至 2026-09-09,模型卡仍寫論文與消融即將更新。能對上的是倉庫、協議名和表內數字。