EVIE-8B란: 2026 텐센트 ViDoRe 문서 검색과 평가

텐센트가 EVIE 두 가중치를 냈다. 8.41B / 4.61B, ViDoRe 자체 표, 압축 행 낙차를 나눠 읽는다.

2026년 9월 7일 전후 텐센트 IMA 제품 센터와 유투 랩이 EVIE-8BEVIE-4.5B를 냈다. 스캔 페이지·표·슬라이드를 이미지로 검색하고 먼저 텍스트를 뽑지 않는다. 뉴스는 또 다른 채팅 기함이 아니라 연구실 자체 ViDoRe 표와, 압축 SKU와 헤드라인 점수가 다른 행이라는 점이다.

검색어는 EVIE-8BViDoRe V3다. 근거는 Hugging Face tencent/EVIE-8B / tencent/EVIE-4.5B, GitHub Tencent/EVIE, DataNorth 9월 7일 요약이다. 점수는 벤더 프로토콜이며 독립 랩 재실행으로 바꿔 쓰지 않는다. 같은 달 다른 공개는 Hy4 preview.

8.41B / 4.61B Apache 2.0ViDoRe V3 66.75 / 66.02압축 행 59.58

공식이 말한 출고물

EVIE는 Evidence-Vector-Informed Embedding이다. 두 SKU 모두 ColQwen3.5 지연 상호작용: 페이지당 수백 벡터, MaxSim 채점, 하나의 요약 벡터로 누르지 않는다. 8B는 교사(양방향 어텐션, 4096차원), 4.5B는 학생(단일 투영 Prefix-MRL). 카드는 왕쯔페이(IMA)와 원웨이(유투, 교신). 훈련은 문서-질의 775,635쌍. a40는 두 팔 가중치 혼합(α=0.40). 정식 논문은 예정. 같은 베이스 가족은 Qwen3.8-27B.

66.75
EVIE-8B · V3 nDCG@10
66.02
EVIE-4.5B · 전폭 행
3.81 GiB
백만 페이지 · d64 K32 인덱스

세 숫자를 읽는 법

  1. 1

    66.75 전에 SKU를 고정한다

    8B 예는 colpali-engine 또는 Sentence Transformers MultiVectorEncoder, FlashAttention과 양방향 어텐션. 4.5B는 질의 시 2048차원을 1024, 512, 256, 128, 64로 자를 수 있고 다른 체크포인트는 필요 없다. 카드는 128차원에서 V3가 66.02에서 65.27. 라이선스는 Apache 2.0.

  2. 2

    66.75는 자체 벤더 프로토콜

    V3는 8영역 × 6질의 언어. 8B 평균 66.75, 컴퓨터과학 81.86부터 물리 52.11. 대조: webAI-ColVec1.1-8b 65.32, VultronRetrieverPrime-8B 64.26, nemotron-colembed-vl-8b-v2 63.54. V1 nDCG@5에서 NVIDIA는 92.65, EVIE-8B는 92.18. 왕관은 더 새 V2/V3에 있다.

  3. 3

    3.81 GiB는 다른 점수에 대응한다

    HAC는 추가 훈련 없이 약 750 벡터를 32 또는 64로 줄인다. 기본 압축은 d64 K32, 백만 페이지 3.81 GiB. 같은 표: 비압축 4.5B V3는 66.02, 압축은 59.58로 tomoro-colqwen3-embed-4b 60.16보다 약간 낮다. 두 행 모두 벤더 표. 하이라이트만 인용하지 말 것.

01

지연 상호작용이 바꾸는 것은 저장이지 마법이 아니다

수백 벡터는 표와 레이아웃을 남기고 인덱스도 커진다. Prefix-MRL은 폭, HAC는 개수. 카드 자체가 압축 점수와 전폭 점수를 다른 설정으로 적는다.

02

138과제는 AA 지수가 아니다

척도는 nDCG, Recall, MAP, MRR. 매크로 평균은 카드에 있다. 예: 8B 네 보드 nDCG@10 79.51. Artificial Analysis Intelligence Index로 바꿔 붙이지 말 것.

03

논문과 메모리 청구서는 아직이다

발표는 가중치·추론·평가 세트가 공개라 하고 소거와 정식 논문은 upcoming. 속도와 피크 VRAM 청구서는 없다.

주장확인할 출처읽는 법
8.41B / 4.61B, Apache 2.0HF 카드 · GitHub Tencent/EVIE구조는 공식 표
V3 66.75 / 66.02카드 ViDoRe 대조표벤더 프로토콜, 독립 재실행 아님
3.81 GiB와 59.584.5B 카드 HAC / Prefix-MRL압축 행은 헤드라인과 별개

텐센트 카드: 기술 세부, 소거, 정식 논문은 이후 갱신. 대조 점수를 같은 프로토콜 상자에서 다시 돌렸다는 약속은 없다.

# EVIE · Tencent IMA / Youtu · as of 2026-09
sku_8b:  8.41B on Qwen3.5-9B, 4096D
sku_45:  4.61B on Qwen3.5-4B, Prefix-MRL 64–2048D
license: Apache-2.0
hf: tencent/EVIE-8B · tencent/EVIE-4.5B
vidore_v3_ndcg10: 66.75 / 66.02
protocol: paired-all-pages-dedup+process_queries+ndcg2r-20260827
hac_index: 3.81 GiB / 1M pages (d64 K32)
compressed_v3: 59.58 (4.5B d64 K32)

읽기와 경계

벤더 ViDoRe ≠ 제3자 지수
66.75 / 66.02는 이름 있는 자체 프로토콜. AA Intelligence Index로 바꿔 쓰지 말고, 같은 주 채팅 기함 자체 보고 표와 우승을 겨루지 않는다.
Apache 2.0 ≠ 압축 후에도 66.02
라이선스는 상업 셀프호스트를 덮는다. 3.81 GiB 행은 59.58. 밀도 높은 재무 표는 텍스트 페이지보다 군집 손실이 크다.
이 뉴스 페이지는 회의 설명서가 아니다
공개와 평가만 설명한다. 짧은 허들과 화이트보드가 필요하면 wbmeet에서 방을 만들고 방 만들기와 참가를 본다.

더 확인할 질문

EVIE는 또 다른 채팅 LLM인가?

아니다. 시각 문서 검색기다. 질의는 텍스트, 문서는 페이지 이미지, 출력은 순위 페이지. 같은 달 Hy4 preview와 한 가중치로 겹치지 말 것.

66.75는 모든 공개 검색기를 이겼다는 뜻인가?

그것만으로는 아니다. 연구실 프로토콜의 V3 평균이다. V1에서는 NVIDIA nemotron-colembed-vl-8b-v2가 더 높다. 대조의 동일 기기 재실행은 주장되지 않았다.

3.81 GiB가 공식 기본 배포인가?

카드는 d64 K32를 기본 압축으로 적고 66.02는 비압축 행에 둔다. 자기 페이지에서 두 행을 잰다.

기술 보고가 나왔나?

2026-09-09 기준 카드는 논문과 소거를 upcoming이라고 쓴다. 확인할 것은 저장소, 프로토콜 이름, 표 숫자다.

무료로 회의 시작