AI 日报 · 2026-09-07
腾讯混元同日开源两款基于 Qwen3.5 的视觉文档检索模型 EVIE-8B 与 EVIE-4.5B,采用 Apache-2.0 并公开权重、推理与评测全链路。两者都走晚期交互多向量路线,以保留版面、表格和图表等细粒度信息,在 ViDoRe V3 上分别取得 66.75 和 66.02 的 nDCG…
腾讯混元同日开源两款基于 Qwen3.5 的视觉文档检索模型 EVIE-8B 与 EVIE-4.5B,采用 Apache-2.0 并公开权重、推理与评测全链路。两者都走晚期交互多向量路线,以保留版面、表格和图表等细粒度信息,在 ViDoRe V3 上分别取得 66.75 和 66.02 的 nDCG@10,并在 138 项多语言任务中验证领先。4.5B 版本通过能力感知蒸馏从 8B 教师模型获得,并借助 Prefix-MRL 与 HAC 标记压缩支持低至约 32 token/页、百万页索引仅 3.81 GiB 的落地配置。整体看,这次发布既给出高精度文档检索方案,也补齐了轻量化和存储效率的工程路径。
东亚一手(中国厂商官方 & 模型发布)
腾讯(混元)
⭐⭐⭐ [模型发布] tencent/EVIE-8B
Tencent Hunyuan Models (HuggingFace) · 2026-09-07 · 原文 ↗
腾讯混元发布 EVIE-8B,一款基于 Qwen3.5 的 8B 规模视觉文档检索模型,采用 Apache-2.0 许可并完整开源权重、推理流程与评测套件。该模型使用双向注意力与 4096 维逐 token 多向量表示,通过 late-interaction MaxSim 机制保留版面、排版、图表和表格等细粒度信息。在 ViDoRe V3 上取得 66.75 nDCG@10 的成绩,并在 ViDoRe V1、V2 与 JinaVDR 共 138 项任务上进行了验证,排名高于同类视觉文档检索模型。EVIE-8B 同时作为教师模型,为轻量级 EVIE-4.5B Prefix-MRL 提供能力感知的关系与 margin 蒸馏目标。
打分理由
这是腾讯官方发布的新模型,完整开源并附有清晰的基准数据,属于有影响力的垂类模型发布,但并非主力旗舰 LLM,故定档为 3。
⭐⭐⭐ [模型发布] tencent/EVIE-4.5B
Tencent Hunyuan Models (HuggingFace) · 2026-09-07 · 原文 ↗
腾讯混元发布开源视觉文档检索模型 EVIE-4.5B 和 EVIE-8B(基于 Qwen3.5)。采用晚期交互多向量范式,通过单投影 Prefix-MRL 支持在 64–2048 维之间运行时截断;训练无关的 HAC 标记压缩可将单页 token 从约 750 压缩至 32 个,百万页索引存储降至 3.81 GiB。在 ViDoRe V3 上 8B 模型得 66.75、4.5B 得 66.02,并在 ViDoRe V1/V2/V3 与 JinaVDR 共 138 项多语言任务上评估。4.5B 版本通过 ARD 蒸馏自 8B 教师模型。全部权重、训练流程、压缩算法与评测代码均已开源(Apache-2.0)。
打分理由
腾讯官方开源视觉文档检索模型,带来新方法与 SOTA benchmark,属非旗舰但专业领域有实质影响的模型发布,给 3。
每天 3–5 条 agent 生态一手信号,中英双语。不错过重要更新 → 订阅邮件
Loading...