visual-document-retrieval

标签

Cards List
#visual-document-retrieval

ColNanoVDR: 通过最优传输实现多向量视觉文档检索的无文档查询蒸馏

Hugging Face Daily Papers ↗ · 3天前 缓存

ColNanoVDR 引入了首个用于多向量视觉文档检索的无文档查询蒸馏框架,利用最优传输对齐学生与教师的查询嵌入,实现更快的编码同时保持高性能。

0 人收藏 0 人点赞
#visual-document-retrieval

视觉文档检索中的生成式后期交互嵌入

Hugging Face Daily Papers ↗ · 2026-09-10 缓存

介绍了生成式后期交互嵌入(GLIE),用于压缩视觉文档检索向量,通过按需重新生成完整嵌入来提高存储约束下的准确性。

0 人收藏 0 人点赞
#visual-document-retrieval

tencent/EVIE-Preview-4.5B · Hugging Face

Reddit r/LocalLLaMA ↗ · 2026-08-17 缓存

EVIE-Preview-4.5B 是一款来自Tencent的最先进的多语言视觉文档检索模型,采用ColBERT风格的晚期交互,在ViDoRe基准测试中表现领先,使用128维的token嵌入。

0 人收藏 0 人点赞
#visual-document-retrieval

ConceptFormer:学习自适应潜在概念以实现视觉文档检索中的查询-文档对齐

Hugging Face Daily Papers ↗ · 2026-08-16 缓存

ConceptFormer学习用于视觉文档检索的连续潜在概念表示,无需文本中间体即可连接视觉证据和语义相关性,相对于基线实现了显著改进。

0 人收藏 0 人点赞
#visual-document-retrieval

DistilVDR: A Compact End-to-End Visual Document Retriever via Dual-Student Distillation

Hugging Face Daily Papers ↗ · 2026-08-11 缓存

DistilVDR is a compact 524M visual document retriever distilled from an 8B teacher via cosine alignment, achieving near-teacher accuracy on ViDoRe with 15.6x smaller indexes and faster indexing.

0 人收藏 0 人点赞
#visual-document-retrieval

@perdactor: 1/ 介绍 Argus-Retriever:首个采用延迟交互的视觉文档检索器,其文档表示会根据查询自适应调整……

X AI KOLs Following ↗ · 2026-06-06 缓存

Argus-Retriever 是一种新型的延迟交互视觉文档检索器,它根据查询自适应文档表示,在 ViDoRe 基准测试上以更小的索引实现了 SOTA 性能。

0 人收藏 0 人点赞
#visual-document-retrieval

使用 Sentence Transformers 训练和微调多模态 Embedding 与 Reranker 模型

Hugging Face Blog ↗ · 2026-04-16 缓存

本文提供了使用 Sentence Transformers 库训练和微调多模态 Embedding 与 Reranker 模型的技术指南,展示了在基于 Qwen3-VL 的视觉文档检索任务上的性能提升。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈