late-interaction

标签

Cards List
#late-interaction

视觉文档检索中的生成式后期交互嵌入

Hugging Face Daily Papers ↗ · 2026-09-10 缓存

介绍了生成式后期交互嵌入(GLIE),用于压缩视觉文档检索向量,通过按需重新生成完整嵌入来提高存储约束下的准确性。

0 人收藏 0 人点赞
#late-interaction

@lateinteraction: "延迟交互确实更好,但需要大量存储" 兄弟们崩溃了

X AI KOLs Timeline ↗ · 2026-08-27 缓存

一条推文讨论了延迟交互模型的存储问题,并分享了关于分层池化和非对称量化技术的有趣结果。

0 人收藏 0 人点赞
#late-interaction

天啊,我几乎忘了在做ColBERT相关工作时得到令人垂涎的结果是多么即时 - @antoine_chaffi…

X AI KOLs Following ↗ · 2026-08-26 缓存

作者表达了对ColBERT模型在机器学习中提供即时高质量结果的兴奋,并暗示即将发布开源模型,展示了晚期交互技术在没有存储开销下的效率。

0 人收藏 0 人点赞
#late-interaction

基于Sentence Transformers的多向量(延迟交互)嵌入模型

Hugging Face Blog ↗ · 2026-08-18 缓存

Sentence Transformers v6.0引入了MultiVectorEncoder,支持ColBERT风格的延迟交互检索,通过熟悉的API增强了多向量嵌入模型的功能。

0 人收藏 0 人点赞
#late-interaction

@lateinteraction:对于某些晚期交互来说,永远都不会太晚——太酷了 @sirupsen @turbopuffer!

X AI KOLs Timeline ↗ · 2026-07-30 缓存

Turbopuffer 宣布对晚期交互(late interaction)的 beta 支持,使 ColBERT 等模型能够将文本表示为 token 级向量,将快速的单向量 ANN 初步搜索与精确的晚期交互重排序相结合,以提高召回率。

0 人收藏 0 人点赞
#late-interaction

DenseOn与LateOn:面向多语言、长上下文和代码搜索的完全开放密集与延迟交互模型

arXiv cs.CL ↗ · 2026-07-30 缓存

本文介绍了完全开放的DenseOn和LateOn检索模型,这些模型在精心整理的英语数据上训练,并通过translate-train扩展到多语言设置,在其参数规模下实现了最先进的BEIR结果。

0 人收藏 0 人点赞
#late-interaction

ColGraphRAG:多模态GraphRAG的延迟交互证据检索

arXiv cs.AI ↗ · 2026-07-21 缓存

ColGraphRAG 在多模态 GraphRAG 中使用延迟交互 MaxSim 评分替代单向量双编码器相似度,用于对图链接图像候选进行排序,从而提高了 MultimodalQA 上的检索和问答准确率。

0 人收藏 0 人点赞
#late-interaction

量化并扩展晚期交互检索模型的理论容量

Hugging Face Daily Papers ↗ · 2026-07-07 缓存

本文量化并扩展了晚期交互检索模型的理论容量,证明MaxSim可以复制非负向量之间的内积,并提出适用于任意实值向量的Signed MaxSim,揭示了内积模型与晚期交互模型之间的表示差距。

0 人收藏 0 人点赞
#late-interaction

所有视觉标记都同等重要吗?面向视觉-语言检索的保留对象证据的标记合并

Hugging Face Daily Papers ↗ · 2026-07-06 缓存

介绍了SaMer,一种面向对象的标记合并框架,用于压缩视觉-语言检索中的图像侧标记,同时保留对象级证据,显著减少存储并提升检索性能。

0 人收藏 0 人点赞
#late-interaction

非对称量化:实现近无损检索且存储降低97%

Hacker News Top ↗ · 2026-06-29 缓存

Mixedbread Search 引入了非对称量化用于后期交互检索,通过将文档向量存储为二进制符号,同时保持查询向量为更高精度,实现了近无损质量且存储减少97%。

0 人收藏 0 人点赞
#late-interaction

@mixedbreadai: https://x.com/mixedbreadai/status/2071678747439505816

X AI KOLs Following ↗ · 2026-06-29 缓存

Mixedbread AI 引入了用于后期交互检索的非对称量化技术,通过将文档向量存储为二进制符号同时保持查询向量高精度,实现了32倍的存储缩减且质量损失极小,使得后期交互在十亿级生产系统中变得实用。

0 人收藏 0 人点赞
#late-interaction

@RuiTheBaker:刚刚目睹了Mixedbread如何把我的存储桶变成了一个延迟交互数据库。

X AI KOLs Following ↗ · 2026-06-23 缓存

Mixedbread宣布,用户现在可以自带云存储桶,从而通过延迟交互模型实现零保留索引和搜索。

0 人收藏 0 人点赞
#late-interaction

@topk_io: https://x.com/topk_io/status/2065172828161200563

X AI KOLs Timeline ↗ · 2026-06-11 缓存

TopK 推出了 semantic_index,这是一种单一的 schema 注解,抽象了生产系统中多向量检索的复杂性,实现了亚秒级延迟和高吞吐量的最先进性能。

0 人收藏 0 人点赞
#late-interaction

@antoine_chaffin: 无论你是GPU匮乏者还是GPU富裕者,今天发布的PyLate总有一款适合你!GPU追求者:MaxSim内核显著…

X AI KOLs Following ↗ · 2026-06-11 缓存

PyLate的发布引入了MaxSim内核,用于GPU加速训练,内存需求更低;以及TACHIOM,用于在CPU上实现快速多向量索引和搜索。

0 人收藏 0 人点赞
#late-interaction

@perdactor: 1/ 介绍 Argus-Retriever:首个采用延迟交互的视觉文档检索器,其文档表示会根据查询自适应调整……

X AI KOLs Following ↗ · 2026-06-06 缓存

Argus-Retriever 是一种新型的延迟交互视觉文档检索器,它根据查询自适应文档表示,在 ViDoRe 基准测试上以更小的索引实现了 SOTA 性能。

0 人收藏 0 人点赞
#late-interaction

@SilvioMartinico: 晚期交互多向量检索生态系统正在爆炸式发展。为了帮助区分信号与噪声……

X AI KOLs Timeline ↗ · 2026-06-02 缓存

一份精选的顶级模型、引擎、库和数据集的列表,用于晚期交互多向量检索,组织在'Awesome Multivector Retrieval'资源中。

0 人收藏 0 人点赞
#late-interaction

@antoine_chaffin: 虽然只是BEIR,但v2与LateOn之间相差近10分。我们也有充分证据表明该模型的泛化能力……

X AI KOLs Timeline ↗ · 2026-05-30 缓存

LateOn作为新一代ColBERT模型,在BEIR上相比v2提升了近10个百分点,并且在BEIR之外也表现出良好的泛化能力,同时在PyLate中的使用方法完全相同。

0 人收藏 0 人点赞
#late-interaction

@yifeiwang77: 感谢分享我们的工作 @lateinteraction @sum!这个想法极其简单:- 多向量检索成本高昂……

X AI KOLs Timeline ↗ · 2026-05-30 缓存

作者分享了他们通过将k-means用作top-1稀疏编码来降低多向量检索成本的工作。Omar Khattab补充说,在无监督稀疏自编码器上使用神经元级别倒排索引的晚期交互稀疏检索效果很好。

0 人收藏 0 人点赞
#late-interaction

@lateinteraction: Late-interaction稀疏检索?利用神经元级倒排索引,基于无监督稀疏自编码器。效果更佳…

X AI KOLs Timeline ↗ · 2026-05-30 缓存

本文提出了一种使用无监督稀疏自编码器和自然倒排索引的单阶段稀疏编码方法,以加速多向量检索,其效果优于传统的基于k-means的方法。

0 人收藏 0 人点赞
#late-interaction

PROTOCOL: 用于蛋白质同源搜索的后期交互检索

arXiv cs.LG ↗ · 2026-05-29 缓存

ProtoCol将后期交互检索应用于蛋白质同源搜索,将蛋白质表示为残基嵌入集,并使用MaxSim进行评分,在远程同源基准上优于池化方法和基于比对的方法。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈