colbert

标签

Cards List
#colbert

MoganColBERT-TR:一个用于土耳其语的后交互多向量检索模型

arXiv cs.CL ↗ · 2026-08-28 缓存

本文介绍了MoganColBERT-TR,一个用于土耳其语的后交互多向量检索模型,通过从先前编码器进行蒸馏训练,在土耳其语BEIR数据集上实现了具有竞争力的零样本性能。

0 人收藏 0 人点赞
#colbert

天啊,我几乎忘了在做ColBERT相关工作时得到令人垂涎的结果是多么即时 - @antoine_chaffi…

X AI KOLs Following ↗ · 2026-08-26 缓存

作者表达了对ColBERT模型在机器学习中提供即时高质量结果的兴奋,并暗示即将发布开源模型,展示了晚期交互技术在没有存储开销下的效率。

0 人收藏 0 人点赞
#colbert

@lateinteraction:对于某些晚期交互来说,永远都不会太晚——太酷了 @sirupsen @turbopuffer!

X AI KOLs Timeline ↗ · 2026-07-30 缓存

Turbopuffer 宣布对晚期交互(late interaction)的 beta 支持,使 ColBERT 等模型能够将文本表示为 token 级向量,将快速的单向量 ANN 初步搜索与精确的晚期交互重排序相结合,以提高召回率。

0 人收藏 0 人点赞
#colbert

@liquidai: 在上下文窗口中存储过多工具会增加延迟,并可能导致错误选择工具。在本演示中,我们……

X AI KOLs Following ↗ · 2026-06-19 缓存

Liquid AI 展示了如何使用 LFM2.5-ColBERT-350M 作为过滤器,从151个工具中仅选出最相关的五个,从而减少延迟并提高工具选择准确性。

0 人收藏 0 人点赞
#colbert

@maximelabonne: LFM2.5-ColBERT-350M 是一个出奇可靠的智能工具选择器。我们给了它151个工具,它总能把最相关的5个挑出来……

X AI KOLs Following ↗ · 2026-06-18 缓存

LFM2.5-ColBERT-350M 是一个模型,能从151个工具中可靠地选出最相关的工具,节省令牌并提高准确性,非常适合代理型边缘模型。

0 人收藏 0 人点赞
#colbert

@liquidai: 介绍 LFM2.5-Embedding-350M 和 LFM2.5-ColBERT-350M:两款为超快且精准的多语言检索模型

X AI KOLs Following ↗ · 2026-06-18 缓存

Liquid AI 推出 LFM2.5-Embedding-350M 和 LFM2.5-ColBERT-350M,这两款多语言检索模型经过优化,可在11种语言中实现快速准确的搜索,延迟低至1.5毫秒。

0 人收藏 0 人点赞
#colbert

@antoine_chaffin: 派对结束了,是时候对ColBERT模型进行正则化,以修复高效的ANN MUVERA和SMVE,它们曾承诺简化多向量……

X AI KOLs Following ↗ · 2026-06-16 缓存

作者发现,对ColBERT模型进行正则化可以修复高效的ANN方法MUVERA和SMVE(这些方法在现代ColBERT模型上出现了问题),并以一种意想不到的方式简化了多向量检索基础设施。

0 人收藏 0 人点赞
#colbert

@raphaelsrty:在GPU上计算最大相似度(ColBERT、ColPali的评分步骤)可以被优化,这正是@tonywu_71所做的。我……

X AI KOLs Following ↗ · 2026-06-10 缓存

Tony Wu发布了late-interaction-kernels (LIK):用于MaxSim的融合Triton内核,MaxSim是ColBERT和ColPali背后的评分步骤,已集成到PyLate和colpali-engine中,提供了内存效率和性能提升。

0 人收藏 0 人点赞
#colbert

@_reachsumit:ColBERTSaR:通过乘积量化实现稀疏化ColBERT索引 @EYangTW等人提出了一种嵌入量化方法……

X AI KOLs Following ↗ · 2026-06-05 缓存

ColBERTSaR提出了一种使用乘积量化的嵌入量化方法,将ColBERT索引转换为真正的倒排索引,与单比特PLAID相比,索引大小减少50-70%,同时保持检索效果。

0 人收藏 0 人点赞
#colbert

@antoine_chaffin: 虽然只是BEIR,但v2与LateOn之间相差近10分。我们也有充分证据表明该模型的泛化能力……

X AI KOLs Timeline ↗ · 2026-05-30 缓存

LateOn作为新一代ColBERT模型,在BEIR上相比v2提升了近10个百分点,并且在BEIR之外也表现出良好的泛化能力,同时在PyLate中的使用方法完全相同。

0 人收藏 0 人点赞
#colbert

@_reachsumit: 告别K-means:单阶段稀疏编码实现高效多向量检索 @Veritas2026 等人替代向量聚…

X AI KOLs Timeline ↗ · 2026-05-29 缓存

本文提出单阶段稀疏检索(SSR),用稀疏自编码器和倒排索引替代K-means聚类,实现了15倍的索引加速和一半的检索延迟,同时在BEIR基准上提升了准确性。

0 人收藏 0 人点赞
#colbert

LiquidAI/LFM2.5-ColBERT-350M

Hugging Face Models Trending ↗ · 2026-05-20 缓存

LiquidAI 发布 LFM2.5-ColBERT-350M,这是一种后期交互多语言检索模型,同时还有一个密集双编码器变体,两者均基于 LFM2.5-350M-Base,支持 11 种语言,并设计为 RAG 管道的即插即用替代品。

0 人收藏 0 人点赞
#colbert

@bo_wangbo:我们在内部随意训练了很多SOTA搜索模型,要不要时不时搞个小发布?

X AI KOLs Following ↗ · 2026-05-18 缓存

暗示即将以低调方式发布一个强大的开源多语言ColBERT搜索模型。

0 人收藏 0 人点赞
#colbert

@bo_wangbo: 好吧,也许这是个好时机?我们在pplx训练了一个小型colbert模型,它是对pplx-embed-0.6的继续训练…

X AI KOLs Following ↗ · 2026-05-18 缓存

Perplexity AI发布了pplx-embed-v1-late-0.6b,一个用于检索的小型ColBERT后期交互嵌入模型,基于他们现有的嵌入模型微调并针对MaxSim评分进行了优化,现已在HuggingFace上开源。

0 人收藏 0 人点赞
#colbert

在@huggingface上发布我的第一个内核:MaxSim后期交互检索(ColBERT / PyLate)的瓶颈在于材料……

X AI KOLs Following ↗ · 2026-05-18 缓存

在 Hugging Face 上发布了一个内核,通过使用分块评分和 SIMD 组矩阵运算(Metal 和 WMMA)来加速 MaxSim 后期交互检索,比朴素实现获得了 3–5 倍的加速。

0 人收藏 0 人点赞
#colbert

@AmelieTabatta: ColBERT 模型继续让体积为其 54 倍的模型颜面扫地,这就是我们信任 Late Interaction @LightOnIO 的原因。一条 1 年…

X AI KOLs Following ↗ · 2026-05-12 缓存

本文强调了 ColBERT 模型如何凭借延迟交互(late interaction)技术和极少微调,尽管体积更小且发布时间更早,仍优于 Qwen3-embed-8B 等更大规模的模型。

0 人收藏 0 人点赞
#colbert

@antoine_chaffin: Reason-ModernColBERT 几乎完美解决了 BrowseComp-Plus,碾压 SOTA,并超越了 54 倍大的模型。还不错吧…

X AI KOLs Following ↗ · 2026-05-12 缓存

Reason-ModernColBERT 在 BrowseComp-Plus 上取得了近乎完美的结果,超越了 SOTA 和 54 倍大的模型,随后 Agent-ModernColBERT 通过极少的训练进一步提升了性能。

0 人收藏 0 人点赞
#colbert

@raphaelsrty:今天我们开源 LateOn 与 DenseOn,两款 149 M 参数的开放检索模型

X AI KOLs Following ↗ · 2026-04-21 缓存

Raphael 开源两款检索模型:LateOn(ColBERT 多向量)与 DenseOn(单向量),均 149 M 参数,在 BEIR 上超越体量 4 倍的大模型。

0 人收藏 0 人点赞
#colbert

@lateinteraction: 主题演讲录像现已上传至 YouTube,供所有要求我们在 X 平台以外托管的用户观看。https://youtube.com/watch?v=Z2…

X AI KOLs Timeline ↗ · 2026-04-13 缓存

一场主题演讲认为,后期交互检索(如 ColBERT 风格)是 AI 规模信息检索研究中最具前景的方向,并指出单向量密集检索存在根本性缺陷,呼吁信息检索社区大幅提升研究雄心。演讲引入 LIMIT 基准测试,作为密集检索泛化能力不足的佐证,并呼吁在 2030 年前实现范式转变。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈