标签
PRQ-KMeans是一种事后分词方法,通过移除全局均值成分、优化质心并使用投影残差来改进语义ID的残差量化,在工业搜索和公开推荐基准测试中实现了显著的性能提升。
提出了递归残差量化(RRQ),这是一种训练后量化框架,通过加法式残差细化,从单个LLM检查点获得多种有效精度,从而提高了灵活性和构建速度。
ContextRAG引入了一种无抽取方法,用于构建面向检索增强生成的层次图索引。该方法利用残差量化K均值(Residual-Quantization K-Means)和形式概念分析(Formal Concept Analysis),将大语言模型(LLM)调用和Token数量减少数个数量级,同时在多跳问题上保持具有竞争力的F1分数。