标签
本文形式化并实证测量了通过语言服务器协议进行语义检索是否为编码代理节省令牌,发现收益是条件性的且常常是负面的,建议采用自适应工具路由方法。
本文提出了针对交易法律文件LLM分析的令牌高效检索方法,证明结构化检索可以在使用更少的令牌和更低成本的同时,在答案质量上与全语料注入相匹配。
RAGless 是一种语义检索系统,它将用户问题与预生成的问题变体进行匹配,适用于封闭域 FAQ,省去了标准 RAG 中的 LLM 生成步骤,从而提高了精确度。
CompressKV针对基于GQA的大语言模型,提出了一种语义检索引导的KV缓存压缩方法,通过识别语义检索头来保留关键令牌。在LongBench任务中,仅使用3%的KV缓存即可实现超过97%的全缓存性能。
本文提出一种人在回路流水线,用于测量计算机科学项目对课程指南的覆盖情况,并纵向应用于CS2013和CS2023。该框架显示主题覆盖率近乎恒定,但由于新版指南提高了期望,认知深度存在差距。
介绍了IdioLink,一个包含10,700篇文档和2,140个查询的检索基准,覆盖107个习语,测试模型是否能够将习语表达与概念上等价的字面或释义含义联系起来。评估显示,当前的嵌入模型在此任务上表现不佳,突显了习语感知语义检索方面的空白。
本文提出JSPG,一种动态字典过滤框架,联合利用语义、拼音和字形特征提升中文上下文ASR的关键词检索准确率,解决同音错误导致语义检索性能下降的问题。