semantic-compression

标签

Cards List
#semantic-compression

语义压缩树:通过分层语义残差实现多分辨率知识检索

arXiv cs.AI · 2026-08-25 缓存

介绍语义压缩树(SCT)用于检索增强生成(RAG)中的分层知识检索,展示了在令牌使用上的效率提升,但与扁平方法相比检索性能表现不一。

0 人收藏 0 人点赞
#semantic-compression

SeKV:面向长上下文LLM推理的分辨率自适应KV缓存与分层语义记忆

arXiv cs.CL · 2026-07-01 缓存

SeKV是一种分辨率自适应的KV缓存方法,它将上下文组织成基于熵引导的语义片段,并存储在GPU-CPU层级结构中,从而在解码过程中实现选择性Token级重建,同时在128K上下文下相比全缓存减少53.3%的GPU内存占用。

0 人收藏 0 人点赞
#semantic-compression

如果上下文压缩是扩散噪声函数会怎样?提案 + 未经训练模型实验的真实结果 [R]

Reddit r/MachineLearning · 2026-06-26

提议将语义压缩视为一种扩散噪声函数,用于处理超出模型窗口的庞大上下文,采用多遍读取并以递减的压缩级别进行。未经训练模型的实验表明,各组件在隔离状态下工作良好,但完整链条需要训练来解决绑定瓶颈。

0 人收藏 0 人点赞
#semantic-compression

SimpleMem: 面向大语言模型智能体的高效终身记忆

Papers with Code Trending · 2026-01-05 缓存

介绍SimpleMem,一种面向LLM智能体的高效记忆框架,利用语义无损压缩提升准确率并降低token消耗,F1分数提升26.4%,推理时token使用量减少高达30倍。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈