不要往回翻:面向流式对话摘要的缺失证据记忆
摘要
本文介绍了 ReMEMBER,一种面向流式对话摘要的缺失证据记忆框架,它从长历史中检索并精炼证据,以在固定记忆预算下解决当前窗口中的空白,并附带一个用于评估的基准。
查看缓存全文
缓存时间: 2026/08/12 08:23
论文页面 - 不要回滚:面向流式对话摘要的缺失证据记忆
来源:https://huggingface.co/papers/2608.09043
摘要
一种用于流式对话摘要的框架,在固定内存预算下,从长历史中检索并提炼证据,以解决当前窗口缺失的上下文。现代平台的用户反复需要近期对话的摘要,但窗口本身很少包含足够的上下文来独立解释。我们将该场景形式化为流式对话摘要(https://huggingface.co/papers?q=streaming%20dialogue%20summarization),即系统必须在固定预算下,使用来自无界历史的选择性记忆(https://huggingface.co/papers?q=selective%20memory)来总结当前窗口。我们表明,核心挑战不在于访问多少历史,而在于记忆是否恢复了当前窗口预设所需的证据。我们构建了一个基准和评估协议,分别评估记忆是否包含缺口解决证据(https://huggingface.co/papers?q=gap-resolving%20evidence),以及生成的摘要是否反映了这些证据。我们提出ReMEMBER(https://huggingface.co/papers?q=ReMEMBER),一个缺失证据记忆框架(https://huggingface.co/papers?q=missing-evidence%20memory%20framework),它以未解决的窗口依赖为条件进行检索,并将检索到的片段提炼为固定预算下的证据密集型记忆(https://huggingface.co/papers?q=evidence-dense%20memory)。在历史多达16万词元的对话实验表明,在相同预算下,ReMEMBER(https://huggingface.co/papers?q=ReMEMBER)相比记忆构建基线,提升了记忆召回率和缺口解决完整性。
查看 arXiv 页面(https://arxiv.org/abs/2608.09043)查看 PDF(https://arxiv.org/pdf/2608.09043)添加到收藏(https://huggingface.co/login?next=%2Fpapers%2F2608.09043)
社区
论文作者
论文提交者
约19小时前(https://huggingface.co/papers/2608.09043#6a7b28ddc8280e6f13a6a99b)
通过拖入文本输入框、粘贴或点击此处上传图片、音频和视频。
点击或粘贴此处以上传图片
在你的智能体中获取此论文:
hf papers read 2608\.09043
没有最新的 CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash
引用此论文的模型0
暂无关联此论文的模型
在模型 README.md 中引用 arxiv.org/abs/2608.09043 以从本页面关联它。
引用此论文的数据集0
暂无关联此论文的数据集
在数据集 README.md 中引用 arxiv.org/abs/2608.09043 以从本页面关联它。
引用此论文的 Space0
暂无关联此论文的 Space
在 Space README.md 中引用 arxiv.org/abs/2608.09043 以从本页面关联它。
包含此论文的收藏1
相似文章
检测、重新掩码、修复:面向演变上下文的忠实摘要的扩散编辑
本文提出了Detect–Remask–Repair,一种基于扩散的框架,用于在上下文演变时进行摘要中的局部忠实性修复,并引入了StreamSum基准来评估此类设置。实验表明,它在忠实性、速度和内容保留之间提供了可控的权衡。
超越检索:渐进式潜在记忆演化用于流式视频理解
LatentStream 引入了一个渐进式潜在工作记忆框架,该框架内化流式视觉证据以进行连续推理,在视频基准测试中实现了最先进的结果。
基于记忆的推理:一种时间粒度自适应的免训练长视频理解框架
ReMem提出了一种双层记忆增强的关键帧选择框架,用于免训练的长视频理解,在多个基准上实现了最先进的零样本性能。
EviMem: 证据差距驱动的迭代检索用于长期对话记忆
EviMem结合了用于证据差距检测的IRIS和用于分层记忆的LaceMem,以改进长期对话记忆检索,在时间和多跳问题上实现了更高准确率和更低延迟。
重构正确片段:评估超越长上下文的交错对话记忆
本文介绍了 SCALE-QA,一个用于评估长上下文中交错对话记忆的基准,并提出了 TSIM,一种提高记忆重构精度的方法,优于现有基线。