标签
Introduces DECAF, a method that decomposes perturbation responses into evidence, contradiction, and fragility components, improving interpretability over raw response magnitude and achieving strong results across vision benchmarks.
本文识别并描述了分解引发的上下文-记忆冲突(DI-CC),这是分解后验证流水线中的一种故障模式,其中分解会用模型的参数化信念替代源文本。作者表明它在机制上与经典的上下文-记忆冲突相关,SelfCheckGPT 无法检测到它,而上下文感知解码可以抑制它,但会引入严重的解析失败。
本文介绍了TriQua,一个用于LLM事实性评估的框架,它自适应地将事实表示为三元组或带有上下文限定符的超关系事实,并提出了TriQuaScore用于细粒度的事实性评分。实验表明,TriQua与人工标注结果高度一致,并且在基于证据的验证方面优于现有方法。
本文表明,逐块验证在多跳RAG中会失败,因为没有任何单个块是充分的,并提出基于分解的验证方法来修复这一问题,在多个数据集上展示了显著改进。
提出DWM框架,该框架将潜在世界模型的转移分解为动作驱动和动作不变(世界效应)组件,在具有持久世界效应的基准上提高了规划成功率。
本文提出了一种用于超维计算分解的高效量子比特量子框架,将表示成本从O(D)量子比特降低到O(log D)量子比特,同时保持二次搜索优势,实现了最多2000倍的量子比特减少。
Mitchell Hashimoto 分享了使用AI代理的经验法则:超过1500行的diff意味着需要分解问题,并概述了一种使用代理生成代码进行迭代开发的模式。
本文提出一种多模态学习的信息论分析,揭示了捕捉样本特定交互的必要性,并提出了DMIL范式,通过变分分解和微调显式建模和学习这些交互,实现了优越性能。
提出TD-Grokking,一种训练时分解框架,递归地将棘手的零奖励问题分解为可验证的子问题,使大语言模型能够从失败轨迹中学习。在数学和医学推理任务上优于普通GRPO及基线方法。
DeSQ是一个基于分解的框架,用于从自然语言问题生成SPARQL查询。它将复杂问题分解为原子约束,将它们映射到SPARQL片段,并组装成完整查询,在五个基准测试中的四个上优于现有技术。
本文将注意力交互矩阵分解为路由(反对称)和过滤(对称)两个组成部分,并引入 S-D 注意力以解耦它们。揭示了路由中的谱级联现象,可预测注意力简化的位置,从而在极小困惑度损失下实现显著的参数减少。
提出PESD-TSF,一种受物理启发的结构化分解框架,用于长期时间序列预测,通过乘法周期性门控、多尺度结构化编码器和跨尺度协作注意力来解决周期感知退化、趋势-噪声纠缠和跨变量依赖关系丢失的问题。