inference-time

标签

Cards List
#inference-time

大型推理模型中推理时间的能力与效率扩展

arXiv cs.LG ↗ · 3天前 缓存

本文评估了使用Chain-of-Thought推理的大型语言模型的能力和效率,发现随着模型大小的增加,能力增益减弱,而效率改善甚微。

0 人收藏 0 人点赞
#inference-time

MIRAGE: 基于强化学习引导的多角度创造性语言模型推理

arXiv cs.CL ↗ · 6天前 缓存

论文介绍了 MIRAGE,这是一个推理时框架,通过使用强化学习引导动态切换视角来增强 LLM 推理,在各种基准测试中优于现有的提示方法。

0 人收藏 0 人点赞
#inference-time

层级、汇聚与缩放:多模态大语言模型的自适应证据选择

arXiv cs.AI ↗ · 2026-09-16 缓存

本文提出AREA,一种无需训练的推理时方法,自适应分配多模态大语言模型中的证据高亮,提升在基于知识的视觉问答和标准多模态基准测试上的性能。

0 人收藏 0 人点赞
#inference-time

通过稀疏自编码器的测试时遗忘

arXiv cs.LG ↗ · 2026-09-16 缓存

ARIA是一种用于大型语言模型的测试时遗忘方法,它使用稀疏自编码器在推理过程中抑制不需要的知识,而不修改权重,从而改善遗忘-保留权衡,并在对抗性攻击中保持稳健。

0 人收藏 0 人点赞
#inference-time

多智能体LLM工作流的推理时图工程

arXiv cs.AI ↗ · 2026-09-10 缓存

本文介绍了ReActNet,一个无需训练的框架,为多智能体LLM系统合成任务条件化的时序工作流图,提升协调性和性能,超越固定或学习拓扑的基线。

0 人收藏 0 人点赞
#inference-time

基于ERASE的动态遗忘机制无需显式去学习

arXiv cs.LG ↗ · 2026-09-10 缓存

ERASE 是一个用于机器学习模型功能性遗忘的框架,无需修改权重,通过输入扰动在推理期间抑制私有数据影响,以实现隐私合规。

0 人收藏 0 人点赞
#inference-time

无悔的隐私:差分隐私推理时对齐

arXiv cs.LG ↗ · 2026-08-28 缓存

本文介绍了Private Best-of-N (PrivBoN)和Private Inference-Time Pessimism (PrivITP)方法,这些方法在推理时对齐中向奖励分数添加校准噪声,以实现差分隐私并减轻奖励哈希,且额外对齐成本最小。

0 人收藏 0 人点赞
#inference-time

通过潜在向量引导的可控情感生成

arXiv cs.CL ↗ · 2026-08-27 缓存

本文提出EmoVec,一个轻量级框架,通过潜在向量引导在大型语言模型中实现可控情感生成,无需更新模型权重即可实现对情感强度的连续控制。

0 人收藏 0 人点赞
#inference-time

CritICL: 推理时利用小型语言模型失败模式的弱到强泛化

Hugging Face Daily Papers ↗ · 2026-08-27 缓存

CritICL 是一个推理时框架,它利用来自较小模型的结构化失败模式作为批判性指导来增强大型语言模型的推理能力,其性能优于标准上下文学习,并降低了生成和令牌成本。

0 人收藏 0 人点赞
#inference-time

GGSS:用于生成式视觉语言模型推理时去偏的测地线门控球面引导

Hugging Face Daily Papers ↗ · 2026-08-26 缓存

GGSS通过在推理过程中使用自适应门控沿测地线弧引导视觉令牌,减少生成式视觉语言模型中的人口统计偏差,同时保持视觉语言准确性。

0 人收藏 0 人点赞
#inference-time

在推理时使用读出反馈引导循环推理器

arXiv cs.LG ↗ · 2026-08-26 缓存

本文介绍了读出反馈(RoFB),一种测试时干预方法,利用自身的读出概率引导循环推理模型中的潜在动态,在数独和迷宫任务上无需重新训练即可获得性能提升。

0 人收藏 0 人点赞
#inference-time

运行上下文的recirculation修复技术

Reddit r/singularity ↗ · 2026-08-26 缓存

论文介绍了'recirculation',这是一种针对基础模型的推理时架构增强技术,通过改进状态跟踪,显著降低了困惑度并提高了准确性,在生成过程中无额外延迟。

0 人收藏 0 人点赞
#inference-time

大型语言模型中对抗性政治偏见的推理时缓解

arXiv cs.CL ↗ · 2026-08-18 缓存

本文提出了使用思维链提示和直接偏好优化来缓解大型语言模型中对抗性政治偏见的推理时策略,展示了在政治中立性分数上的显著改进。

0 人收藏 0 人点赞
#inference-time

可达性并非实现:追踪LLM基准测试提升的来源

arXiv cs.AI ↗ · 2026-08-05 缓存

本文介绍了一种问题级审计框架,用于区分LLM基准测试中的“已实现”答案与“可达”答案,表明总体得分提升往往来自生成已经可达的答案,而非扩展真实能力,并且在匹配预算下,随机层路由与结构化搜索表现相当。

0 人收藏 0 人点赞
#inference-time

面向公平强化学习的推理时策略对齐

arXiv cs.LG ↗ · 2026-08-04 缓存

本文提出了一种推理时策略塑形框架,受大语言模型推理时对齐的启发,无需重新训练即可将预训练的强化学习策略引导至基于福利的公平目标。

0 人收藏 0 人点赞
#inference-time

推理时指令层次控制

arXiv cs.CL ↗ · 2026-07-30 缓存

介绍V-Steer,一种无需训练的推理时方法,通过编辑缓存的值向量恢复语言模型中的指令层次,在受控基准上将主要约束准确率从低于18%提升至92%,且开销可忽略。

0 人收藏 0 人点赞
#inference-time

DiFA:扩散模型的推理时前向过程对齐方法

Hugging Face Daily Papers ↗ · 2026-07-20 缓存

提出DiFA,一种无需训练的框架,将推理时的数据预测优化重新定义为使用卡尔曼滤波的序列状态估计,显著提升了CIFAR-10和ImageNet上的生成保真度。

0 人收藏 0 人点赞
#inference-time

Motion4Motion:推理时的跨主体运动迁移

Hugging Face Daily Papers ↗ · 2026-07-13 缓存

Motion4Motion 是一个无需训练的运动迁移框架,它从视频中建模运动流而不是依赖骨架结构,从而在推理时实现跨物种(例如,从人类到动物)的运动迁移。

0 人收藏 0 人点赞
#inference-time

通过拉格朗日奖励增强实现安全的推理时对齐

arXiv cs.LG ↗ · 2026-07-07 缓存

提出了LARA框架,用于安全的推理时对齐。该框架通过拉格朗日对偶化,从单独的奖励和成本模型中推导出增强奖励,从而在不重新训练的情况下改善有用性-无害性权衡。

0 人收藏 0 人点赞
#inference-time

拆解病态捷径:用于忠实LVLM解码的因果框架

arXiv cs.AI ↗ · 2026-06-29 缓存

本文揭示了大视觉语言模型中的幻觉是由一种动态结构错位引起的,其中某些注意力头充当风险中介,与视觉证据解耦,转而锁定语言先验。作者提出了Fox,一种无需训练的因果干预框架,能够诊断并物理切断这些病态捷径,在忠实解码中实现了最先进的性能。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈