filler-tokens

标签

Cards List
#filler-tokens

并非所有LLM推理都可见于思维链

arXiv cs.CL · 昨天 缓存

本文证明,前沿语言模型能够利用语义无关的填充令牌进行“不可见推理”,在合成推理任务上准确率提升高达13个百分点,这动摇了思维链监控能捕获所有推理的假设。

0 人收藏 0 人点赞
#filler-tokens

点间解读:解码填充标记中的隐藏计算

arXiv cs.CL · 2026-07-07 缓存

本文表明,前沿LLM能够在无内容的填充标记上进行多步推理,并且残差流中的隐藏状态可以被解码以高精度恢复中间值,挑战了思维链监控是唯一审计工具这一假设。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈