auto-regressive-risk

标签

Cards List
#auto-regressive-risk

可靠性反向缩放:更大模型通过隐藏的自回归风险机制更快积累错误

arXiv cs.LG · 2026-07-22 缓存

本文发现,更大的语言模型存在一种隐藏的自回归风险机制,在该机制下,模型会承诺低概率词元,进而导致错误滚雪球式增长,使得可靠性随规模扩大而更快下降。研究表明,这种故障模式是因果性的、主导性的,并且对模型自身的自我监控不可见。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈