大语言模型中的元认知:基础、进展与机遇
摘要
本文全面概述了大语言模型中的元认知,涵盖了测量方法、改进技术及未来方向。
查看缓存全文
缓存时间: 2026/07/14 08:13
论文页面 - 大语言模型中的元认知:基础、进展与机遇
来源:https://huggingface.co/papers/2607.11881
摘要
元认知是智能的基础组成部分,对有效学习、问题解决、决策制定、沟通等方面至关重要。近年来,它越来越被认为是构建能力强、透明的人工智能系统的基石。然而,尽管大语言模型在多种现实世界任务中取得了显著进展,但目前尚不清楚它们何时、如何以及在多大程度上能够展现或被赋予有效的元认知能力,也不清楚这些能力如何被用于提升人工智能系统的基础能力、可靠性和智能水平。本文通过提供关于大语言模型元认知知识现状的首次全面概述,弥合了这一差距。我们分析并分类了这一新兴领域的格局,总结了近期的技术进步,包括测量和评估大语言模型元认知能力的方法与基准、激发、提升和应用大语言模型元认知的技术,以及正在进行的研究的发现和启示。我们还讨论了应用、开放问题与挑战,以及未来工作的有前景方向。我们的目标是提供对该主题的详细且最新综述,并激发有意义的研究和讨论。论文的整理列表请见 https://github.com/yale-nlp/LLM-Metacognition。
查看arXiv页面 (https://arxiv.org/abs/2607.11881)查看PDF (https://arxiv.org/pdf/2607.11881)添加至收藏 (https://huggingface.co/login?next=%2Fpapers%2F2607.11881)
引用本文的模型0
暂无模型关联此论文
请在模型 README.md 中引用 arxiv.org/abs/2607.11881 以在此页面建立链接。
引用本文的数据集0
暂无数据集关联此论文
请在数据集 README.md 中引用 arxiv.org/abs/2607.11881 以在此页面建立链接。
引用本文的 Spaces0
暂无 Space 关联此论文
请在 Space README.md 中引用 arxiv.org/abs/2607.11881 以在此页面建立链接。
包含本文的收藏集0
暂无收藏集包含此论文
请将本论文添加至收藏集 (https://huggingface.co/new-collection) 以在此页面建立链接。
相似文章
@omarsar0: 强烈推荐的LLM元认知概述。(请收藏) LLM中有趣的行为如置信度校准…
本文首次全面概述了LLM中的元认知,认为置信度校准和自我验证等行为是统一元认知能力的各个方面,并对评估和提升这些能力以增强LLM可靠性和透明性的方法和基准进行了分类。
解构并引导大型语言模型中的功能性元认知
本研究探讨了大型语言模型中的功能性元认知,证明诸如评估意识和自我评估能力等内部状态可以从残差流激活中线性解码。作者提出了一个机械机制框架来引导这些状态,展示了对推理行为、冗长度及安全响应的因果控制。
前沿大语言模型中的领域级元认知监控:一份33个模型图谱
本研究提出了一份涵盖33个模型的图谱,利用MMLU基准分析了前沿大语言模型中的领域级元认知监控,揭示了聚合指标所掩盖的不同知识领域中置信度校准的显著差异。
基于元认知反馈的强化学习激发大语言模型中的忠实不确定性表达
本文介绍了基于元认知反馈的强化学习(RLMF)和元认知数据选择,以改进大语言模型的校准,实现内部不确定性的忠实表达,并比标准强化学习提升高达63%。
LLMs 未显示出个体化元认知迹象
本文研究了前沿大语言模型是否表现出个体化元认知——即超越共享信号评估自身项目级别能力的能力。通过对20个模型和六个基准进行因子分析和成对校准,作者未发现此类元认知的证据;置信度差异归结为一个单一的共享难度因子,表明模型依赖于共同的难度信号而非模型特定的自我认知。