大语言模型中涌现模块化认知架构
摘要
本文研究模块化认知架构是否在大语言模型中涌现,发现大语言模型发展出专门化的神经网络,反映了人脑在认知领域的组织结构,表明模块化是智能系统的一个基本属性。
查看缓存全文
缓存时间: 2026/08/17 09:36
# 大语言模型中涌现的模块化认知架构 来源:https://arxiv.org/abs/2608.13567 查看PDF (https://arxiv.org/pdf/2608.13567) > 摘要:人类大脑展现出显著的功能专门化特征,不同的网络分别支持语言处理、形式推理、心智理论推理以及物理世界推理。这种模块化组织结构是智能系统构建的基本原则,还是生物大脑特有的进化偶然产物?本文通过检验大语言模型——另一类通过迥异优化过程创造的智能系统——是否呈现类似组织结构来探索该问题。基于覆盖四大认知领域(语言、形式推理、社会推理、物理推理)的N=46项任务进行电路分析,研究发现大语言模型发展出类脑模块化架构:在人类认知中共享同一网络的任务,在大语言模型中激活重叠的神经元集群;而依赖不同网络的任务则激活差异化的神经元群组。大脑与神经网络在模块化特性上的趋同涌现表明,这可能是智能系统的基础属性。 ## 投稿历史 来自:Pengrui Han \[查看邮件 (https://arxiv.org/show-email/910a5152/2608.13567)\] **\[v1\]** 2026年6月27日 星期六 01:56:22 UTC \(6,479 KB\)
相似文章
@LiorOnAI:大型语言模型自发地发展出了与人类相同的专门化大脑区域,用于语言、数学、物理……
一篇预印本研究发现,大型语言模型自发地发展出了专门化的模块化大脑区域,用于语言、数学、物理和社会推理,这与人类大脑相似,表明智能系统设计中的趋同现象。
Decodable But Not Detachable: Training Data Granularity Determines Parametric Modularity in Large Language Models
This paper investigates when large language models develop domain-specific parametric shells (causally necessary neuron populations), finding that modular training data at the token level (e.g., languages, code) produces functional shells, while academic subject domains do not, despite being linearly decodable.
NeuroCogMap揭示大型语言模型的认知组织结构
NeuroCogMap是一个受认知神经科学启发的框架,将大型语言模型的内部特征映射为功能性脑区,并将其与可解释的认知功能联系起来,揭示模型失败(如幻觉和偏见)的迹象。
理解大型语言模型
本章回顾了当前对大型语言模型的理解,讨论了它们的Transformer架构、类似人类认知的涌现能力,以及关于LLM是真正理解还是仅仅模拟理解的争论。
跨语言模型架构的神经激活模式:认知任务性能的综合分析
本文分析了六种LLM架构在认知任务上的神经激活模式,揭示了编码器和解码器模型在注意力熵和稀疏性上的差异。