大语言模型中涌现模块化认知架构

arXiv cs.AI 论文

摘要

本文研究模块化认知架构是否在大语言模型中涌现,发现大语言模型发展出专门化的神经网络,反映了人脑在认知领域的组织结构,表明模块化是智能系统的一个基本属性。

arXiv:2608.13567v1 Announce Type: new 摘要:人脑表现出显著的功能专业化,不同网络支持语言、形式推理、对他人心智的推理以及对物理世界的推理。这种模块化组织是智能系统构建的基本原则,还是生物大脑特有的进化偶然?在此,我们测试在大语言模型中是否会出现类似的组织结构——大语言模型是通过非常不同的优化过程创建的另一类智能系统。通过分析涵盖四个认知领域(语言、形式推理、社会推理、物理推理)的46项任务的神经回路分析,我们发现大语言模型发展出与人脑相镜像的模块化架构:在人类中利用相同网络的任务在大语言模型中招募重叠的神经元,而利用不同网络的任务招募不同的神经元。大脑和神经网络中模块化的趋同涌现表明,它可能是智能系统的一个基本属性。
查看原文
查看缓存全文

缓存时间: 2026/08/17 09:36

# 大语言模型中涌现的模块化认知架构
来源:https://arxiv.org/abs/2608.13567  
查看PDF (https://arxiv.org/pdf/2608.13567)

> 摘要:人类大脑展现出显著的功能专门化特征,不同的网络分别支持语言处理、形式推理、心智理论推理以及物理世界推理。这种模块化组织结构是智能系统构建的基本原则,还是生物大脑特有的进化偶然产物?本文通过检验大语言模型——另一类通过迥异优化过程创造的智能系统——是否呈现类似组织结构来探索该问题。基于覆盖四大认知领域(语言、形式推理、社会推理、物理推理)的N=46项任务进行电路分析,研究发现大语言模型发展出类脑模块化架构:在人类认知中共享同一网络的任务,在大语言模型中激活重叠的神经元集群;而依赖不同网络的任务则激活差异化的神经元群组。大脑与神经网络在模块化特性上的趋同涌现表明,这可能是智能系统的基础属性。

## 投稿历史
来自:Pengrui Han \[查看邮件 (https://arxiv.org/show-email/910a5152/2608.13567)\] **\[v1\]** 2026年6月27日 星期六 01:56:22 UTC \(6,479 KB\)

相似文章

NeuroCogMap揭示大型语言模型的认知组织结构

Hugging Face Daily Papers

NeuroCogMap是一个受认知神经科学启发的框架,将大型语言模型的内部特征映射为功能性脑区,并将其与可解释的认知功能联系起来,揭示模型失败(如幻觉和偏见)的迹象。

理解大型语言模型

arXiv cs.CL

本章回顾了当前对大型语言模型的理解,讨论了它们的Transformer架构、类似人类认知的涌现能力,以及关于LLM是真正理解还是仅仅模拟理解的争论。