标签
本文演示了在游戏 Age of Empires II 中构建一个感知器和与非门,认为改变 LLM 的基质会改变对属性的感知,并批评了关于 LLM 拟人化的研究。
HumanLLM 提出了一个框架,通过将心理模式建模为相互作用的因果力来对大语言模型的拟人化进行基准测试和改进。该方法从学术文献中构建了244个心理模式和11,359个多模式场景。研究表明,真正的人类对齐需要认知建模而非表面行为模拟,HumanLLM-8B 在多模式动态上的表现超越了 Qwen3-32B 等更大的模型。