心智理论——LLM与人类

Reddit r/artificial 新闻

摘要

一篇关于LLM心智理论与人类心智理论差异的反思,认为LLM由于依赖客观数据而缺乏情感共情,而人类则整合了主观体验。

我刚刚在思考LLM的心智能力与人类心智能力之间的差异,并意识到这触及了LLM与人类区别的核心,即我们收集信息的方式。LLM基于客观数据,例如文本、数字、像素等。而我们人类则使用主观信息,例如感受、感觉、体验,以及客观数据。在认知科学中,这被描述为情感共情与认知共情。换句话说,LLM只拥有认知层面的心智理论,而我们则同时拥有认知*与*情感的心智理论。我对像Hinton这样声称AI已经具备意识的人感到困扰,因为他的整个框架建立在一个观点上:意识(主观体验)只是计算过程的产物(一种幻觉),因此不承认主观度量——现实只由我们能够客观测量(通过固定指标)的事物来定义。我认为这未能认识到的是,在追求可重复结果的过程中,由于需要固定指标,我们抛弃了另一整套度量方式,即主观(可变)的度量。
查看原文

相似文章

LLMs 能内省吗?现实检验

arXiv cs.AI

本文认为,近期关于LLMs内省能力的说法并不成立,因为仅凭行为证据无法区分真正的内省与基于表面线索的模式匹配。作者重新审视了两种评估范式,发现模型依赖于输入层特征,而非真正访问内部状态。

评估 LLM 在受控实验中作为人类代理的可靠性

arXiv cs.CL

本论文通过比较 LLM 生成的数据与人类在准确性感知调查中的反应,评估现成 LLM 是否能可靠地模拟受控行为实验中的人类反应。研究发现,虽然 LLM 能捕捉方向性效应和聚合信念更新模式,但它们的效应大小与人类尺度不一致,这有助于澄清合成 LLM 数据何时可以作为行为代理。

评估推理模型中的心智理论:稳健性优于推理

arXiv cs.CL

这篇arXiv论文评估了推理型大语言模型的心智理论能力,发现其对提示变化和任务扰动的稳健性有所提高。作者将这一增益解读为支持基于稳健性的解释,而非新的ToM特定能力。