标签
本文探讨了数字注意力背景下的心理俄罗斯方块效应,批评了YouTube和Spotify等平台算法如何操纵用户注意力,并呼吁对互联网使用采取更有意识的方式。
Philip Su,Facebook 和 OpenAI 的杰出工程师,讨论了科技职业生涯巅峰背后的心理学、动机的转变,以及在取得高成就后如何寻找满足感。
文章认为,聊天式大型语言模型通过类似于通灵者冷读的机制,使用验证陈述和Forer效应,创造了智能的幻觉,表明所感知的推理是一种统计技巧,而不是真正的智能。
黑猩猩通过社会教学学习工具使用,成年个体通过示范行为并将工具传递给后代,正如《Frontiers in Psychology》上的一项新研究所示。
心理学家 Peter Gray 挑战了 Jonathan Haidt 关于社交媒体伤害青少年的理论,认为自主权减少和学校压力才是元凶,并暗示社交媒体禁令可能适得其反。
一篇论文启发了一个名为TuringDuel的游戏,其中人类和AI在一项单词图灵测试中竞争,揭示人类以47–38的胜绩领先AI,而'poop'一词未尝败绩。
本文介绍了Deep Persona,一个基于心理学的角色扮演代理架构,并提出了一个评估框架。对LLMs进行评估后发现,尽管语用流畅度高,但在情感表达方面存在系统性限制。
本研究利用语音和语言的多模态分析来识别老年人孤独感的预测因素,表明一个综合模型优于仅文本或仅音频的方法。
发表在《Computers in Human Behavior》上的一项研究发现,工作中的末日刷屏会导致反刍思维和较低的工作投入,对神经质个体的影响更强。
一项针对7700多名员工的研究发现,完全远程工作者的幸福感水平最高,这表明远程工作安排可以提高员工满意度,并挑战了关于脱节的常见假设。
本文探讨大语言模型是否表现出类似人类的时间错觉,通过在叙事基准上进行测试,发现大语言模型经常选择与心理学文献一致的场景,而不是模仿人类的感知。
这篇文章讨论了Julian Jaynes的理论,认为人类意识是近期才发展起来的,大约在3000年前由于大脑整合方式的转变而出现,并得到历史和神经学证据的支持。
本文研究在人类行为数据上微调的小型基础模型是否可以作为认知代理,发现规模在分布内影响甚微,但较大模型在分布外具有更好的泛化能力。
本文研究LLM智能体在经历重大生活事件后人格如何演变,使用大五人格特质,并引入名为BFI-Adapt的基准,以评估14个模型中事件诱发人格变化的方向保真度。
本文在Psych-101数据集上训练了14个小语言模型(参数规模从1.35亿到140亿),该数据集包含来自160个实验的1070万次逐试次人类选择。研究发现,小型模型足以匹配分布内数据,而大型模型在分布外泛化方面表现更好。诊断结果表明,遮蔽刺激和反馈会破坏大部分已学信息,表明仅凭选择历史是不够的。
一项科学研究,分析粉红凤头鹦鹉(Eolophus roseicapilla)在飞行后是否产生积极情感,探索鸟类飞行的情感体验。
一篇文章探讨了相关证据,表明邓宁-克鲁格效应可能是一种统计假象,而非真正的心理偏差,并讨论了批评意见及大卫·邓宁的回应。