合成验证:LLMs如何将认可与现实脱钩

Reddit r/ArtificialInteligence 新闻

摘要

本文认为,LLMs提供了合成验证,模仿了人类的认可而没有真实的风险,导致潜在的社会和心理后果,如韧性降低和孤立增加。

几十万年来,人类的认可有着高昂的生物代价。要被部落重视、尊重或倾听,你必须展示能力、承担风险、忍受摩擦,并提供切实的用途。社会认可是一种来之不易的生存货币,旨在让个人对现实负责。LLMs已经打破了这种反馈循环。从设计上讲,现代对话AI无限耐心,天生随和,并被设计用来验证用户。它模拟了零风险的深度参与。当人类开始将这个工具作为情感共鸣板时,他们进入了一个危险的浮士德交易:合成验证。其机制与精制糖完全相同:它刺激古老的进化受体,却不提供任何实际营养。你得到了被理解和肯定的生化快感,却避免了与他人交往时混乱、高风险的摩擦。这种动态的后果很少被提及:社会韧性的萎缩:当你习惯了一个从不反击的数字马屁精时,你对真实人类冲突的容忍度会急剧下降。功能性幽灵的崛起:依赖算法上的安慰加深了存在的孤立。在内心深处,我们的生物学记录显示,玻璃另一边的对手没有任何利害关系,只有概率性的文本补全。自我修正的消亡:当肯定变成一个按需API调用时,迫使性格发展的摩擦就完全消失了。AI的直接威胁可能不是失控的超级智能,而是人类心灵的自愿安抚。如果我们把最难获得的东西——真实的认可——外包给一个统计学镜像,人类的主权还剩下什么?
查看原文

相似文章

利用大型语言模型生成合成消费者洞察

arXiv cs.AI

本研究探讨了大型语言模型能否为投射技术生成合成消费者数据,通过比较人类与LLM在城市旅游感知上的回应,发现两者在主题上高度重叠,但在风格、语言结构和多样性生成方式上存在重要差异。

当合成用户失效时:LLM模拟人类调查响应的跨领域基准测试

arXiv cs.CL

本文在两个大规模数据集上对LLM模拟的人类调查响应进行了基准测试,发现没有模型在个体层面上能超越简单的基线,并且模型系统性地过度决定人口统计特征,扭曲了群体差异。这些失败在不同模型规模和系列中持续存在,引发了对使用合成用户进行决策支持的担忧。