cognitive-alignment

标签

Cards List
#cognitive-alignment

立场:我们需要实用的AI对齐方法来镜像人类推理

arXiv cs.AI ↗ · 2026-08-14 缓存

这篇立场论文认为,用于高风险决策的AI系统应以与其用户相似的方式进行推理,并忠实地传达这种推理,同时概述了实现这种“认知对齐AI”的研究议程。

0 人收藏 0 人点赞
#cognitive-alignment

大型语言模型中的类人回指消解

arXiv cs.CL ↗ · 2026-08-07 缓存

本文研究了五个开放权重的大型语言模型在回指消解中是否表现出对心理语言学因素的人类类似敏感性,使用惊奇度和理解准确率作为行为指标。结果显示选择性认知对齐:一些模型在回指消解中匹配了人类的话语敏感性,但对语义干扰效应的敏感性较弱或缺失。

0 人收藏 0 人点赞
#cognitive-alignment

Mental-R1:对齐LLM推理用于心理健康评估

arXiv cs.AI ↗ · 2026-06-12 缓存

提出认知相对策略优化(CRPO),一种用于对齐大语言模型在心理健康评估中推理的强化学习框架,在加权F1分数上比现有基线平均提高10.4个百分点。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈