pragmatics

标签

Cards List
#pragmatics

通过隐含意义识别与取消评估大语言模型中的交际信念更新

arXiv cs.CL · 2026-07-29 缓存

本文评估了大语言模型识别未言明信念(隐含意义)以及通过隐含意义取消来理解信念更新的能力,并引入了专家标注的ImplicatureX数据集。结果表明,大语言模型在自然场景中尤其落后于人类。

0 人收藏 0 人点赞
#pragmatics

能够灵活生成意义与表达替代方案的语用推理计算模型

arXiv cs.CL · 2026-07-22 缓存

提出SAGE,一种结合语言模型与认知模型的神经符号框架,用于语用推理,并通过包括指称表达生成和含意在内的三个案例研究进行验证。

0 人收藏 0 人点赞
#pragmatics

为何AI需要“Genie系数”

Reddit r/ArtificialInteligence · 2026-07-21 缓存

本文提出一个“Genie系数”来衡量AI代理理解用户意图的程度,认为当前的基准测试未能捕捉用户所说与所想之间的差距。

0 人收藏 0 人点赞
#pragmatics

它们推断出你的意图:模型对交际意图的表征比实际行动更可靠

arXiv cs.CL · 2026-07-07 缓存

本文研究了语言模型尽管具有稳健的内部表征,但在行动上却未能体现交际意图的问题。通过线性探针,作者发现意图可以从隐藏状态中解码,但通常不反映在输出中,而引导一个较后层的方向可以恢复预期的行为。

0 人收藏 0 人点赞
#pragmatics

通过人口统计条件融合嵌入学习视角主义社会意义

arXiv cs.CL · 2026-06-08 缓存

本文提出人口统计条件融合嵌入,用于建模语言中的视角主义社会意义,通过将注释者人口统计信息整合到NLP系统中,展现出相对于纯文本基线的持续改进。

0 人收藏 0 人点赞
#pragmatics

KARMA:基于Karma对齐的奖励模型适配

arXiv cs.CL · 2026-05-27 缓存

介绍KARMA,一个在Reddit对话上训练奖励模型的框架,通过强化学习提升大语言模型的上下文敏感对话行为。研究发现,预测Karma的最佳奖励模型并不能带来最佳的下游对齐效果。

0 人收藏 0 人点赞
#pragmatics

DRInQ:通过受控上下文变化评估会话含义

arXiv cs.CL · 2026-05-26 缓存

介绍DRInQ,一个用于评估疑问话语中会话含义的基准,揭示了LLMs尽管能够生成合理的语用场景,但在推理时往往无法恢复预期的含义。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈