标签
本文研究了在认知不对称条件下,大语言模型是否在多主体协作任务中表现出语用合作性,形式化了格莱斯的合作原则,并评估了大语言模型作为说话者和听者的能力。结果表明,尽管大语言模型表现出一定的语用能力,但在信息不完整的情况下仍存在困难,并且未能识别某些违反格莱斯准则的情况。
PragReST 是一个自监督框架,通过生成反事实推理轨迹并利用监督微调和强化学习训练模型,提升大语言模型的语用推理能力,在语用基准测试上取得了显著提升,且无需人工标注数据。