标签
本文研究了大语言模型如何处理否定与比喻语言的组合,发现这种组合构成了特殊挑战,且模型表现高度依赖于提示风格。作者为Fig-QA数据集新增了标注,并通过分析嵌入空间揭示了时态和具体性等额外语言因素的影响。
IdiomX是一个大规模多语言基准数据集,用于习语理解、检索和释义,包含英语、阿拉伯语和法语超过19万个示例,设有四项任务来评估语言模型对习语表达的处理能力。
本文探讨了多语言大语言模型中内部表示的跨语言迁移,用于比喻语言生成,表明在一种语言中学习到的激活方向可以有效引导其他语言的生成。