register-aware

标签

Cards List
#register-aware

大型语言模型有多像人类?一个关注语域的语言评估框架

arXiv cs.CL · 2026-05-25 缓存

本文提出了一种关注语域的语言评估框架,通过使用最大均值差异(MMD)比较人类与LLM生成文本中67个词汇语法特征的分布,来评估大型语言模型(LLM)的人类相似度。在七个经过指令微调的开源模型和五个语域上的实验表明,没有模型能完美匹配人类基线,且与人类语言的接近程度因语域而异,而非模型规模。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈