cognate-benchmark

标签

Cards List
#cognate-benchmark

当相似意味着不同:评估LLM在阿拉伯语-希伯来语同源词上的表现

arXiv cs.CL · 2026-06-12 缓存

本文介绍了SemCog Bench,这是一个精心整理的基准测试,包含1,858个阿拉伯语-希伯来语词对,并带有句子级别的注释,用于评估LLM区分真同源词、假同源词和借词的能力。结果显示,模型在真同源词上准确率很高,但在假同源词上准确率大幅下降,突显了跨语言语义推理中的一个关键局限性。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈