标签
本文介绍了SiPE,一种轻量级方法,将依存句法分析中的句法先验注入Transformer位置嵌入,在不增加推理成本的情况下,提升句法泛化能力(在SyntaxGym上最高提升10.3%)和语言理解能力(在GLUE上最高提升8.2%)。
本文研究了非人灵长类动物的发声或手势的依存句法分析是否可以在没有金标准的情况下进行评估。利用网络科学,作者表明,由于非人灵长类动物序列长度分布的快速衰减,解析器获取的正确边比例必然很高,这使得评估成为可能,与人类语言不同。
我们介绍了Prague Dependency Treebank的第二个整合版本,这是一个400万词的人工多语言标注资源,涵盖形态、句法、语义、共指和话语,以及兼容的词典。
本文介绍了AthDGC,这是首个获得公开许可的依存句法分析希腊语树库,跨越八个历时时期,并使用Stanza、LaBSE和多语言BERT等NLP工具与四种古代印欧语进行了诗句级别的交叉对齐。
AfriSUD是一个新的非洲语言依存树库集合,遵循表层句法通用依存(SUD)框架,旨在评估NLP模型在Naija、Wolof和Yorùbá等语言上的表现。
本文介绍了一种可复现的流水线,用于构建面向Katharevousa希腊语议会文本的Universal Dependencies风格解析资源,包括OCR重建、LLM辅助标注以及多个解析器的评估。最佳模型(XLM-R)达到了0.8893的UPOS准确率和0.5162的LAS,显著优于现成的基线模型。