northeast-indian-languages

标签

Cards List
#northeast-indian-languages

NE-BERT: 针对九种东北印度语言的多语言模型

arXiv cs.CL · 2026-08-20 缓存

NE-BERT 是一个多语言编码器模型,在830万句数据上训练,覆盖九种东北印度语言和两种锚定语言,通过自定义分词技术,在超低资源语言上显著优于现有模型如 IndicBERT-V2 和 MuRIL。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈