l2-assessment

标签

Cards List
#l2-assessment

可解释、公平评估的自动化第二语言口语评估,超越单一人评判者上限,以及为什么停顿编码不改变大语言模型流畅度评分

arXiv cs.CL ↗ · 2026-08-28 缓存

本文介绍了一个可解释的特征-大语言模型混合系统,用于自动化第二语言英语口语评估。该系统优于个别受过训练的人类评判者,并表明停顿编码对大语言模型流畅度评分没有显著影响。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈