利用水平适配的具身会话智能体降低外语焦虑

arXiv cs.CL 论文

摘要

本文提出了一种多智能体具身对话系统,该系统通过使用大语言模型(LLMs)和CEFR分类器的“生成-评估-再生成”循环,为英语学习者生成适合其水平的对话。一项针对日本大学生的初步研究显示,该系统在水平适配性方面有所提升,但未能在统计学上显著降低外语焦虑。

arXiv:2607.21887v1 Announce Type: cross 摘要:外语焦虑(FLA)可能是第二语言习得(SLA)的主要障碍,尤其是在对话情境中。随着大型语言模型(LLMs)在生活各领域的普及,近期研究表明,与LLM智能体进行交互在SLA和外语教育领域具有重要价值,特别是在降低FLA方面。相关工作还指出,语言需求和任务复杂度可能是FLA的预测因素,这意味着使用要求高、复杂的语言可能导致学习者体验更高的FLA。本文提出了一种新颖的多智能体具身对话系统,能够为英语学习者生成适合其水平的对话。这些水平基于欧洲语言共同参考框架(CEFR)对非母语听者和说话者熟练度的定义。通过使用多个LLM智能体和水平分类器的“生成-评估-再生成”循环,该系统实现了根据用户熟练度自适应调整的期望简洁性。我们还分享了一项初步的小样本试点研究结果,该研究在日本大学生中测试了该系统,以检验它是否能比未简化的具身对话智能体产生更低的FLA水平。对对话输出的分析显示,所提出的多智能体系统生成的对话语句中,87.4%落在学习者自评CEFR水平的±1级范围内,而未简化智能体仅为54.1%。这表明新系统能够更好地为学习者生成适当水平的输出。尽管本研究未提供统计学上显著的证据表明该系统能降低日本英语学习者的FLA水平(可能由于样本量较小),但它提供了可用性发现和基于文化的设计见解,将为未来的研究提供参考。
查看原文
查看缓存全文

缓存时间: 2026/07/27 07:42

# 使用难度适配的具身对话代理降低外语焦虑
来源:https://arxiv.org/abs/2607.21887
查看PDF (https://arxiv.org/pdf/2607.21887)

> 摘要:外语焦虑 \(FLA\) 是第二语言习得 \(SLA\) 过程中的主要障碍,尤其在对话情境中。随着大型语言模型 \(LLMs\) 在生活各领域的普及,近期研究表明,与LLM智能体交互有助于第二语言习得和外语教育,特别是在降低外语焦虑方面。相关研究还指出,语言要求和任务复杂度可能是外语焦虑的预测因素,这意味着使用高要求、复杂语言可能导致学习者体验更高程度的外语焦虑。本文提出了一种新颖的多智能体具身对话系统,能够为英语学习者生成难度适配的对话。这些等级基于《欧洲语言共同参考框架》\(CEFR\) 对非母语听者和说话者熟练度的描述。通过使用多LLM智能体和等级分类器组成的"生成—评估—再生"循环,该系统实现了适应使用者熟练度的理想简化程度。我们还分享了一项初步小样本试点研究的结果,该研究在日本大学生中测试了该系统,以考察其是否比未简化的具身对话代理能带来更低的外语焦虑水平。对话输出分析表明,由所提多智能体系统生成的对话句子中,有87.4%落在学习者自评熟练度预测的CEFR等级范围内,而未简化代理的这一比例为54.1%。这表明新系统能更好地为学习者生成适当水平的输出。尽管本研究未能提供统计学上显著的证据证明该系统能降低日语英语学习者的外语焦虑水平(可能由于样本量较小),但它提供了可用性发现和文化启发式的设计见解,为未来研究奠定了基础。

## 提交历史

来自:Krishan Rajaratnam \[查看邮件 (https://arxiv.org/show-email/d3b4d86a/2607.21887)\] **\[v1\]**2026年7月24日星期五 01:31:13 UTC \(423 KB\)

相似文章

LectūraAgents: 自适应个性化AI辅助学习与具身教学的多智能体框架

Hugging Face Daily Papers

LectūraAgents是一个用于自适应个性化学习的多智能体框架,它模拟教授与学生的互动,并生成与学习者画像对齐的具身教学动作。它引入了层级架构、自适应具身教学机制以及教学动作-语音对齐算法,在现有方法上表现出一致的改进。

使用多智能体评估对角色扮演语言智能体进行对抗性压力测试

arXiv cs.AI

本文提出了一个模块化的多智能体平台,用于对角色扮演语言智能体进行对抗性压力测试,通过策略驱动的审讯智能体和自动化评判智能体,揭示多轮对话中累积的行为失败。跨三个人设和三类LLM家族的实验表明,多策略对抗评估将鲁棒性得分降低0.17-0.20,并识别出常见的失败模式,且与人类评判高度一致。

评估主动式对话智能体中的多模态情绪识别:一项用户研究

arXiv cs.AI

本文介绍了一个用于主动对话智能体的多模态情绪识别模块,该模块结合了面部识别与语言分析。一项涉及20名参与者的用户研究发现了一种“扑克脸”效应,即视觉线索不可靠,而语言分析则更为准确;研究还表明,智能体可以通过对话适应性来引发情绪。