APEX-VW:医疗领域文档级英西译后编辑数据集
摘要
本文介绍了APEX-VW,一个基于NHS虚拟病房文档并在Trados Studio中进行专业译后编辑构建的新型文档级英西译后编辑数据集。该语料库旨在支持术语规范化、纠正传播以及人在回路翻译支持的研究。
查看缓存全文
缓存时间: 2026/08/11 08:06
# APEX-VW:医疗领域中的文档级英语-西班牙语译后编辑数据集 来源:https://arxiv.org/html/2608.08059 \(2026\) ###### 摘要。 机器翻译(MT)输出的译后编辑(PE)通常涉及在众多片段中重复相同的词汇和术语修正,尤其是在专业性强且高度重复的文档中。尽管在自动译后编辑(APE)方面已有大量工作,但大多数现有语料库都是句子级别的,另一些则是合成的,总体上并非为研究修正如何在真实的计算机辅助翻译(CAT)工作流程中传播而设计。本文介绍了APEX-VW(Automatic Post-Editing eXperiments on Virtual Wards)语料库,这是一个新的开放英语-西班牙语(EN-ES)数据集,基于近期
相似文章
AI_LectureNote:后ASR工作流在韩英医学讲座中英文脚本呈现与语义漂移的回顾性试点研究
一项回顾性试点研究评估了AI_LectureNote,这是一个针对韩英医学讲座的后ASR工作流,结果显示虽然它改善了英文脚本呈现,但在转录中引入了语义漂移和极性错误。
提升科学论述:科学领域的机器翻译
本文介绍了针对西班牙语-英语、法语-英语和葡萄牙语-英语的科学机器翻译平行语料库和单语语料库的开发,涉及四个领域:癌症研究、能源研究、神经科学和交通运输。这些语料库用于微调神经机器翻译系统,以解决科学文本中专业词汇和句法带来的挑战。
VisEditBench:视觉语言模型能否根据多模态反馈编辑可视化代码?
介绍了VisEditBench,这是一个包含1,395个人工标注的可视化代码编辑任务的基准,面向视觉语言模型,涵盖反馈引导的修复和参考引导的重新样式化。评估了20个VLM,并提出了VisEditAgent,一个基于渲染的编辑框架,将通过率从55.75%提升到67.99%。
VEFX-Bench:通用视频编辑与视觉特效的全方位基准
VEFX-Bench 引入了一个大规模人工标注的视频编辑数据集(5,049个样本),包含多维质量标签,以及一个专门用于标准化评估视频编辑系统的奖励模型。该论文针对AI辅助视频创作中缺乏全面基准的问题,提供了VEFX-Dataset、VEFX-Reward和一个300个视频提示对的基准测试,揭示了当前编辑模型中的差距。
AVE-Compass:迈向音视频编辑能力的全面评估
AVE-Compass 是一个用于全面评估音视频编辑能力的新基准,包含 145 个视频、196 条编辑指令和 2,688 个检查表项。它还提出了 AVE-Agent,一个模块化智能体框架,通过自我反思和评估器反馈改进跨模态编辑。