machine-translation

标签

Cards List
#machine-translation

阿拉伯语-俄语机器翻译基准测试:微调NMT与少样本LLM在丰富形态和低词汇重叠下的对比

arXiv cs.CL ↗ · 12小时前 缓存

本文通过对比微调的NMT模型和少样本LLM,对阿拉伯语-俄语机器翻译进行基准测试,发现在低资源条件下,微调的NMT显著优于LLM。

0 人收藏 0 人点赞
#machine-translation

EnSiTa - 一个面向特定领域机器翻译的三语多领域平行数据集与基准

arXiv cs.CL ↗ · 12小时前 缓存

EnSiTa 是一个支持英语、僧伽罗语和泰米尔语的三语多领域平行数据集和基准,包含人工后编辑的训练数据,并进行了大量领域特定机器翻译的实验,以应对低资源语言的挑战。

0 人收藏 0 人点赞
#machine-translation

标签感知的结构化文本翻译:迈向系统性理解

arXiv cs.CL ↗ · 12小时前 缓存

本文提出了一种系统性的标签感知结构化文本翻译方法,通过处理数据合成、能力构建和对齐,展示了比现有方法显著改进的效果。

0 人收藏 0 人点赞
#machine-translation

COILD:一个以印度语言为中心的平行语料库与跨语言机器翻译基准

arXiv cs.CL ↗ · 12小时前 缓存

本文介绍了COILD,这是一个以印度语言为中心的平行语料库,包含超过116万对句子,覆盖20对印度语言,并提供了一个以领域为中心的基准。研究结果表明,在微调多语言模型时,机器翻译性能得到了显著提升。

0 人收藏 0 人点赞
#machine-translation

跨职业机器翻译评估指标的性别偏见基准测试

arXiv cs.CL ↗ · 4天前 缓存

本研究对跨职业机器翻译评估指标的性别偏见进行基准测试,揭示男性化翻译倾向于获得更高分数,且偏见因语言和评估者而异。

0 人收藏 0 人点赞
#machine-translation

推理在机器翻译中何时有帮助?LRM推理轨迹的层次分析

arXiv cs.CL ↗ · 4天前 缓存

本文分析了大型推理模型在机器翻译中的推理轨迹,发现推理收益是有条件的,并引入Hierarchical Meta-Summarization来理解轨迹模式。

0 人收藏 0 人点赞
#machine-translation

评估机器翻译对话中的交际成功度

arXiv cs.CL ↗ · 2026-09-18 缓存

本文提出一个三层清单-评判框架,用于评估机器翻译对话中口译智能体在语义、语用和文化-社会维度上的交际成功度,并通过广泛的基准测试进行了验证。

0 人收藏 0 人点赞
#machine-translation

TACTICS:面向分类法的智能语料库采样方法用于机器翻译

arXiv cs.CL ↗ · 2026-09-17 缓存

TACTICS是一种分类法感知的语料库采样方法,通过优化稀有类别的覆盖范围并提高较少片段的诊断能力来增强机器翻译评估。

0 人收藏 0 人点赞
#machine-translation

MudawanSn:用于机器翻译的沃洛夫语-阿拉伯语高质量平行语料库

arXiv cs.CL ↗ · 2026-09-17 缓存

本文介绍了MudawanSn,一个用于沃洛夫语-阿拉伯语机器翻译的高质量平行语料库,并展示了在该语料库上进行微调可以显著提高两个语言方向的翻译质量。

0 人收藏 0 人点赞
#machine-translation

ReMova:针对英语到白俄罗斯语翻译的LLMs微调方法

arXiv cs.CL ↗ · 2026-09-16 缓存

本文介绍了一种针对英白翻译的数据清洗流程和微调方法,重点处理白俄罗斯语的正字法复杂性并提升数据质量。

0 人收藏 0 人点赞
#machine-translation

StalePO:利用传统后编辑的机器翻译锚定令牌级偏好优化

arXiv cs.CL ↗ · 2026-09-16 缓存

StalePO引入了一种用于机器翻译的令牌级偏好优化方法,该方法利用传统后编辑来提升模型性能,在质量指标上显示出显著提升。

0 人收藏 0 人点赞
#machine-translation

基于联合多流扩散的高效一对多翻译

arXiv cs.CL ↗ · 2026-09-16 缓存

本文提出了一种离散扩散框架,用于高效的一对多机器翻译,实现了随目标语言数量次线性延迟扩展,并支持对未见源语言的零样本迁移。

0 人收藏 0 人点赞
#machine-translation

CRITICS - 无国界批判科学:利用语言模型促进科学教育中的批判性思维

arXiv cs.CL ↗ · 2026-09-15 缓存

CRITICS项目通过大型语言模型实现机器翻译,旨在消除科学资料的语言障碍,促进科学教育中的批判性思维和资源普及。

0 人收藏 0 人点赞
#machine-translation

North Small Translate: 先进的性价比翻译 (Cohere CAT+)

arXiv cs.CL ↗ · 2026-09-15 缓存

North Small Translate 是一个基于LLM的开源机器翻译模型,拥有250亿活动参数,无需在推理时进行昂贵推理,即可在其类别中实现跨50种语言的顶级性能。

0 人收藏 0 人点赞
#machine-translation

当局部编辑放大相对选择偏差时:梯度几何、目标不匹配与重要性加权

arXiv cs.CL ↗ · 2026-09-15 缓存

本文分析了在模型训练中,如何通过局部化人工校正中的编辑来放大相对选择偏差,并提供了来自机器翻译实验的理论见解和实证证据。

0 人收藏 0 人点赞
#machine-translation

墨尔本大学WMT 2026 CreoleMT提交:一种针对低资源太平洋克里奥尔语机器翻译的领域平衡方法

arXiv cs.CL ↗ · 2026-09-15 缓存

墨尔本大学提交了一个针对低资源太平洋克里奥尔语(如Tok Pisin、Bislama和Solomon Pijin)的领域平衡机器翻译模型,在WMT 2026 CreoleMT共享任务中,以超过3个chrF++点的优势超越了开放基线模型。

0 人收藏 0 人点赞
#machine-translation

在无参考条件下构建机器翻译评估的伪参考

arXiv cs.CL ↗ · 2026-09-15 缓存

本文描述了一种在机器翻译评估中构建伪参考的方法,无需人工参考,利用多个翻译模型、质量估计和GPT-5.5后编辑来提高选择准确性。

0 人收藏 0 人点赞
#machine-translation

Doc2FRC:通过固定范围分块实现长度一致的文档级机器翻译

arXiv cs.CL ↗ · 2026-09-14 缓存

本文提出了固定范围分块(FRC)用于文档级机器翻译,以确保长度一致性,减少训练-测试不匹配,并提升大型语言模型中的翻译质量。

0 人收藏 0 人点赞
#machine-translation

TransClean:从大型语言模型输出中检测和提取干净翻译的基准

arXiv cs.CL ↗ · 2026-09-11 缓存

TransClean 是一个基准,用于检测和提取来自大型语言模型输出的干净翻译,分析了超过 790,000 个翻译输出以识别噪声模式并评估提取方法。

0 人收藏 0 人点赞
#machine-translation

North Small Translate 模型卡 (8分钟阅读)

TLDR AI ↗ · 2026-09-11 缓存

CohereLabs 发布了 North Small Translate,这是一个开放权重的稀疏混合专家模型,拥有250亿活跃参数,用于支持50种语言的高质量机器翻译。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈