machine-translation

标签

Cards List
#machine-translation

通过经验回放和模型融合对 IndicTrans2 在 21 种印度语言上进行会话域适应

arXiv cs.CL · 2026-06-30 缓存

本文通过经验回放和模型融合技术,将 IndicTrans2-1B 适应到 21 种印度语言的会话语域,在保持通用领域性能的同时取得了会话性能提升,但人工评估表明,基于指标的性能提升可能并未反映感知质量的改善。

0 人收藏 0 人点赞
#machine-translation

NagaTranslate: 为低资源的那加兰克里奥尔语构建翻译与语音流水线 (Whisper, VITS, LLMs) [P]

Reddit r/MachineLearning · 2026-06-28

介绍了 NagaTranslate,一个使用 Whisper、VITS 和 LLMs 针对低资源的那加兰克里奥尔语的翻译和语音合成流水线。

0 人收藏 0 人点赞
#machine-translation

低资源Tangkhul-英语神经机器翻译

arXiv cs.CL · 2026-06-25 缓存

介绍了一个针对严重资源匮乏的Tangkhul-英语语言对的神经机器翻译系统,通过微调ByT5-large和mT5-small模型,在BLEU、chrF++、BERTScore和COMET评分上取得了优异成绩。

0 人收藏 0 人点赞
#machine-translation

AI翻译文学文本“还行”,但读者依然更偏爱人工翻译

Hugging Face Daily Papers · 2026-06-24 缓存

一项对比文学作品中人工翻译与AI翻译的研究表明,虽然机器翻译被视为“还行”,但读者仍因其沉浸感和清晰度更偏爱人工翻译。自动指标无法捕捉读者偏好。

0 人收藏 0 人点赞
#machine-translation

翻译不可译之物:一个可操作化的不可译性本体论

arXiv cs.CL · 2026-06-17 缓存

本文提出了机器翻译中不可译性的结构化本体论,以及补偿策略的分类法和多语言数据集。人类偏好研究表明,翻译质量取决于所使用的策略,且对解释性翻译存在一致偏好。

0 人收藏 0 人点赞
#machine-translation

自我评价之言:大语言模型在机器翻译中的口头化置信度研究

arXiv cs.CL · 2026-06-17 缓存

本文研究了从大语言模型中提取机器翻译输出置信度的口头化方法,并将其与内部token概率进行了比较。研究发现,尽管两种方法在错误检测和校准方面表现相似,但内部置信度与口头化置信度之间几乎没有相关性。

0 人收藏 0 人点赞
#machine-translation

基于LLM的文学翻译中的情绪特征分析:机器翻译与后期编辑的系统性转变

arXiv cs.CL · 2026-06-10 缓存

本文通过对比研究玛格丽特·阿特伍德的《羚羊与秧鸡》译成意大利语的情况,探讨大语言模型(LLM)翻译是否表现出可识别的情绪特征,以及后期编辑如何将其重塑为更接近人类的标准。

0 人收藏 0 人点赞
#machine-translation

mmPISA-bench:LLMs 在43种语言中的推理能力是否同样出色?

arXiv cs.CL · 2026-06-08 缓存

介绍 mmPISA-bench,一个源自PISA的紧凑型多语言推理基准,评估了专有LLMs在43种语言上的表现,发现它们能有效推理但存在一些性能差异,且机器翻译的问题不会降低准确率。

0 人收藏 0 人点赞
#machine-translation

基于循环一致性机器翻译的多语言共指消解

arXiv cs.CL · 2026-06-05 缓存

本文提出了一种新的多语言共指消解流水线,利用从英语到低资源语言的循环一致性机器翻译生成训练数据,并通过反向翻译和BERT相似性进行验证。在四种低资源语言上的实验表明,该方法带来了显著的性能提升,使得在没有现有语料库的语言中也能实现准确的共指消解。

0 人收藏 0 人点赞
#machine-translation

ComplexityMT:文本复杂度与机器翻译交互的基准测试

arXiv cs.CL · 2026-06-05 缓存

引入ComplexityMT,这是一个使用CEFR级别评估六种语言中文本复杂度与机器翻译交互的基准测试,表明更高的复杂度使翻译更困难,并且机器翻译会改变复杂度级别。

0 人收藏 0 人点赞
#machine-translation

超越“致相关人士”:为受众和意图定制机器翻译

arXiv cs.CL · 2026-06-03 缓存

本文系统评估了使用大语言模型在50种语言中进行目的驱动的机器翻译,发现明确的指令能显著提升适应质量,尤其是在非正式领域和更大模型中,而传统指标无法捕捉适应质量。

0 人收藏 0 人点赞
#machine-translation

G^2C-MT:基于图引导的文档级机器翻译上下文选择

arXiv cs.CL · 2026-06-03 缓存

提出了G²C-MT,一种基于图引导的文档级机器翻译上下文选择框架,通过轻量级话语图和深度偏置随机游走来建模结构化话语依赖关系,在多个大语言模型上超越基线。

0 人收藏 0 人点赞
#machine-translation

将古典诗歌翻译成现代散文

arXiv cs.CL · 2026-06-03 缓存

介绍Padyam2Gadyam数据集,该数据集用于将13至17世纪泰卢固语古典诗歌翻译成现代泰卢固语和英语散文,并评估了五种大语言模型在此任务上的表现。

0 人收藏 0 人点赞
#machine-translation

KletterMix:迈向高质量德语预训练数据

Hugging Face Daily Papers · 2026-06-02

KletterMix 是一个高质量的德语预训练语料库,通过将最先进的英语预训练数据集翻译成德语构建而成,同时保留其结构和多样性。控制实验表明,在 KletterMix 上训练的模型在德语基准测试中取得了可衡量的改进。

0 人收藏 0 人点赞
#machine-translation

基于模型的大规模多语言平行数据质量评估

Hugging Face Daily Papers · 2026-05-29 缓存

本文提出了一种基于模型的方法来评估大规模多语言平行数据,将其分解为平行性评估和无参考质量估计,发现没有任何单一的通用指标适用于所有语言方向。

0 人收藏 0 人点赞
#machine-translation

基于ROC分析的翻译质量评估系统性能评价

arXiv cs.CL · 2026-05-26 缓存

本文提出使用接收者操作特征(ROC)分析来评估翻译质量评估(QE)系统,表明该方法能为商业决策提供可操作的性能见解,并与现有方法一致。

0 人收藏 0 人点赞
#machine-translation

多语言设计导向的调控:多语言稀疏自编码器与原则性层选择

arXiv cs.CL · 2026-05-25 缓存

本文介绍了一种基于原则的多语言语言调控方法,该方法使用在多语言数据上训练的稀疏自编码器(SAEs)以及一种基于多语言对齐与语言可分性交集的新型层选择规则,并在LLaMA-3.1-8B和Gemma-2-9B上针对机器翻译和跨语言摘要进行了评估。

0 人收藏 0 人点赞
#machine-translation

Hy-MT2:一套快速、高效且强大的多语言翻译模型,面向实际应用

arXiv cs.CL · 2026-05-22 缓存

Hy-MT2 是腾讯推出的一套快速高效的多语言翻译模型,提供 1.8B、7B 和 30B-A3B 三种尺寸,支持 33 种语言,性能超越此前开源和商业模型。

0 人收藏 0 人点赞
#machine-translation

@FeitengLi: Hy-MT2 新的开源多语言翻译模型 能力可以跟顶尖大模型匹配、支持 33 种语言之间的互译,而且具备灵活的 Instruct 能力,实现了 2-bit 量化不足 500MB 的空间占用 可以很好的跑在端侧 https://modelsc…

X AI KOLs Timeline · 2026-05-21 缓存

Hy-MT2 is a new open-source multilingual translation model from Tencent Hy that supports 33 languages, offers flexible instruction capabilities, and achieves 2-bit quantization under 500MB for on-device deployment.

1 人收藏 1 人点赞
#machine-translation

@AdinaYakup: Hy-MT2 来自@腾讯混元的新翻译模型系列 1.8B/7B/30B-A3B MoE 支持33种语言 1.8B > 440MB 通过…

X AI KOLs Following · 2026-05-21 缓存

腾讯混元发布了Hy-MT2翻译模型系列,最高含30B参数的MoE模型,支持33种语言,并经过量化可用于设备端。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈