将古典诗歌翻译成现代散文
摘要
介绍Padyam2Gadyam数据集,该数据集用于将13至17世纪泰卢固语古典诗歌翻译成现代泰卢固语和英语散文,并评估了五种大语言模型在此任务上的表现。
arXiv:2606.02806v1 公告类型:新
摘要:我们推出了Padyam2Gadyam数据集,用于将13至17世纪泰卢固语古典诗歌翻译成当代泰卢固语和英语散文。该数据集包含600首诗及其经过人工验证的泰卢固语和英语散文译本。我们评估了5种当代大语言模型(LLMs)在将诗歌翻译成泰卢固语和英语方面的能力。结果表明,尽管不同LLMs之间存在差异,但它们的整体表现在这两种语言上仍有很大的提升空间。通过定性分析,我们讨论了当代机器翻译评估方法在此任务中的能力和局限性。
查看缓存全文
缓存时间: 2026/06/03 09:35
# 将古典诗歌翻译为现代散文 来源:https://arxiv.org/abs/2606.02806 查看 PDF (https://arxiv.org/pdf/2606.02806) > 摘要:我们提出了 Padyam2Gadyam,这是一个用于将 13 世纪至 17 世纪的泰卢固语古典诗歌翻译为当代泰卢固语和英语散文的数据集。该数据集包含 600 首诗歌及其经过人工核验的泰卢固语和英语散文翻译。我们评估了 5 个当代大型语言模型 (LLM) 在将诗歌翻译为泰卢固语和英语散文方面的能力。结果表明,尽管不同 LLM 之间存在差异,但其整体表现在两种语言中仍有很大的改进空间。通过定性分析,我们探讨了当前机器翻译评估方法在此任务中的能力与局限性。 ## 提交历史 来自:Kranti Chalamalasetti [查看邮箱 (https://arxiv.org/show-email/7e1fe74b/2606.02806)] **[v1]** 2026 年 6 月 1 日星期一 19:24:50 UTC (521 KB)
相似文章
使用可解释的形式级特征检测与引导LLM生成的韩国诗歌
本文介绍了可解释的形式级特征,用于检测和引导LLM生成的韩国诗歌,实现了检测准确性的提升,并生成了在形式上更贴近人类写作的诗歌。
大型语言模型在理解现代中文诗歌中的诗歌逻辑方面表现如何?
本文介绍了Peony,首个评估大型语言模型在理解现代中文诗歌中诗歌逻辑的基准,并评估了六种主流LLM,揭示了它们在这一专业任务中的局限性。
通过多阶段LLM流程的结构保持文档翻译:以马拉地语为例
本文提出了一种多阶段LLM流程,用于政府文档的结构保持型马拉地语到英语翻译,集成了布局感知OCR和HTML重构,以维护格式和领域术语。
Padamitra: 面向古典梵语的基于语境词汇表生成
本文介绍了面向古典梵语的基于语境词汇表生成,这一任务涉及从诗句-翻译对中恢复梵语短语并产生翻译驱动的含义。研究从印度教文本构建了一个基准,并评估了多种AI模型,发现指令微调能提升性能,而形态建模被确定为一个关键挑战。
大型语言模型中的比喻与文化知识:通过微调研究跨领域迁移
本研究探讨了在大型语言模型上微调文化数据是否能提升比喻语言的理解能力,反之亦然。研究发现,虽然诗歌微调能增强成语理解,但文化微调可能会降低谚语准确率,突显了两者之间关系的非直接性。