nlp

标签

Cards List
#nlp

上线了一款面向金融科技的印地语-英语语音代理:所有踩过的坑以及真正有效的修复

Reddit r/AI_Agents · 昨天

一位开发者分享了为金融科技构建印地语-英语语音代理的事后复盘,重点介绍了数字回读、语码混合TTS、负载下的延迟和合规性等挑战。关键的修复是选择对印度语码混合有一流支持的TTS,并在真实并发条件下进行测试。

0 人收藏 0 人点赞
#nlp

MameLoshnLM:意第绪语语言模型与评估基准

arXiv cs.CL · 2天前 缓存

本文介绍了 MameLoshnLM,这是首个开源的 8B 参数意第绪语语言模型,同时还包括 Oytser 预训练语料库和 Kashes 评估基准。研究表明,在高质量意第绪语数据上进行持续预训练的表现优于通用多语言模型,凸显了专门进行低资源语言建模的价值。

0 人收藏 0 人点赞
#nlp

不同扰动,不同机制:理解面向零样本方言鲁棒性的持续预训练

arXiv cs.CL · 2天前 缓存

本文系统研究了基于扰动的持续预训练(CPT)在提升多语言大语言模型零样本方言鲁棒性方面的作用,比较了德语、意大利语和阿拉伯语中的六种训练条件。研究发现,字符级噪声CPT是最有效的通用策略,并揭示了不同扰动方法会引发不同的鲁棒性机制。

0 人收藏 0 人点赞
#nlp

重复出现的 LLM 轨迹能否被合成为由类型化 ML 和 NLP 算子组成的确定性流水线?[D]

Reddit r/MachineLearning · 2天前

本文探讨了重复出现的 LLM 工作负载是否可以在适当情况下被自动合成的、由类型化 ML/NLP 算子组成的确定性流水线所替代,并征求关于可行性和方法的反馈。

0 人收藏 0 人点赞
#nlp

IslamicTurathBench:评估大语言模型在伊斯兰学术传统(turath)上的多任务、多学科基准

arXiv cs.CL · 3天前 缓存

IslamicTurathBench(ISTB)是一个新的多任务、多学科基准,用于评估大语言模型在古典伊斯兰学术上的表现,包含 3,465 道专家审核的题目,涵盖 35 部著作和七个领域。

0 人收藏 0 人点赞
#nlp

FinReportBench:衡量与改进机构级财务报告生成

arXiv cs.CL · 3天前 缓存

FinReportBench 是一个基于专家经验的基准测试,用于衡量和改进机构级财务报告生成,包含 35 项可观察标准,涵盖可交付性、报告身份和机构完整性。它精选了 244 个双语任务,评估了九个模型家族,并使用基准引导的技能蒸馏来改进五个模型家族的生成和自我审查能力。

0 人收藏 0 人点赞
#nlp

搜索音义碰撞:基于图的可供性检索与多评估器排序在CLEF 2026 JOKER任务2双关语翻译中的应用

arXiv cs.CL · 3天前 缓存

本文从计算角度研究双关语翻译,将其视为一个发现、探索和选择的过程,使用基于图的可供性检索和多评估器排序。作者表明,成功的双关语翻译依赖于在目标语言中发现新的音义碰撞,而非保留源语言词汇。

0 人收藏 0 人点赞
#nlp

面向低资源语言的大语言模型:塔吉克语电子详解词典的概念框架

arXiv cs.CL · 3天前 缓存

本文提出了一个使用大语言模型构建塔吉克语电子详解词典的概念框架,该框架整合了词法分析、词形还原、语义聚类和词典条目生成,并采用PEFT策略。

0 人收藏 0 人点赞
#nlp

用多智能体视角偏好优化学习性别歧视检测

arXiv cs.CL · 3天前 缓存

该论文提出了MAP-PO,一个多智能体框架,通过标注行为对标注者进行聚类,并使用偏好优化为每个聚类微调独立的LLM智能体,从而在性别歧视检测任务中保留分歧。在EXIST 2024数据集上的实验表明,聚类特定训练是必要的,且共享的团队级奖励能使智能体保持校准。

0 人收藏 0 人点赞
#nlp

模型会保持自己的判断,还是赞同当前讲故事的人?

Reddit r/singularity · 3天前

一个GitHub项目,衡量语言模型如何根据叙事框架改变判断,量化对立叙述者之间的谄媚程度。

0 人收藏 0 人点赞
#nlp

动态分配评估努力以进行模型排名

arXiv cs.CL · 4天前 缓存

本文将多模型人类评估形式化为多臂老虎机设置中的最佳臂识别问题,自适应地分配标注努力以聚焦于有竞争力的模型,并提高排名区分度。

0 人收藏 0 人点赞
#nlp

HomoEnsNER:语言对齐在古吉拉特语命名实体识别中是否优于架构复杂性?

arXiv cs.CL · 4天前 缓存

本文提出了HomoEnsNER,一个由五个GujaratiBERT模型组成的同质集成,用于古吉拉特语命名实体识别,并表明它优于依赖架构多样性的异构替代方案,在Naamapadam测试集上取得了最先进的F1分数。

0 人收藏 0 人点赞
#nlp

TabletCraft:用双向阿卡德语神经机器翻译与楔形文字渲染弥合四千年文化鸿沟

arXiv cs.CL · 4天前 缓存

TabletCraft 是一个开源系统,支持阿卡德语与英语之间的双向神经机器翻译,并具备楔形文字渲染功能,使用户既能阅读古代泥板,也能用楔形文字撰写新消息。该系统已被 ACL 2026 的 C3NLP 研讨会接收,并首次公布了英语到阿卡德语翻译的量化结果。

0 人收藏 0 人点赞
#nlp

多样性并非歧义:面向开放域问答的准确高效歧义检测

arXiv cs.AI · 4天前 缓存

本文提出了Archive,一个用于开放域问答中歧义检测的框架,利用逻辑冲突区分歧义与答案多样性,并引入了包含4,703个查询的基准QuireQA。实验表明,Archive将F1最高提升21.6%,同时比竞争对手快16倍。

0 人收藏 0 人点赞
#nlp

@jxmnop:我认为我们从来都不需要发明掩码语言建模。它在构造上就有点愚蠢。在大多数平行宇宙里,我们可能直接跳到自回归模型了,抱歉了 BERT

X AI KOLs Following · 4天前

一条推文认为掩码语言建模没有必要,自回归模型就足够了,并顺便提到了 BERT。

0 人收藏 0 人点赞
#nlp

Pruned BPE: Post-training Visibility Pruning and Token Reallocation for Byte Pair Encoding

arXiv cs.CL · 5天前 缓存

This paper proposes Pruned BPE, a post-training method that prunes low-exposure tokens from a BPE vocabulary and reallocates slots to better-exposed candidates, reducing encoded length without increasing model-visible vocabulary size. Experiments on English and Chinese corpora show approximately 0.27–0.36% encoded length reduction over standard BPE.

0 人收藏 0 人点赞
#nlp

Exploiting Intrinsic Duality for Multi-Hop Question Generation

arXiv cs.CL · 5天前 缓存

The paper proposes QQ, a framework that leverages the intrinsic duality between multi-hop question generation and question answering via bidirectional alignment constraints and contrastive learning, improving question quality on HotpotQA and MuSiQue.

0 人收藏 0 人点赞
#nlp

AttnLink: Turning Attention into Schema Links for Text-to-SQL

arXiv cs.CL · 5天前 缓存

AttnLink is a research paper presenting an attention-based framework for schema linking in Text-to-SQL, converting LLM internal attention into continuous relevance scores for schema items. Experiments on Spider, BIRD, and Spider2-SQLite show high mAP scores and millisecond-scale latency.

0 人收藏 0 人点赞
#nlp

Select-And-Extract:检索增强生成的轻量级插件

arXiv cs.CL · 5天前 缓存

本文介绍了SANE,一种用于检索增强生成的轻量级插件,通过基于摘要选择最佳候选者并执行蓝图引导的查询时证据提取,同时改进检索和阅读。

0 人收藏 0 人点赞
#nlp

面向字节级BPE的书写系统级分词器适配

arXiv cs.CL · 5天前 缓存

本文介绍了BPE引导插入,用于对字节级BPE模型进行事后分词器适配,在保持词汇表大小固定的同时保留大多数token-ID分配。该方法将乌克兰语的token数量减少约33-36%,同时将对英语和其他欧洲语言的影响降至最低。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈