natural-language-processing

标签

Cards List
#natural-language-processing

字母还原:利用一对一和带状RNN逆转中世纪文本中的字符集简化与缩写

arXiv cs.CL · 2026-07-13 缓存

本文提出了用于逆转中世纪文本中字符集简化和缩写的神经方法,采用一对一和带状RNN,并通过自监督或平行语料库进行训练,同时介绍了一个用于字母还原的Python库。

0 人收藏 0 人点赞
#natural-language-processing

L-MAD:法律推理中多智能体辩论结构的系统性评估

arXiv cs.AI · 2026-07-13 缓存

本文介绍了L-MAD,一个用于系统性评估法律文本蕴含中多智能体辩论结构的框架。研究发现,增加智能体数量可提升准确率,但延长辩论轮次会导致有害的过度 deliberation 漂移,使得智能体互相强化错误,相较于单智能体基线最高提升8%。

0 人收藏 0 人点赞
#natural-language-processing

基于细粒度分类法从SEC 8-K文件中进行可溯事件抽取

arXiv cs.CL · 2026-07-10 缓存

本文提出一个基于大语言模型(LLM)的两阶段系统,利用包含119种事件类型的三层分类法,从SEC 8-K文件中提取可溯事件标签,并具备约束与可审计机制。该系统在近30万份文件上进行了评估,在高质标签上展现出高精确度,并支持区分经济意义上不同事件的事件研究。

0 人收藏 0 人点赞
#natural-language-processing

揭示公众舆论:基于LSTM与传统模型的情感分析研究

arXiv cs.CL · 2026-07-10 缓存

本文对LSTM和传统模型在公众舆论情感分析中进行了比较研究。

0 人收藏 0 人点赞
#natural-language-processing

@stanfordnlp:在大语言模型时代,仍有使用细致语言学的机会!

X AI KOLs Following · 2026-07-09 缓存

斯坦福NLP宣布,一篇题为《大语言模型中的未完成体悖论》的语言学视角NLP论文在ACL 2026上获得最佳论文奖,鼓励对大语言模型进行更细致的语言学评估。

0 人收藏 0 人点赞
#natural-language-processing

LLMs悄悄纠正非裔美国人英语:通过激活操控审计和缓解方言偏见

arXiv cs.CL · 2026-07-09 缓存

本文审计并缓解大型语言模型中的方言偏见,显示它们系统性地偏好标准美式英语而非非裔美国人英语。作者引入了激活操控,一种无需训练的方法,在保持流畅性的同时显著减少偏见,并发布了迄今为止最大的真实AAE平行语料库。

0 人收藏 0 人点赞
#natural-language-processing

@chenxiao_yang_: 对于更长范围的任务,我们常常考虑使用长上下文模型。但框架也很重要!实际上,它们……

X AI KOLs Timeline · 2026-07-08 缓存

这篇 ICML 论文介绍了递归模型,这些模型递归地调用自身在隔离上下文中解决子任务,证明它们可以在长时推理中超越上下文受限的自回归模型。在 SAT 求解和围棋博弈树搜索上的实验表明,使用较小的活动上下文能提高准确性。

0 人收藏 0 人点赞
#natural-language-processing

域适应总是有帮助吗?一项关于跨域情感迁移的冻结骨干网络研究

arXiv cs.CL · 2026-07-08 缓存

本文探讨了在使用冻结的预训练语言模型骨干时,显式域适应方法是否对情感迁移有益,发现其有效性取决于骨干是否已经拥有目标域知识。

0 人收藏 0 人点赞
#natural-language-processing

UCSC NLP at SemEval-2026 Task 10:基于边界感知的跨度抽取与RoBERTa分类的阴谋论检测

arXiv cs.CL · 2026-07-08 缓存

本文介绍了UCSC NLP在SemEval-2026 Task 10(PsyCoMark)中使用的系统,针对阴谋论标记提取采用了基于边界感知的跨度抽取与RoBERTa,以及文档级别的阴谋论分类(含标签平滑)。该系统在子任务1中排名第7,在子任务2中排名第12。

0 人收藏 0 人点赞
#natural-language-processing

基于推特上自我报告ADHD和ASD用户的DSM-5抑郁症状群体层面剖析:一项使用高级NLP与统计分析的前瞻性研究

arXiv cs.CL · 2026-07-08 缓存

本研究分析了来自自我报告ADHD和ASD用户的推文,利用NLP刻画DSM-5抑郁症状,发现尽管分类性能有限,但两组在症状表达上存在群体层面的差异。

0 人收藏 0 人点赞
#natural-language-processing

从文化遗产保护视角重新思考Indic AI

arXiv cs.AI · 2026-07-08 缓存

本文综述了印度语言自然语言处理(NLP)的挑战与演变,强调文化遗产,并提出一个名为“文化感知”的新研究方向,以解决代表性差距并确保AI输出具有文化意义。

0 人收藏 0 人点赞
#natural-language-processing

在细节中查找幽门螺杆菌:基于证据的多智能体病例发现——来自胃活检报告

arXiv cs.AI · 2026-07-08 缓存

本文介绍了Nimblemind多智能体系统(nMAS),用于从胃活检报告中提取幽门螺杆菌感染证据,在216个特征病例决策中达到98.61%的准确率,并显示出相比人工审查显著节省时间。

0 人收藏 0 人点赞
#natural-language-processing

利用大型语言模型生成合成消费者洞察

arXiv cs.AI · 2026-07-08 缓存

本研究探讨了大型语言模型能否为投射技术生成合成消费者数据,通过比较人类与LLM在城市旅游感知上的回应,发现两者在主题上高度重叠,但在风格、语言结构和多样性生成方式上存在重要差异。

0 人收藏 0 人点赞
#natural-language-processing

Genie Ontology 如何真正提高 text-to-SQL 准确率——机制而非宣传

Reddit r/AI_Agents · 2026-07-07

本文解释了 Genie Ontology 方法如何通过关注底层机制而非营销宣传来提高 text-to-SQL 准确率。

0 人收藏 0 人点赞
#natural-language-processing

Lacuna Inc. 参与 SemEval-2026 任务4:基于结构门控状态空间模型的叙事相似性解耦

arXiv cs.CL · 2026-07-07 缓存

本文介绍了不变-可变解耦状态空间模型(IVD-SSM),这是对 SemEval-2026 任务4的提交,该模型使用混合 Jamba-1.5-Mini 骨干网络和新型结构门控对齐头,从词汇变体中解耦结构不变性,用于叙事相似性评估。

0 人收藏 0 人点赞
#natural-language-processing

从丢失的溯源中学习:用于癌症登记肿瘤组分类的多实例学习

arXiv cs.CL · 2026-07-07 缓存

本文提出了一种基于注意力的多实例学习(ABMIL)框架,利用癌症登记处的患者级别标签来训练用于肿瘤组分类的深度学习分类器,无需每份报告的注释,在BC癌症登记处的任务上实现了0.83的宏F1。

0 人收藏 0 人点赞
#natural-language-processing

CaresAI在SMM4H-HeaRD 2026:预测TNM分期

arXiv cs.CL · 2026-07-07 缓存

本文介绍了CaresAI在SMM4H-HeaRD 2026共享任务上的方法,该任务利用多种嵌入和分类器从病理报告中预测TNM分期,取得了强劲结果,但也指出了泛化问题。

0 人收藏 0 人点赞
#natural-language-processing

TACG:面向扩散语言模型解码的轨迹感知提交门控

arXiv cs.CL · 2026-07-07 缓存

TACG 是一种无需训练的扩散语言模型解码器,通过轨迹感知信号决定何时提交 token,在代码和数学基准测试中提高了准确性和效率。

0 人收藏 0 人点赞
#natural-language-processing

psytechlab 在 CLPsych 2026:利用自然语言处理方法和大型语言模型进行社交媒体文本分析

arXiv cs.CL · 2026-07-07 缓存

本文描述了在 CLPsych 2026 共享任务中,使用包括 LSTM、BERT 和 LLMs 在内的自然语言处理方法分析社交媒体帖子中的心理健康状态,并在摘要任务中取得了最高的一致性得分。

0 人收藏 0 人点赞
#natural-language-processing

NLP的未来可能不在NLP会议上:自然语言处理中的学术迁移模式

arXiv cs.CL · 2026-07-03 缓存

一项分析2010年至2026年间14.2万篇NLP论文的研究发现,资深和新兴的NLP作者越来越多地将论文发表在NeurIPS和ICLR等通用机器学习会议上,而非ACL等核心NLP会议,且ML会议具有显著的引用优势。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈