natural-language-processing

标签

Cards List
#natural-language-processing

我们是否需要回答那个问题?自然对话中潜在问题的显著性与可回答性

arXiv cs.CL ↗ · 昨天 缓存

本文实证研究了自然对话中问题的显著性与可回答性之间的关系,发现一个稳健但低的正相关关系,且弱于独白文本中的相关性,这表明对话结构的可预测性较低。

0 人收藏 0 人点赞
#natural-language-processing

Coupled Usage-Sense Processes: 时间性与可归因的词汇语义变化

arXiv cs.CL ↗ · 昨天 缓存

本文介绍了Coupled Usage–Sense Processes (CUSP),一个用于分析词汇语义变化的层次化模型,通过量化词语使用中随时间变化的时间、机制和归因。

0 人收藏 0 人点赞
#natural-language-processing

LLMs是否理解上下文?基于知识图谱的评估框架

arXiv cs.AI ↗ · 昨天 缓存

本文提出一种基于知识图谱的评估框架,用于评估大型语言模型在问答任务中的上下文理解能力,并引入一种新的相似度度量S3KG,该度量在性能上优于现有的基线方法。

0 人收藏 0 人点赞
#natural-language-processing

通过ℓp正则化在大语言模型中实现低秩适应的自动秩分配

arXiv cs.LG ↗ · 4天前 缓存

本文介绍了一种基于ℓp正则化的自动秩分配方法ℓp-LoRA,该方法用于低秩适应,并在自然语言处理任务上展示了具有竞争力的性能。

0 人收藏 0 人点赞
#natural-language-processing

当解释无法阅读时:测量和校正面向右到左语言的 SHAP 与 LIME 渲染

arXiv cs.LG ↗ · 4天前 缓存

本研究引入 SHAP-RTL,一个渲染层,用于校正针对右到左语言的 SHAP 和 LIME 解释可视化,解决标记序列和文本塑形等问题,同时保留原始归因值。

0 人收藏 0 人点赞
#natural-language-processing

经典语义抽取式摘要能否在印地语中进行评估?一项复现研究

arXiv cs.CL ↗ · 4天前 缓存

本文复现了一种针对印地语的分布式语义抽取式摘要方法,并在标准语料库上进行评估,发现句子位置是唯一有效的特征,且当前的印地语基准测试未能激励高级内容选择。

0 人收藏 0 人点赞
#natural-language-processing

对比语言模型

Hacker News Top ↗ · 5天前

本文可能介绍了对比语言模型的研究,探讨对比学习技术在语言模型开发中的应用。

0 人收藏 0 人点赞
#natural-language-processing

通过过滤技术提升基于大语言模型的自主网络智能体性能

arXiv cs.CL ↗ · 5天前 缓存

本文提出了一种检索策略,用于过滤大语言模型驱动的自主网络智能体中的无关HTML内容,从而提升其在WebArena等基准测试上的表现。

0 人收藏 0 人点赞
#natural-language-processing

并非所想:大型语言模型能否遵循指定的否定语义?

arXiv cs.AI ↗ · 5天前 缓存

本文介绍了NAF-Bench,用于研究大型语言模型对指定否定语义的遵守情况。研究发现,像o4-mini这样的前沿模型表现良好,而开源模型则滞后。建议通过求解器委托或微调来改进。

0 人收藏 0 人点赞
#natural-language-processing

用户生成文本音素化:基准、分类体系与组合方法

arXiv cs.CL ↗ · 5天前 缓存

本文介绍UGTPhon,一个针对用户生成文本字音转换的基准,并提出一种组合方法,通过利用标准形式提升性能。

0 人收藏 0 人点赞
#natural-language-processing

构建面向交互式多智能体模拟的社会情感人工智能

arXiv cs.AI ↗ · 5天前 缓存

本文提出设计原则及'AGIMUD'软件,该软件利用生成式人工智能和分布式处理,以支持在模拟动态世界中人类与多个AI智能体之间的社会情感交互。

0 人收藏 0 人点赞
#natural-language-processing

ARAFA:一个基于LLM生成的阿拉伯语事实核查数据集

arXiv cs.CL ↗ · 6天前 缓存

本文介绍了Arafa,一个使用LLM生成的大规模阿拉伯语事实核查数据集,旨在解决阿拉伯语自动事实核查资源稀缺的问题。

0 人收藏 0 人点赞
#natural-language-processing

为LLM推理压缩长上下文至答案对齐的记忆嵌入

arXiv cs.CL ↗ · 6天前 缓存

本文提出一种上下文与答案对齐的记忆压缩(CMC)框架,通过将长输入上下文压缩为紧凑的记忆嵌入,在不修改解码器权重的情况下降低LLM推理成本,显著提升性能和效率。

0 人收藏 0 人点赞
#natural-language-processing

Peerify:同行评审声明验证基准测试

arXiv cs.CL ↗ · 6天前 缓存

Peerify 是一个用于自动验证同行评审声明与稿件证据的流程,使用来自 NeurIPS 2024 和 ICLR 2024 的 800 个声明的基准,证明以检索为中心的验证优于蕴含基线。

0 人收藏 0 人点赞
#natural-language-processing

@VraserX: AI 的日子真美好。GPT-6 Sol 和 Luna 终于来了,将 Astra 级别的进步带入更快、更便宜的模型中,这些模型能够在大规模上实际使用…

X AI KOLs Timeline ↗ · 6天前 缓存

OpenAI 发布了 GPT-6 Sol 和 GPT-6 Luna,这是基于 GPT-6 Astra 进步的更快、更实惠的模型,旨在实现大规模使用。

0 人收藏 0 人点赞
#natural-language-processing

超越缝合假设:通过语义量化的多模态合成数据评估统一框架

arXiv cs.CL ↗ · 2026-09-22 缓存

本文提出了一种使用语义量化和跨模态指标评估多模态合成数据的统一框架,强调了进行显式评估时需要排列基线和覆盖报告。

0 人收藏 0 人点赞
#natural-language-processing

Hemmingway-1:像人一样写作的人工智能(Qwen3.8-27B 微调版)

Reddit r/LocalLLaMA ↗ · 2026-09-21

Hemmingway-1 是 Qwen3.8-27B AI 模型的微调版本,旨在生成更像人类的写作风格的文本。

0 人收藏 0 人点赞
#natural-language-processing

如何可靠地让AI代理将会议记录转化为行动项?

Reddit r/AI_Agents ↗ · 2026-09-21

用户描述了让AI代理可靠地将原始会议记录转化为带有负责人和截止日期的结构化行动项的挑战和部分解决方案,强调了幻觉和遗漏上下文等问题。

0 人收藏 0 人点赞
#natural-language-processing

CaLR:基于因果潜变量修正的鲁棒扩散推理

arXiv cs.AI ↗ · 2026-09-21 缓存

论文提出CaLR框架,通过因果拓扑构建有约束隐空间优化机制以增强扩散语言模型,在复杂基准测试中实现了最先进的性能。

0 人收藏 0 人点赞
#natural-language-processing

推理在机器翻译中何时有帮助?LRM推理轨迹的层次分析

arXiv cs.CL ↗ · 2026-09-21 缓存

本文分析了大型推理模型在机器翻译中的推理轨迹,发现推理收益是有条件的,并引入Hierarchical Meta-Summarization来理解轨迹模式。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈