scientific-papers

标签

Cards List
#scientific-papers

ResearchQA:科学论文中基于引用的问答基准测试

arXiv cs.CL · 6天前 缓存

ResearchQA是一个新基准,包含来自八个领域494篇开放获取论文的6,211个单论文问答对,旨在通过要求可验证引用并在证据不足时支持基于理由的拒绝,来评估基于引用的问答能力。

0 人收藏 0 人点赞
#scientific-papers

按语义相似度和时间切片划分的最新1100万篇论文地图 [P]

Reddit r/MachineLearning · 2026-06-30

利用语义相似度和时间切片对1100万篇学术论文进行大规模映射,从而分析研究趋势和关联。

0 人收藏 0 人点赞
#scientific-papers

从科学论文中提取问题和方法句子:使用公式化表达脱敏的上下文增强Transformer

arXiv cs.CL · 2026-06-26 缓存

本文提出了一种使用公式化表达脱敏的上下文增强Transformer,用于从科学论文中提取问题和方法句子,在两个数据集上分别实现了3.71%和2.67%的宏F1分数提升。

0 人收藏 0 人点赞
#scientific-papers

@heynavtoor: Rongxin Ouyang 解决了每个非英语世界的研究人员一直在默默忍受的那个问题…

X AI KOLs Timeline · 2026-06-22 缓存

PDFMathTranslate 是一个开源工具,用于翻译科学PDF文件,同时保留数学公式、图表、表格和布局,已被EMNLP 2025接收,并在MIT许可下免费提供。

0 人收藏 0 人点赞
#scientific-papers

@Xudong07452910: 这可能是人类写给 AI 看的最后一篇论文了。 最近刷到Stanford、CMU、Michigan 等 37 位作者联名的论文:《The Last Human-Written Paper》。 核心观点很狠:沿用几百年的论文,在 AI 时代可…

X AI KOLs Timeline · 2026-06-09 缓存

来自Stanford、CMU、Michigan等37位作者联名的论文提出ARA(Agent原生研究工件)替代传统论文格式,旨在解决叙事税和工程税,让AI Agent能理解、复现和扩展研究。

0 人收藏 0 人点赞
#scientific-papers

Review Arcade:论LLM评审的人类对齐性与可操控性

arXiv cs.AI · 2026-05-29 缓存

本文通过实验评估了LLM生成的科学论文评审与人工评审之间的对齐程度,发现对齐有限且变化较大。研究还表明,作者可以通过迭代修改论文来“操控”LLM评审以提高分数,多达35%的论文的总体分数出现了统计显著提升。

0 人收藏 0 人点赞
#scientific-papers

我们距离真正的自动研究还有多远?

arXiv cs.AI · 2026-05-20 缓存

本文介绍了ResearchArena,一个用于评估自动研究智能体的框架,并发现虽然智能体生成的论文在仅稿件评审下看似具有竞争力,但结合工件的评审揭示了实验严谨性方面的严重缺陷,没有一篇论文达到顶级会议的接收标准。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈