academic-research

标签

Cards List
#academic-research

哈佛大学和UIUC的研究人员发现第三个预训练轴:样本效率提升6.2倍,GenAI生成速度提升250倍

Reddit r/singularity · 2026-07-31

来自哈佛大学和UIUC的研究人员发现了第三个预训练轴,将样本效率提高了6.2倍,并将GenAI生成速度提高了250倍。

0 人收藏 0 人点赞
#academic-research

(迈向)使用大型语言模型的可扩展可靠自动化评估

arXiv cs.CL · 2026-07-31 缓存

本文提出了一种可扩展、领域无关的自动化 LLM 评估框架,该框架利用多个 LLM 的成对比较和 Elo 评分系统来近似专家判断,从而减少人工干预的需求。

0 人收藏 0 人点赞
#academic-research

@JenovaAIAgent: “你喜欢我们的美味冰淇淋吗?”现在正在某处投入生产。该调查工具已发布。领导层已查看仪表盘…

X AI KOLs Following · 2026-07-30 缓存

Jenova AI 的 Survey Design Consultant 工具通过 Tourangeau 认知模型分析问题、推荐经过验证的量表并确保最佳长度,从而提升调查质量。

0 人收藏 0 人点赞
#academic-research

基于可复制上下文的防护措施无法为LLM提供可靠的安全性

Hugging Face Daily Papers · 2026-07-30 缓存

本文认为,基于可复制上下文的LLM防护措施无法可靠地确保安全性,提出了在有用能力、可靠安全性和开放访问之间的安全三难困境,并建议将可信凭证作为补充机制。

0 人收藏 0 人点赞
#academic-research

@tom_doerr: 生成博士论文提案、撰写文献综述,并创建具有矢量方程和高保真度的学术幻灯片…

X AI KOLs Timeline · 2026-07-29 缓存

一组用于学术研究工作流的Claude Code技能,包括文献综述、博士论文提案,以及带有矢量方程和引用的高保真学术幻灯片。

0 人收藏 0 人点赞
#academic-research

借助ChatGPT for Academic Researchers加速科学发现

OpenAI Blog · 2026-07-29 缓存

OpenAI推出ChatGPT for Academic Researchers,为10万名研究人员免费提供包括GPT-5.6 Sol Pro在内的前沿模型,以加速科学发现,并承诺到2027年投入2.5亿美元。

0 人收藏 0 人点赞
#academic-research

何时使用额外上下文:面向同声传译的基于证据的术语自适应

arXiv cs.CL · 2026-07-21 缓存

本文提出了EGTA,一种面向同声传译的基于证据的术语自适应框架,该框架选择性地使用文档特定术语来改进罕见词的翻译,在无需全模型微调的情况下,在命名实体和缩写召回率方面取得了显著提升。

0 人收藏 0 人点赞
#academic-research

通过激活聚合的提示压缩

arXiv cs.CL · 2026-07-10 缓存

本文提出通过中间层激活的学习加权和将指令提示压缩为单个激活向量,准确率下降低于2%,并揭示了对LLM激活空间结构的洞察。

0 人收藏 0 人点赞
#academic-research

使用离线强化学习控制LLM Agent执行框架

arXiv cs.LG · 2026-07-08 缓存

本文通过一个使用离线强化学习训练的Harness MDP,将LLM Agent周围的执行框架形式化为一个可学习的控制层,展示了在多个领域中的验证行为和最终质量的改进。

0 人收藏 0 人点赞
#academic-research

ACPO:基于细粒度替代熵的自适应信用策略优化

arXiv cs.LG · 2026-07-07 缓存

介绍了ACPO,一种用于大型语言模型强化学习的token级信用分配框架,利用细粒度替代熵提升数学和编码基准的推理性能,优于DAPO、GTPO、SAPO等强基线。

0 人收藏 0 人点赞
#academic-research

@yrzhe_top: 试了一下 Claude Science,感觉很适合做科研早期调研。它会把一个研究问题拆成多个检索面,连接 OpenAlex、arXiv 这样的文献库,抓取真实文献数据,然后自动去重、过滤、聚类、画图,最后生成一份带主题地图、增长趋势和代表…

X AI KOLs Timeline · 2026-07-05

Claude Science是一款科研早期调研工具,可自动检索、去重、聚类文献并生成研究地图和趋势报告,对探索新领域很有帮助。

0 人收藏 0 人点赞
#academic-research

@idlhy0218:学术论文本质上是一种引用“对话”。我开发了一个工具,可以从你的 Zotero 图书馆中拉取文件夹并…

X AI KOLs Timeline · 2026-07-04 缓存

一个免费的开源工具,利用 OpenAlex 数据库分析 Zotero 图书馆中的引用关系,并生成关联的 Obsidian 笔记。

0 人收藏 0 人点赞
#academic-research

黑盒大型语言模型的知识蒸馏

Hacker News Top · 2026-06-28 缓存

提出了一种名为 Proxy-KD 的新方法,通过代理模型从黑盒大型语言模型(如 GPT-4)中蒸馏知识到较小的模型,超越了传统的黑盒和白盒知识蒸馏技术。

0 人收藏 0 人点赞
#academic-research

面向仓库优化的上下文感知流水线合成

arXiv cs.AI · 2026-06-26 缓存

本文提出CASOP(上下文感知优化流水线合成与评估框架),用于仓库订单履约中优化流水线的上下文感知合成与评估,支持从模块化仓库中自动构建有效的算法流水线。

0 人收藏 0 人点赞
#academic-research

探究LLM的问题解决能力——静力学问题研究

arXiv cs.CL · 2026-06-26 缓存

本文评估了LLM在静力学问题上的表现,发现虽然纯文本问题处理得较好,但引入图表和多步推理后准确率下降,表明模型在持续应用视觉信息方面存在困难。

0 人收藏 0 人点赞
#academic-research

加速国际象棋技能评估:漂移扩散增强的Elo评级系统

arXiv cs.AI · 2026-06-26 缓存

提出了DD-Elo,一种通过漂移扩散模型整合步级数据以加速技能评估和评级适应的国际象棋评级系统,同时保持与传统Elo的一致性。

0 人收藏 0 人点赞
#academic-research

迈向代理优先的Web:为AI代理重新设计互联网

arXiv cs.AI · 2026-06-18 缓存

本文提出对万维网进行原则性重新设计,以适应AI代理作为主要中介,涉及访问权限、速率限制和标准化代理标识,从而超越以人为中心的假设。

0 人收藏 0 人点赞
#academic-research

R2D-RL: 面向多智能体强化学习的RoboCup 2D足球环境

arXiv cs.AI · 2026-06-18 缓存

介绍R2D-RL,一个强化学习环境,通过共享内存通信将RoboCup 2D足球模拟服务器与基于Python的多智能体强化学习工作流连接起来,支持全场和基于场景的训练,可配置对手和奖励塑造。

0 人收藏 0 人点赞
#academic-research

@coldsake_: https://x.com/coldsake_/status/2067374833692815638

X AI KOLs Timeline · 2026-06-17 缓存

本文介绍如何使用Obsidian结合Codex/CC等AI工具构建学术文献管理系统,实现文献自动分类、查重、生成wiki页面和学术工具箱,并分享阅读文献和提升学术能力的方法。

0 人收藏 0 人点赞
#academic-research

@tom_doerr: 将学术论文转换为结构化的Obsidian笔记 https://github.com/917Dhj/DeepPaperNote…

X AI KOLs Timeline · 2026-06-17 缓存

DeepPaperNote 是一个开源工具,可自动将学术论文转换为结构化的Obsidian笔记,处理元数据、图表和笔记生成,以支持深度阅读。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈