ai-assisted-research

标签

Cards List
#ai-assisted-research

Claude 式科学:正确的计算,仍需一个值得问的问题

Reddit r/artificial ↗ · 6小时前

一篇评论文章,回应 Anthropic 发布的客座文章,后者介绍了 BootLoops——一系列工具,其中由 Claude 生成的计算在技术上是正确的,但只有在领域专家重新引导问题之后才获得了科学意义。文章主张,在把 AI 输出称为一项发现之前,算术验证与相关性/新颖性判断需要分别由专家独立审核;同时也指出,该客座文章的作者是 Anthropic 的访问研究员,而非独立基准测试者。

0 人收藏 0 人点赞
#ai-assisted-research

我借助AI获得了Conway猜想的证明

Hacker News Top ↗ · 2026-09-18 缓存

作者描述了使用AI辅助证明关于omnific integers的Conway refinement conjecture,声称在大量使用令牌后获得了Lean证明。该证明已通过机械检查,但尚待独立验证。

0 人收藏 0 人点赞
#ai-assisted-research

PRISMA-LLM:一个用于AI辅助系统性综述的实证报告框架

arXiv cs.CL ↗ · 2026-09-14 缓存

本文介绍了PRISMA-LLM,一个基于实证的报告AI辅助系统性综述的框架,解决了在综述工作流程中如何记录LLMs和AI软件的不一致性。

0 人收藏 0 人点赞
#ai-assisted-research

微软修复近1000个安全漏洞

Krebs on Security ↗ · 2026-09-08 缓存

微软发布超过974个安全补丁,包含关键零日漏洞,创下单次更新最大规模纪录,其中人工智能技术助力加速漏洞发现。

0 人收藏 0 人点赞
#ai-assisted-research

Fable 5 经济学工作

Hacker News Top ↗ · 2026-09-07 缓存

本文描述了利用 Opus 和 Fable 等 AI 工具开发新的工资决定经济理论的过程,该理论在一篇论文中形式化,扩展了 Acemoglu 和 Restrepo 的基于任务的模型。

0 人收藏 0 人点赞
#ai-assisted-research

Paper Pilot:一种面向应用科学中证据可追溯科学文稿生成的人机协同专家系统

arXiv cs.AI ↗ · 2026-09-01 缓存

Paper Pilot是一个面向证据可追溯科学文稿生成的人机协同专家系统,通过审批关卡和审计日志确保问责制并防止AI辅助研究工作流程中的伪造行为。

0 人收藏 0 人点赞
#ai-assisted-research

当难题不再难时(3分钟阅读)

TLDR AI ↗ · 2026-08-17 缓存

这篇文章反映了前沿大语言模型和Lean自动化如何大幅减少了编程语言研究中形式化证明所需的工作量,导致会议投稿数量翻倍并改变了出版规范。

0 人收藏 0 人点赞
#ai-assisted-research

利用中点Hessian矩阵在$2^{0.6039n}$时间内求解最短向量问题

Hacker News Top ↗ · 2026-08-05 缓存

本文提出了最短向量问题(SVP)的随机算法,通过使用周期高斯函数在中点处的Hessian矩阵,将经典最佳时间复杂度改进到$2^{0.6039n}$,量子最佳时间复杂度改进到$2^{0.5411n}$。

0 人收藏 0 人点赞
#ai-assisted-research

AI在物理、天体物理和宇宙学科学研究中的辅助能力 II:项目规划与提案评估

arXiv cs.CL ↗ · 2026-07-29 缓存

本文评估了大型语言模型(ChatGPT、Claude、DeepSeek)在物理、天体物理和宇宙学领域生成单页项目计划的能力,以及人类和AI评审员如何对其进行评估。结果表明,人类评审员对AI和人类撰写的提案评分相似,而AI评审员则更偏好AI撰写的提案,并能完美区分两者。

0 人收藏 0 人点赞
#ai-assisted-research

从元理念到高级数学发现——人类与AI共同发现符号嵌入量子算法

arXiv cs.LG ↗ · 2026-06-25 缓存

本文呈现了数学领域中人类与AI共同发现的一个案例研究,AI协助将关于符号嵌入量子算法的直觉扩展为正式框架和证明,而人类判断则指导路线选择。

0 人收藏 0 人点赞
#ai-assisted-research

@PierceZhang34: 分享一个专注于 AI 辅助科研的开放共建仓库 Awesome Vibe Research 项目核心目标它收集和沉淀科研全流程(从想法生成到论文发表、传播)中可复用、可验证、可演化的 AI 辅助组件,包括: Agents(智能体) Skil…

X AI KOLs Timeline ↗ · 2026-06-14 缓存

分享了一个由 ModelScope 维护的开放共建仓库 Awesome Vibe Research,该仓库收集并沉淀了科研全流程中可复用、可验证、可演化的 AI 辅助组件,包括智能体、技能包、工作流、工具和最佳实践,旨在帮助科研人员和开发者利用 AI 提升研究效率。

0 人收藏 0 人点赞
#ai-assisted-research

(Human) Attention Is (Still) All You Need: 人类监督使AI辅助的社会科学研究可靠

arXiv cs.AI ↗ · 2026-06-12 缓存

本文提出,AI辅助社会科学研究的可靠性取决于决策架构——即认知劳动在人类与机器之间的分工方式。通过一个预先指定的析因实验,作者表明,一个无约束的多智能体基线在72%的运行中失败,而采用三个架构承诺(限制LLM仅进行推理、确定性数据/估计、以及三个人类决策门控)的组织运行失败率仅为16%。

0 人收藏 0 人点赞
#ai-assisted-research

Bolzano:LLM辅助数学研究的案例研究

arXiv cs.CL ↗ · 2026-04-21 缓存

# Bolzano:LLM辅助数学研究的案例研究 来源:[https://arxiv.org/html/2604.16989](https://arxiv.org/html/2604.16989) Jan Grebík1、Pavel Hubáček1,2、Martin Koutecký1、Matěj Kripner3、Václav Rozhoň1、Robert Šámal1、Adrián Zámečník1 1 布拉格查理大学计算机科学研究所 2 捷克科学院数学研究所 3 布拉格查理大学形式与应用语言学研究所 ###### 摘要 我们报告了在数学与理论计算机科学领域六个问题上取得的新成果……

0 人收藏 0 人点赞
#ai-assisted-research

GPT-5.2 在理论物理学中推导出一个新结果

OpenAI Blog ↗ · 2026-02-13 缓存

GPT-5.2 协助推导出一个新的理论物理学结果,表明在特定半共线动量条件下,单负胶子树图振幅可以非零,挑战了粒子物理学中数十年的假设。该AI模型识别了复杂费曼图表达式中的模式,并推测出一个通用公式,随后通过形式化证明得到了验证。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈