@Phoenixyin13: 这是我最重要的信息转发之一。 这篇论文的第一作者是我极为钦佩的人,也是我的好朋友,来自@Tsinghua_Uni 姚班顶尖选手Guowei Xu,现在他在@Harvard 进行人工智能大模型的科研工作。 Guowei这篇论文精准击中了目前…

X AI KOLs Timeline 论文

摘要

转发介绍一篇由清华姚班毕业生Guowei Xu(目前在哈佛)撰写的论文,该论文精准指出了LLM搜索的两个致命瓶颈:稀疏验证和候选局限,对提升推理能力有重要意义。

这是我最重要的信息转发之一。 这篇论文的第一作者是我极为钦佩的人,也是我的好朋友,来自@Tsinghua_Uni 姚班顶尖选手Guowei Xu,现在他在@Harvard 进行人工智能大模型的科研工作。 Guowei这篇论文精准击中了目前LLM搜索的两个致命瓶颈: ① 只有最后一步对错的sparse verification ② https://t.co/zzUqckORQv
查看原文
查看缓存全文

缓存时间: 2026/05/29 07:59

这是我最重要的信息转发之一。

这篇论文的第一作者是我极为钦佩的人,也是我的好朋友,来自@Tsinghua_Uni 姚班顶尖选手Guowei Xu,现在他在@Harvard 进行人工智能大模型的科研工作。

Guowei这篇论文精准击中了目前LLM搜索的两个致命瓶颈: ① 只有最后一步对错的sparse verification ② https://t.co/zzUqckORQv

Guowei Xu (@Kevin_GuoweiXu): 🚀 How should LLMs sample on hard reasoning problems during post-training and inference where direct rollouts rarely produce a correct answer?

Best-of-N (e.g., GRPO) and tree search share two limitations: 🔻 Verification signals are sparse 🔻 Candidates stay within the model’s

相似文章

@Phoenixyin13: 震撼!来自英伟达和剑桥大学等团队的这篇 Red Queen Gödel Machine 绝对是我近期认为最重要的 AI 论文之一。 这次,论文直接针对自我改进 AI 的核心瓶颈: 以前,评估器一旦固定不变,就会导致代理钻空子或者快速停滞不…

X AI KOLs Timeline

英伟达与剑桥大学等团队提出的Red Queen Gödel Machine论文,通过让代理和评估器共进化解决了递归自我改进的瓶颈,在代码、论文写作等任务上超越现有SOTA,为可控开放式AI进化提供了重要方法论。

@snowboat84: 重读了哈佛量子场论教授Matthew Schwartz发在Anthropic博客的Vibe Physics。他全程只用文字提示,指挥 Claude(外加GPT、Gemini交叉验证)两周做完一篇真实的量子色动力学论文,贴上了arXiv,等…

X AI KOLs Timeline

哈佛教授Matthew Schwartz在Anthropic博客发表文章,展示用Claude、GPT、Gemini等大语言模型两周完成量子色动力学论文(通常需一年),并指出LLM在科研中的优缺点。作者进一步提出工程化修补方案,包括计算外挂、验证agent和人工把关,强调将LLM作为科研核心引擎。