@dosco: 我看到很多行业论文实际上是Karpathy的自动研究循环(未引用)或是Codex优化目标,旨在改进某个特定事物……
摘要
关于近期行业AI论文缺乏新颖性的批判性观察,以SkillOpt为例,这些论文将自然语言技能视为可训练的外部参数。
查看缓存全文
缓存时间: 2026/05/26 07:04
我看到很多行业论文实际上就是 Karpathy 的自动研究循环(没有引用),或者是一个针对改进某单一特定目标的 Codex 优化目标,被包装成一个系统并写成论文。虽然不想显得负面,但为了提供诚实反馈,我觉得这类论文——比如 Skill-Opt、Skill-Forge 和 Skills-Coach——整体上缺乏新意。
Yifan Yang (@Yif_Yang): 🚀 推出 SkillOpt —— 一种针对 Agent 技能的优化器。
不同于微调模型权重,我们将自然语言技能视为可训练的外部参数。
可以把它看作是面向「前沿模型 + Agent」时代的深度学习:学习率、学习率调度、小批量、批量。
相似文章
@dair_ai: https://x.com/dair_ai/status/2061104052818108476
三篇值得关注的人工智能论文综述:SkillOpt 将技能文档视为可训练参数以优化冻结的智能体;一种新方法将智能体工作流编译成模型权重,实现100倍成本降低;而 AutoScientists 引入了一个去中心化智能体团队,无需中央规划者即可进行长期科学研究。
@omarsar0:Karpathy 的 autoresearch 仓库掀起一股新风潮,智能体已能训练 AI 模型打造 SoTA 智能体系统……
Karpathy 的 autoresearch 项目引发潮流:智能体训练 AI 模型构建最先进的智能体系统,同时暴露当前 LLM 在假设生成上的短板。
@omarsar0: 微软研究院的新研究 我看到很多AI工程师手写智能体技能文档,并希望它们能泛化。…
微软研究院推出了SkillOpt,该方法将智能体技能文档视为可训练的外部状态,利用优化器模型进行受限编辑,并通过预留集进行验证。该方案在52个评估单元中取得最佳或并列结果,在GPT-5.5上准确率提升超过23个百分点,且零额外推理成本,技能可迁移。
@lftherios:1/ @karpathy 的 autoresearch 是今年最具代表性的智能体范式之一。问题在于……
Andrej Karpathy 的 autoresearch 范式揭示:当下 AI 智能体各自为战做实验,重复劳动、浪费算力,还不断「重新发明」死路。
@dair_ai: https://x.com/dair_ai/status/2068724104815890889
重点介绍近期三篇AI论文:SpatialClaw(通过代码实现无需训练的空间推理),SkillWeaver(组合式技能路由,采用分解-检索-组合流水线),以及PreAct(将智能体运行编译为快速状态机,用于重复任务)。