@dosco: 我看到很多行业论文实际上是Karpathy的自动研究循环(未引用)或是Codex优化目标,旨在改进某个特定事物……

X AI KOLs Timeline 新闻

摘要

关于近期行业AI论文缺乏新颖性的批判性观察,以SkillOpt为例,这些论文将自然语言技能视为可训练的外部参数。

我看到许多行业论文实际上是Karpathy的自动研究循环(未引用)或Codex优化目标,旨在改进某个特定事物,却变成了一个系统和一篇论文。虽然听起来可能有些负面,但为了提供诚实的反馈,我看不出这类论文(例如Skill-Opt、Skill-Forge和Skills-Coach)有何新颖之处。
查看原文
查看缓存全文

缓存时间: 2026/05/26 07:04

我看到很多行业论文实际上就是 Karpathy 的自动研究循环(没有引用),或者是一个针对改进某单一特定目标的 Codex 优化目标,被包装成一个系统并写成论文。虽然不想显得负面,但为了提供诚实反馈,我觉得这类论文——比如 Skill-Opt、Skill-Forge 和 Skills-Coach——整体上缺乏新意。

Yifan Yang (@Yif_Yang): 🚀 推出 SkillOpt —— 一种针对 Agent 技能的优化器。

不同于微调模型权重,我们将自然语言技能视为可训练的外部参数。

可以把它看作是面向「前沿模型 + Agent」时代的深度学习:学习率、学习率调度、小批量、批量。

相似文章

@dair_ai: https://x.com/dair_ai/status/2061104052818108476

X AI KOLs Following

三篇值得关注的人工智能论文综述:SkillOpt 将技能文档视为可训练参数以优化冻结的智能体;一种新方法将智能体工作流编译成模型权重,实现100倍成本降低;而 AutoScientists 引入了一个去中心化智能体团队,无需中央规划者即可进行长期科学研究。

@dair_ai: https://x.com/dair_ai/status/2068724104815890889

X AI KOLs Following

重点介绍近期三篇AI论文:SpatialClaw(通过代码实现无需训练的空间推理),SkillWeaver(组合式技能路由,采用分解-检索-组合流水线),以及PreAct(将智能体运行编译为快速状态机,用于重复任务)。