@FinanceYF5: 2/ SkillOpt:把文档当参数来训练 微软把 SKILL.md 当成可训练的模型参数——不改权重,只优化自然语言文档,validation gate 过滤每次改动。 6 个 Benchmark 52 连胜,GPT-5.5 直聊提升 …
摘要
微软提出SkillOpt方法,将文档作为可训练参数,通过优化自然语言文档而不改动权重来提升模型性能,在6个benchmark上取得52连胜,GPT-5.5提升23.5分,Claude Code提升19.1分。
查看缓存全文
缓存时间: 2026/06/01 11:18
2/📄 SkillOpt:把文档当参数来训练
微软把 SKILL.md 当成可训练的模型参数——不改权重,只优化自然语言文档,validation gate 过滤每次改动。
6 个 Benchmark 52 连胜,GPT-5.5 直聊提升 +23.5 分,Claude Code 提升 +19.1 分。
相似文章
@NFTCPS: 微软搞了个东西叫 SkillOpt,思路挺野:把 agent 的技能文档当成神经网络一样来训练,有 epoch、batch、学习率、验证集,但一根模型权重都不碰。 它牛在哪?我给你拆三点: 训练只改一份 skill 文档,新的改动必须在验…
微软推出SkillOpt,一种将智能体技能文档像神经网络一样训练的方法,通过epoch、batch、学习率和验证集来进行优化,但不修改模型权重。在多项基准测试中取得最佳结果,可跨模型和工具迁移。
@gippp69:这个人展示了Microsoft Loop,它无需重新训练就将GPT-5.5从41%提升至80%——微软的SkillOpt论文提到…
这条推文讨论了微软的SkillOpt论文,该论文通过使用一个小的技能文件来指导智能体,在不重新训练的情况下将GPT-5.5的准确率从41%提升至80%。
@omarsar0: 微软研究院的新研究 我看到很多AI工程师手写智能体技能文档,并希望它们能泛化。…
微软研究院推出了SkillOpt,该方法将智能体技能文档视为可训练的外部状态,利用优化器模型进行受限编辑,并通过预留集进行验证。该方案在52个评估单元中取得最佳或并列结果,在GPT-5.5上准确率提升超过23个百分点,且零额外推理成本,技能可迁移。
@nash_su: 巨硬出的这个东西有点意思 用训练模型的思路优化 skill,每次对skill的MD内容做一些调整,然后跑结果,好了就继续推进,这个思路蛮有意思
微软发布一个新工具,采用训练模型的迭代方法优化skill,每次调整markdown内容并测试结果,不断推进改进。
@Yif_Yang: 介绍 SkillOpt — 一个面向智能体技能的优化器。不再微调模型权重,而是将自然语言…
介绍 SkillOpt,一个将自然语言技能视为可训练外部参数而非微调模型权重的优化器。它通过有界编辑和验证门控实现稳定、可控的技能更新,在 7 个模型的 6 个基准测试的 52 个设置中取得最佳或并列最佳结果。