解绑:徽章与贡献不再是同一事物
摘要
本文探讨了AI生成的代码如何打破了工作者资质与其输出之间的传统联系,引发了关于把关与质量的辩论。文章提出,新的验证工具可以将贡献与可验证的收据重新绑定,从而同时解决质量与可及性的问题。
在整个人类技能工作的历史中,徽章与贡献是捆绑在一起的:如果你不是那种已经赢得能力的人,就不可能解决难题。工作的证明与工作者的证明是同一事物。我们建立的所有信任工作的制度——资质认证、代码审查、同行评议、资历、面试——都建立在那捆绑之上。没有一个是为这种捆绑破裂的世界设计的。而它已经破裂了。如今,一个模型可以为任何询问的人生成具有专家水准的输出。已解决的问题不再认证解决者。你可以实时看到整个行业在感受这一点。在编程社区中,六个月内最热门的讨论中,同样的伤痛不断浮现。审查者们描述自己正在淹没:生成变得免费,而验证仍然昂贵,成本被转嫁给仍然阅读代码的人。开源维护者报告称AI生成的拉取请求数量已达到无法处理的程度,GitHub正在公开权衡是否给维护者禁用拉取请求的选项。一项随机化研究验证了教师们的担忧:将任务委托给AI的初级工程师理解分数为50%,而手动编码者为67%,同时生产率提升未达到统计显著性。而那些花了几十年获得能力的人描述了一种比经济学更原始的感受:一夜之间,精通本身被商品化了。由这种失落感,领域正分裂为两个阵营,两者都认为自己是在捍卫质量。一个阵营将艰难习得的知识视为它一直以来的徽章,并希望大门紧闭:人类编写、资质验证、赢得而来。另一个阵营看到了第一次将能力交予所有曾被拒之门外之人的真正机会,并将大门视为它们常常是的那样:穿着质量外衣的排斥。每个阵营都只对了其中一半。把关者是对的:无法审查的输出会降低领域水平;开放者也是对的:大门从未衡量过它声称要衡量的东西。但请注意,这两个阵营实际在争夺什么:代理品。徽章从来只是经过验证的工作的代理品,因为验证成本太高而被采用。当你无法廉价区分真正的和声称的时,你就会退而求其次,依赖资质、背景和把关,然后你像捍卫本质一样捍卫代理品。这种分裂不是价值观的战争。这是验证的短缺。而这种短缺现在不再是必然。在同一时代,徽章与贡献被解绑,也使得有可能将它们重新绑定——围绕工作本身而非工作者。让外部检查来决定接受与否:作者无法编辑的测试套件、证明检查器、带有区间的测量、一个声明账本——未被验证的内容保持可见,而不是被粉饰。让每个结果都附带一个陌生人都能重新运行的收据。让审查机器工作的人准确地证明他们检查了什么,以及该审查的覆盖范围可见,这样“我拥有这个”就是一个可检查的声明,而非签名。这些都不是假设性的工具;它们今天全部可以在本地机器上运行。还有第二道大门,诚实要求指出它。知识现在对任何人来说都是一个真正开放的表面——只要他们能获得手段。旧世界通过背景设限;新世界正在悄然学会通过账单设限:按量计费的管道、不断变化的计划、按令牌计价的能力。因此答案有两部分。验证瓦解了徽章之关:工作本身说话,无论谁创造的。以本地优先的工程瓦解了手段之关:验证循环运行在某人已经拥有的机器上。只做一半的平台只是替换了一道大门,而不是移除了一道。在这个世界里,两个阵营都得到了他们实际捍卫的东西。工匠的自豪幸存下来,并得到加强:工作是其可证明的,且可证明是好的,没有人需要凭信仰接受他们的徽章。公地完全赢了:接受由任何人都能运行的检查决定,大门向每个愿意将工作放在它面前的人敞开。死去的只有代理品,而代理品从来不是重点。诚实的边界:没有工具能修复社会。工具能做的,是在其触及之处改变诚实的代价,并在一面工作平台上证明,以验证为先的共存不是两个阵营之间的妥协,而是对双方都严格更好的。证明本身在说话。一个反例在招募。徽章与贡献曾捆绑在一起,那个世界已经消逝。我们可以为之哀悼,或者我们可以建造一个工作为自己说话的世界,并允许每个人都让它发声。来源(在发布前均与实时页面重新核对):
- Anthropic 关于AI辅助与技能形成的随机试验:https://www.infoq.com/news/2026/02/ai-coding-skill-formation/
- GitHub 权衡给维护者禁用或限制拉取请求的选项:https://www.theregister.com/2026/02/03/github_kill_switch_pull_requests_ai/
相似文章
Badge
Badge 是一款利用AI代理收集同行评审并生成工作量证明的产品。
验证前沿:编码智能体奖励并无银弹
本文探讨了验证AI编码智能体输出的挑战,认为随着模型改进,验证正变得比生成更困难。它分析了四种奖励构建方式,并表明随着模型能力的增长,没有固定奖励函数能保持有效。
AI 智能体开始干正事了。但收据在哪?
文章指出了一个日益严重的问题:AI 智能体可以执行复杂任务,但其工作难以检查、信任和交接。作者提出了一种“工作凭证”系统,以提供透明、可分享的证明,展示智能体执行了哪些步骤、使用了哪些来源以及置信度,旨在帮助非技术用户自信地使用代理式 AI。
2026年AI编程代理输出验证:查看差异、氛围检查再合并
关于当前AI编程代理输出验证实践的一点反思,指出开发者通常只是粗略查看差异就合并,而没有全面审计代理的会话活动,引发了对AI时代代码审查文化的担忧。
编程代理是否变得昂贵,还是我们对成本的衡量方式有误?
本文质疑编程代理的真实成本是否包含隐藏的人力监督和调试,认为真正的价值应以可信输出来衡量,而非原始 token 消耗。