有两类开发者在推出AI功能
摘要
一位开发者反思了推出AI功能时输出质量不佳的不可避免性,并强调需要主动监控,而非仅依赖用户报告。
你可能听过摩托车手的说法:“有两类摩托车手:已经摔过跤的,和将要摔跤的。”老实说,我开始觉得对于任何推出AI功能的人来说也是如此。有人已经推出了输出垃圾的AI,而有人则迟早会这样。很长一段时间里,我相当自信地认为自己属于后者,并且以为有很好的实践来防止糟糕的输出。我们有扎实的测试,内部演示很顺利,团队对输出结果也很满意。我们一路顺畅(抱歉,不再玩双关了)。然后上周我们收到了一张截图,显示了一个回复——不是轻描淡写——简直是垃圾。我说的是热腾腾的屎……好吧,你懂的。我们没有看到任何错误日志,也没有任何迹象表明出了问题。这真的很糟糕,因为我们在“这坏了”和“有用户注意到并报告”之间没有任何中间环节。我们的反馈循环实际上只是依赖用户主动联系我们。总之。我们后来修复了这个问题,学到了一些东西,并对实际到达用户的内容有了更健康的警觉感。抱歉这听起来有点像吐槽,但我想分享出来,以防其他人也有类似的情况。总觉得这些事件才是最终说服人们认真对待AI质量的东西。
相似文章
经过一年使用AI代理发布产品,以下仍是它们经常出错的地方
一位开发者分享了使用AI代理编写代码一年后发现的持久性故障模式,包括代码看似正确实则错误、无法维护跨文件架构、对错误决策缺乏质疑、以及安全边缘情况问题。
AI行业有个奇怪的问题:造工具的人比用工具的人更兴奋。
文章探讨了AI开发者与最终用户之间的脱节——开发者热衷于技术能力,而用户则优先考虑能减少日常摩擦的实用、可靠的解决方案。作者学会了更看重用户的哈欠而非掌声,因为那才预示着真正的长期采用。
AI编程工具是在让开发者变得更好,还是仅仅加速了糟糕的判断?
一篇观点文章探讨了像Claude Code和Copilot这样的AI编程工具是否真正提升了开发者的技能,还是仅仅加速了有缺陷的决策,并强调了需要新的指标来评估工程中的人机协作。
小众观点:大多数生产环境下的AI代理都在盲目运行,而开发者却浑然不知
一位开发者认为,大多数生产环境下的AI代理缺乏必要的可观测性,例如会话追踪和成本监控,并将其比作在没有监控的情况下部署Web应用。文章质疑代理可观测性是否仍是一个未解决的问题。
我不理解“AI将取代开发者”这个观点
一位用户讲述了一次对话,其退休的CTO叔叔认为AI将取代开发者,但用户反驳称,人工验证、成本和风险管理仍需人类监督,认为这一想法过于炒作。