AI现在能构建应用了,但谁来检查它构建的是否正确?
摘要
关于AI编码代理下一个瓶颈的讨论:验证AI生成的应用是否正确,以及谁应该负责检查输出。
我一直在思考AI编码代理的下一个瓶颈。如果你描述一个想法,AI代理创建了应用,那么显而易见的问题就变成了:你怎么知道输出实际上是好的?你会:
- 自己手动审查和测试一切?
- 相信用户反馈来发现问题?
- 使用另一个AI代理来审查所构建的内容?
- 其他方式?
好奇其他人是怎么看待这个问题的。
相似文章
如何判断AI编码代理真正完成了?
作者创建了OpenPitStop,一个独立检查和验证AI编码代理工作的开源工具,并在一个损坏的应用程序上进行了演示,同时邀请讨论如何信任AI的更改。
当AI编写了大部分代码时,我们该如何验证它?
本文探讨了当AI也创建验证工具时,验证AI编写代码的挑战,强调人工评估是瓶颈,以及中美实验室之间训练数据的战略重要性。
没有人对AI编码代理进行足够测试
本文讨论了AI编码代理测试不足的问题,强调了在确保其在软件开发中的可靠性和安全性方面存在关键差距。
如何验证AI编写的代码是否正确?
用户询问验证AI生成代码正确性的方法,强调使用多个模型进行检查时的疑虑和低效。
AI编程智能体可以编写代码,那么接下来发生的事情应该由谁来控制?
本文探讨了在代码更改后控制AI编程智能体的挑战,并提出一个工程控制平面来处理权限、验证和人工审批。