AI现在能构建应用了,但谁来检查它构建的是否正确?

Reddit r/AI_Agents 新闻

摘要

关于AI编码代理下一个瓶颈的讨论:验证AI生成的应用是否正确,以及谁应该负责检查输出。

​ 我一直在思考AI编码代理的下一个瓶颈。如果你描述一个想法,AI代理创建了应用,那么显而易见的问题就变成了:你怎么知道输出实际上是好的?你会: - 自己手动审查和测试一切? - 相信用户反馈来发现问题? - 使用另一个AI代理来审查所构建的内容? - 其他方式? 好奇其他人是怎么看待这个问题的。
查看原文

相似文章

如何判断AI编码代理真正完成了?

Reddit r/AI_Agents

作者创建了OpenPitStop,一个独立检查和验证AI编码代理工作的开源工具,并在一个损坏的应用程序上进行了演示,同时邀请讨论如何信任AI的更改。