AI代理是否应该能够看到应用程序实际在做什么?

Reddit r/AI_Agents 新闻

摘要

讨论AI编程代理需要超越源代码的运行时感知能力,例如检查容器、端口和服务,并考虑代理应对开发环境拥有多大程度的控制权。

我在使用AI编程代理时注意到一件事:它们非常擅长处理源代码,但这只是构建真实应用时问题的一部分。你可能拥有看起来完全合理的代码,但应用仍然无法运行,因为容器没有正常启动、服务在错误的端口上监听、缺少环境变量,或者两个服务之间通信不正常。我认为这就是运行时感知变得有趣的地方。在IQX.DEV工作期间,我一直在探索一种代理,它能够超越代码库,检查容器日志、运行中的进程、端口、端点和服务连接等内容。代理不是简单地修改代码然后寄希望于问题得到修复,而是可以遵循更接近这样的流程:检查 → 诊断 → 更改 → 运行 → 验证。例如,如果API没有响应,代理可以先确定问题实际上是在代码中,还是API容器没有运行、端口配置错误,或者依赖项无法访问。但赋予代理这种访问权限也引发了一些严肃的问题。AI代理应该对运行中的开发环境有多大控制权?它应该自动重启容器吗?更改环境变量?重建服务?或者潜在破坏性操作是否始终需要批准?我很好奇构建AI代理的人们是如何思考代码生成与实际系统操作之间的界限的。
查看原文

相似文章