我几乎完全用AI构建了一个完整的3D开放世界赛车游戏,现在它有了真实的日常玩家。下面是模型做得好和彻底失败的地方的诚实分析。

Reddit r/artificial 新闻

摘要

一位开发者借助AI构建了一个完整的3D开放世界赛车游戏,详细说明了AI表现出色的地方(样板代码、孤立系统)以及失败的地方(空间推理、系统集成、游戏手感)。该游戏已上线并有真实的日常玩家。

这不是一篇炒作帖。我想谈谈我们实际所处的位置,因为用AI构建一个真实、发布、带有多人功能的项目,比任何基准测试都更能让我了解当前的天花板。项目:一个霓虹风格的开放世界街头赛车游戏,运行在浏览器中,无需安装。真实的3D城市可供驾驶,道路上还有其他实时玩家,有车库、经济系统等等。我负责指导,但绝大多数代码是由AI编写的。从空文件夹到拥有真实日常玩家上线,只用了几个星期。 AI真正擅长的地方:一次性完成整个自包含系统。'构建一个带有轨道相机和滤镜的拍照模式',完成并运行。样板代码繁重、常见的问题:认证、存档系统、REST API、Stripe集成。快速且基本正确。重构和转换。'把它变成实例化网格,这样只需一次绘制调用'这种繁琐的修改,它比我手动做得更好。当我能够精确描述症状时,它是一个不知疲倦的调试伙伴。 它失败的地方:空间和3D推理。任何涉及'这个物体在那个后面'或'车牌埋在保险杠里'的问题,它都看不见,因为它无法看见。我必须不断充当它的眼睛。无法把握整个系统。它会修复一件事,然后悄悄破坏三个文件之外的某个系统,因为它并没有真正模拟交互,只做了局部修改。性能直觉。它愉快地编写了给每辆流式传输的汽车附加灯光的代码,导致帧率骤降。一旦我找到原因,它就知道如何修复,但它没有预先考虑到。游戏手感。它无法告诉你某个机制是否无聊,或者经济系统是否会被利用。这种判断仍然完全取决于你。 真正的要点:瓶颈已经转移。不再是'它能写代码吗',而是'你能精确地指定、不懈地验证,并提供它所缺乏的品味和空间判断力吗'。AI把我从一个编写功能的人变成了一个指导和测试功能的人。这确实是一份不同的工作,而且实际上比人们预期的要求更高。证明它不仅仅是一个玩具:它已经上线,人们每天玩,甚至有人付费支持。所以这不是一个死在文件夹里的周末演示,而是一个真实的产品,主要由AI代码承载,由人类掌舵。很好奇其他人认为分界线在哪里。对于那些正在用AI发布真实产品(而非演示)的人来说,它在哪里仍然失败?我赌任何需要随时间变化的状态心智模型的事情。
查看原文

相似文章

@0xAikoDai: https://x.com/0xAikoDai/status/2057317742248931363

X AI KOLs Timeline

作者反思了对一款由AI Dungeon制作团队开发的全新AI原生RPG测试版的体验,指出了在战斗和系统可读性方面AI生成的沉浸感会崩溃的设计挑战,并呼吁为AI原生游戏制定新的设计原则。