AI视频演示应该附带“收据”。给我看那些失败品,而不是仅展示那个幸存下来的干净片段
摘要
一篇评论文章,主张AI视频演示应公开生成次数、失败率及编辑步骤,以提供现实预期,而非仅展示精修后的片段。
最近越来越频繁地思考这个问题。一个精雕细琢的AI视频片段已经无法提供任何有用信息了。不是说这些片段是假的,或者技术很烂。有些人生成的内容确实不错。问题在于它的呈现方式。你在推特上看到一个干净的10秒片段。但你看不到背后那37个失败的。你看不到那个几乎成功的提示词,或者模型完全忽略的参考图片。你看不到第42帧那只融化的手。那个版本光照完美但脸部开始漂移。另一个版本镜头运动很棒但产品变成了一滩水。那个修复了一个问题却悄悄毁了另一个问题的局部编辑。没人谈论这部分。他们只发布那个幸存者然后继续前进。我理解为什么。干净的片段看起来很好。失败品看起来很尴尬。但如果你真的想在生产中使用这些东西,失败品才是唯一重要的。一个花了80次生成和4次手动清理的片段,和那个3次尝试就能用的片段不是同一个产品。但它们被冠以相同的标题发布。老实说,我认为每个AI视频演示都应该附带一个小“收据”。不用太夸张。只是简单备注:多少次生成、多少次可用、什么失败最多、是否做了局部编辑、是否在外部工具中清理过、大概花费多少。也许还有如果重试能否复现。这些信息比另一个慢动作雨中人行镜头有用十倍。我不知道,也许关心这个很无聊。但我一直看到这些奇迹般的片段,想知道实际的失败率是多少。一个需要60次掷骰子才能看起来不错的渲染不是工作流程,而是老虎机。我觉得试验阶段这样没问题,但我们应该停止假装它和生产就绪一样。工具本身如果想的话,或许可以自动生成一半这些信息。提示词、种子、生成次数、编辑、花费。比添加另一个预设风格滤镜之类有用多了。总之,不是想发表什么宏论。我只是觉得关于AI视频的讨论缺少了最无聊也最重要的数字:它试了多少次。
相似文章
代理演示看起来很惊艳,因为没人拍那90%的错误处理部分
作者将精心打磨的AI代理演示与生产系统的现实进行对比,指出大多数代理代码用于错误处理和护栏(guardrails),而非核心智能。
演示差距是目前AI产品中最被低估的问题
文章讨论了AI产品在演示中表现完美,但在实际使用中由于输入混乱和边缘情况而失败的问题,强调弥合这一差距对于建立用户信任至关重要。
三个在演示中不会出现的生产AI记忆故障:
本文强调了生产AI记忆系统中的三种常见失败模式:过时的偏好持续存在、讽刺性评论被当作字面偏好存储、以及摘要比其来源事实更持久。文章认为AI记忆行业缺乏出处、置信度评分和版本控制,造成了妨碍调试的黑箱问题。
AI生成视频何时不再是技术演示,而成为电影制作?
本文探讨了AI生成视频从视觉实验过渡到真正的电影制作必须克服的障碍,强调了叙事连贯性和节奏等问题。
AI 记忆演示:第一周光鲜,生产环境是六个月后的问题 lol
文章讨论了 AI 记忆演示与长期生产挑战之间的差距,指出记忆会因矛盾、信息漂移和过时的偏好而退化,而基准测试无法捕捉这些问题。