标签
本文评测了多款AI视频工具,如Runway、Pika和Luma Dream Machine,指出它们在特定用例中的优势,例如逼真生成、风格化动画和快速内容创作,同时强调没有单一工具能在所有方面都表现出色。
文章回顾了2020年的一个VR项目,其中包含一个名为ToastGenie的GPT-3驱动烤面包机,它通过烤面包主题的对话与用户互动,并能喷射虚拟食物,展示了早期创意AI应用。
本文评测了Sora 2、Kling AI、DomoAI、Higgsfield和Veo 3.1等AI视频工具,推荐它们在电影镜头、真实感、风格化动画和音频集成等多种使用场景下的应用。
Magnific 宣传其AI工具Seedance 2.5,使电影制作人能在拍摄后修改实拍镜头,例如背景替换和灯光调整。
这篇arXiv论文介绍了梦境场景可视化器(DSV),该系统利用LLM进行叙事拆分,并结合带反馈的文本到图像模型,将书面梦境描述转换为连贯的四面板视觉序列,以确保视觉和语义连贯性。
这篇预印本介绍了用于音乐共创代理的分层自监督世界模型,具有对CPU友好的快速模型,以及用于MIDI修补和生成的实时演示。
一项个人AI基准测试要求模型生成一个带有哈布斯堡下颌的青蛙SVG,结果发现模型添加了大量添油加醋的内容,编造了皇室身份和医学评论,超出了字面请求。
一位开发者描述了自己构建“AI 鱿鱼游戏”的过程,这是一个 LLM 基准测试,将 12 个 AI 智能体放入一个生存游戏秀竞技场,每个智能体位于自己的 Docker 容器内,并将生成的日志变成 YouTube 视频。
本文通过一项为期两周的实物设备研究(名为Memetic Mixer的有形交互设备),探讨创意从业者如何将语言作为与LLM交互的物质界面。
Matt Shumer演示了使用Gauntlet Loops编写一部完整恐怖小说的实时运行,展示了该工具超越游戏的通用性。
JarvisHub是一个开放框架,专为画布原生多模态创意代理设计,它将可编辑画布作为用户工作区,实现可检查和可编辑状态下的长周期创意自动化。
Meta正在测试StoryKit,这是一款AI驱动的应用,能通过自定义角色、场景和道理,生成个性化的儿童睡前故事,旨在简化家长的讲故事过程。
一项实验让四个视觉模型(GPT-5.6 Sol、Claude Fable 5、Grok 4.5、Gemini 3.6 Flash)在彩铅绘画竞技场中相互较量,要求它们通过工具使用来重现《蒙娜丽莎》和《星夜》等目标。结果显示令人惊讶的成本与质量权衡,其中 Grok 表现挣扎,而 Claude 尽管成本更高却表现不佳。
OpenAI 创意专家 Chad Nelson 将 Codex 作为创意协作者,用于生成活动创意、构建定制工具并加速原型制作。Codex 理解品牌上下文的能力使其能够快速构思并创建工作流程。
本文展示小型双曲语言模型能够展现创造力、诚实性和设计性遗忘,并引入一个行为审计器,用于检测人类和前沿评判者遗漏的合规差距,为可信赖的伴侣AI提供了路径。
GPT 5.6 Sol 通过一个简单的提示生成了一整个带有纹理和素材的过山车模拟器,展示了其强大的游戏开发能力,表明用户的雄心才是主要限制。
用户分享使用Claude设计logo的经历,称效果堪比专业设计,并公开了使用的7个提示词。
一条推文哀悼即将被下架的 GPT-4.5,鼓励用户在其消失前体验其创意写作能力。