@heyshrutimishra: Luma 发布的 Uni-1.1 中无人关注的关键细节:该模型在训练过程中引入了好莱坞 cinematographer 和 VFX 艺术家的反馈…
摘要
Luma 的 Uni-1.1 模型通过与好莱坞摄影师和 VFX 艺术家进行反馈闭环训练来实现差异化。这一策略表明,在图像 AI 领域,经过精心筛选的人类审美品味可能成为超越传统基准测试的关键竞争壁垒。
查看缓存全文
缓存时间: 2026/05/10 02:29
Luma 发布 Uni-1.1 时,没人注意到的关键细节:
该模型在训练过程中引入了好莱坞电影摄影师和视觉特效(VFX)艺术家进行闭环反馈。
其他所有实验室都在竞相比拼参数量和基准测试指标。而在图像生成 AI 领域,下一道护城河将是模型学到了谁的审美品味。
https://t.co/m7sU2cuqVC
相似文章
@heyshrutimishra: 我们衡量图像模型的方式一直是错的。多年来,我们关注的是相似度,然后是照片级真实感,每个基准测试都聚焦于……
该推文认为,图像模型一直以照片级真实感而非生产就绪性来评估,然后介绍了基于 NEO-Unify 架构的 SenseNova U1 Pro,该架构支持原生 8K 分辨率和迭代式设计推理。
@heyshrutimishra: 在这里试试 →
Luma AI 推出了其 API,为 Ray3.14 和 Photon 等图像和视频生成模型提供按量付费和预留吞吐量的定价模式。
整个AI电影算法似乎只产出超写实主义
这篇文章批评AI电影算法一贯生成超写实图像,认为真正的专业电影摄影依赖柔和的边缘和微妙的对比,而AI则默认生成过度清晰、高对比度的画面,这种画面可能让新手印象深刻,但缺乏大片观众所需要的细腻层次。
@heyshrutimishra: 新视频模型刚刚发布。但这款并非为电影级视频打造。LingBot-Video专为具身智能设计…
LingBot-Video是一个30B参数的视频模型,采用稀疏MoE架构,专为具身智能设计,现已开源。它在RBench上优于现有模型,训练数据来自7万+小时的具身数据。
@VraserX: 这个BTS展示了AI视频的真正瓶颈:不再只是制作一个美丽的镜头,而是保持整个项目……
本文强调,AI视频的真正瓶颈在于跨场景保持连贯性(情绪、风格、节奏),并指出Dreamina AI是一个将AI视频从片段生成推向完整制作流程的工具,正如Nexus: Wet Markets of Kafar的BTS所示。