FLUX 3 - 现实世界模型:迈向多模态流模型作为视觉智能的骨干

Reddit r/LocalLLaMA 论文

摘要

FLUX 3 提出了多模态流模型作为现实世界视觉智能的基础方法,建立在之前的 FLUX 工作之上。

暂无内容
查看原文

相似文章

Flux 3

Hacker News Top

Black Forest Labs 宣布推出 FLUX 3,这是一个多模态基础模型,能够共同从图像、视频和音频中学习,实现跨模态的统一生成和理解,现已开放早期访问。

Flux 3 X Mimic:新一代视频-动作模型

Hacker News Top

Black Forest Labs 宣布推出 FLUX 3,这是一个多模态基础模型,可联合生成视听内容,并通过与 mimic robotics 的合作,实现用于机器人控制的视频-动作预测,已在奥迪进行测试。