FLUX 3
摘要
FLUX 3 是来自 Black Forest Labs 的多模态AI模型,能够根据文本提示生成同步的视频和音频,并可选择性地输入图像或视频。
FLUX 3 提供逼真的高分辨率视频和同步音频,适用于生产级别的生成。
查看缓存全文
缓存时间: 2026/08/14 23:25
# black-forest-labs/flux-3 – Replicate
来源:https://replicate.com/black-forest-labs/flux-3
## 自述文件
FLUX 3 是 Black Forest Labs 推出的多模态模型,可生成带同步音频的视频。您只需提供文本提示,也可选择上传图片或视频作为生成内容的驱动依据。
输出文件为`.mp4`格式,分辨率720p或1080p,时长5至20秒,默认包含音频。
## 生成内容类型
您需要提供提示词,并可附加以下任一素材:
- **无附加素材** — 模型根据文本直接生成完整片段(文生视频)。
- **单张图片** — 该图片将作为视频首帧,像素级呈现。
- **两张图片** — 首张图片作为起始帧,第二张作为结束帧。
- **三张及以上图片**(最多10张) — 采用分镜脚本模式:首张起始,末张结束,中间图片均匀分布(需设置时长)。
- **`start_video`** — 基于现有视频的末帧进行续写生成。
图片素材与起始视频仅能二选一。
## 参数设置
- **`aspect_ratio`** —`auto`(默认),或选择`21:9`、`2:1`、`16:9`、`4:3`、`1:1`、`3:4`、`9:16`。`auto`模式会根据提示词与输入素材自动匹配比例。
- **`resolution`** — `720p`(默认)或`1080p`。
- **`duration`** — `auto`(默认)或设定5-20秒的整数时长。
- **`generate_audio`** — 默认开启。设为关闭可生成静音片段。
- **`draft`** — 生成快速预览版720p视频,适合提示词迭代调试,相比正式生成更省时省钱。
- **`safety_tolerance`** — 内容审核宽松度,0为最严格,4为最宽松。输入包含图片或视频时需限制在2以内。
## 技术说明
FLUX 3 基于 Black Forest Labs 的自流架构构建,这是单一多模态流匹配模型,横跨图像、视频与音频领域进行训练。
模型创建时间:2周2天前
模型更新时间:4天4小时前
相似文章
Flux 3
Black Forest Labs 宣布推出 FLUX 3,这是一个多模态基础模型,能够共同从图像、视频和音频中学习,实现跨模态的统一生成和理解,现已开放早期访问。
BFL 推出 FLUX 3 - 支持图像、视频和音频的多模态模型
BFL 推出了 FLUX 3,这是一个能够生成图像、视频和音频的多模态 AI 模型。
Black Forest Lab's Flux 3: 全模态用于图像、视频、音频和动作预测
Black Forest Lab's Flux 3 是一种新型的全模态AI模型,能够生成和预测图像、视频、音频和动作。
Flux 3 X Mimic:新一代视频-动作模型
Black Forest Labs 宣布推出 FLUX 3,这是一个多模态基础模型,可联合生成视听内容,并通过与 mimic robotics 的合作,实现用于机器人控制的视频-动作预测,已在奥迪进行测试。
FLUX 3 - 现实世界模型:迈向多模态流模型作为视觉智能的骨干
FLUX 3 提出了多模态流模型作为现实世界视觉智能的基础方法,建立在之前的 FLUX 工作之上。