FLUX 3

Replicate Explore 模型

摘要

FLUX 3 是来自 Black Forest Labs 的多模态AI模型,能够根据文本提示生成同步的视频和音频,并可选择性地输入图像或视频。

FLUX 3 提供逼真的高分辨率视频和同步音频,适用于生产级别的生成。
查看原文
查看缓存全文

缓存时间: 2026/08/14 23:25

# black-forest-labs/flux-3 – Replicate 来源:https://replicate.com/black-forest-labs/flux-3 ## 自述文件 FLUX 3 是 Black Forest Labs 推出的多模态模型,可生成带同步音频的视频。您只需提供文本提示,也可选择上传图片或视频作为生成内容的驱动依据。 输出文件为`.mp4`格式,分辨率720p或1080p,时长5至20秒,默认包含音频。 ## 生成内容类型 您需要提供提示词,并可附加以下任一素材: - **无附加素材** — 模型根据文本直接生成完整片段(文生视频)。 - **单张图片** — 该图片将作为视频首帧,像素级呈现。 - **两张图片** — 首张图片作为起始帧,第二张作为结束帧。 - **三张及以上图片**(最多10张) — 采用分镜脚本模式:首张起始,末张结束,中间图片均匀分布(需设置时长)。 - **`start_video`** — 基于现有视频的末帧进行续写生成。 图片素材与起始视频仅能二选一。 ## 参数设置 - **`aspect_ratio`** —`auto`(默认),或选择`21:9`、`2:1`、`16:9`、`4:3`、`1:1`、`3:4`、`9:16`。`auto`模式会根据提示词与输入素材自动匹配比例。 - **`resolution`** — `720p`(默认)或`1080p`。 - **`duration`** — `auto`(默认)或设定5-20秒的整数时长。 - **`generate_audio`** — 默认开启。设为关闭可生成静音片段。 - **`draft`** — 生成快速预览版720p视频,适合提示词迭代调试,相比正式生成更省时省钱。 - **`safety_tolerance`** — 内容审核宽松度,0为最严格,4为最宽松。输入包含图片或视频时需限制在2以内。 ## 技术说明 FLUX 3 基于 Black Forest Labs 的自流架构构建,这是单一多模态流匹配模型,横跨图像、视频与音频领域进行训练。 模型创建时间:2周2天前 模型更新时间:4天4小时前

相似文章

Flux 3

Hacker News Top

Black Forest Labs 宣布推出 FLUX 3,这是一个多模态基础模型,能够共同从图像、视频和音频中学习,实现跨模态的统一生成和理解,现已开放早期访问。

Flux 3 X Mimic:新一代视频-动作模型

Hacker News Top

Black Forest Labs 宣布推出 FLUX 3,这是一个多模态基础模型,可联合生成视听内容,并通过与 mimic robotics 的合作,实现用于机器人控制的视频-动作预测,已在奥迪进行测试。