标签
介绍开源 AI Logo 生成器 Logocreator,由 Nutlope 开发,基于 Together AI 的 FLUX 模型,可秒级生成高清 Logo,GitHub 获 7.6k+ Star,支持自定义 API Key 和局部微调。
一份实用的无审查 AI 图像生成器汇总,推荐严肃用户通过 ComfyUI 本地运行 FLUX,并通过 Atlas Cloud 使用 Krea 2 Turbo 和 Wan spicy 图像模型,以获得托管速度和提示词遵循能力。
FLUX 3 提出了多模态流模型作为现实世界视觉智能的基础方法,建立在之前的 FLUX 工作之上。
ReChannel通过将令牌直接映射到像素空间块,适配预训练的扩散变换器(如FLUX-Klein)用于密集预测任务,在无三元图的抠图、KITTI深度和指代分割上以极少的额外参数取得了最先进的成果。
根据 Artificial Analysis 的基准测试,Modular 的 MAX 推理服务在 FLUX.2-dev 上实现了比竞争对手快3倍的图像生成速度。
一个用于 Flux 2 Klein 9B 的 LoRA 模型,通过使用参考球图像和阴天中间步骤,使能够在室外图像中控制太阳方向。包含一个自定义的 ComfyUI 节点,用于渲染球体光源参考。
一个简化的开源 PyTorch 实现,包含可逐行验证的源代码映射,专为教育目的设计。
Comfy-Org已为ComfyUI重新打包了Boogu-Image模型文件,包括base、edit和turbo变体,具有不同的量化格式,以及一个LoRA和文本编码器。
一款开源的本地AI地牢应用,使用Gemma 4和FLUX进行文本和图像生成,完全私密,运行内存低于8GB。
马丁·斯科塞斯加入 Black Forest Labs 担任顾问,并使用 FLUX 进行故事板制作,展示了 AI 在视觉创意中的作用。
构建了一个开源流程,仅需输入一句话即可生成带有角色、动画、音乐和旁白的电影级短片,使用FLUX.2、Wan2.2及其他模型,在单个AMD GPU上运行。该流程包含导演代理、角色生成、关键帧动画、视觉评论器、音乐和旁白等阶段。
Black Forest Labs 在 AI Engineer 大会上分享了 Flux 系列模型的演进历程,并发布了 SelfFlow 研究论文,提出了一种无需外部编码器的自监督多模态训练方法。
Hugging Face 推出了模块化扩散器(Modular Diffusers),这是一个使用可组合、可重用的构建块而非单体管道实现的新框架,用于构建扩散管道。该系统允许灵活地混合匹配图像生成工作流的组件,并支持与 Mellon 等可视化工作流工具的集成。
PrunaAI 推出 Flux Fast,这是针对 Black Forest Labs 的 FLUX.1-dev 模型优化的端点,号称通过压缩、缓存和编译实现最快的 Flux 推理。