标签
谷歌正在重新设计谷歌图片首页,在搜索前展示一个动态、个性化的图片画廊,并很快将允许 AI 概览使用其 Nano Banana 2 Lite 模型生成图片。
空间推测解码(SSD)通过使用小型辅助网络并行预测整行像素,加速了自回归图像模型,实现了高达13.28倍的加速,同时保持了基准性能。
Boogu-Image-0.1是一个开源的统一多模态理解与生成模型系列,在文本到图像生成、快速推理、基于指令的编辑和双语文本渲染方面实现了有竞争力的性能,训练成本仅约40万美元。
本文提出了一种基于多条件扩散的合成流程,使用Stable Diffusion XL和ControlNet生成合成沙沸图像,用于低资源土石堤坝检查,解决标注缺陷样本稀缺的问题。
Seedream 5.0 Pro 是一款高度可控的AI图像生成与编辑模型,支持参考图片和提示词。它可通过BytePlus API获取,并可直接在Lumina上使用,用于制作广告、编辑角色、创建蓝图等任务。
一个名为Flaxeo Image的stable diffusion cpp本地桌面UI已经构建完成。
Meta移除了一项在Instagram上具有争议的AI功能,该功能允许用户在未经通知的情况下,通过引用公开的Instagram账户生成图像,此前该功能遭到广泛反对和审查。
D2PO提出了一种动态偏好优化框架,利用直接偏好优化使扩散采样策略与感知质量对齐,在低NFE约束下优于基于回归的方法。
字节跳动推出Seedream 5.0 Pro,这是一款面向生产设计的多模态图像生成模型,具备高级推理、复杂可视化、精准编辑、逼真纹理以及原生多语言支持。
Meta 已推出 Muse Image,这是来自 Meta Superintelligence Labs 的首个图像生成模型,现已在其应用的 Meta AI 中可用。该模型支持高级推理、多参考组合,并在 Arena 上排名第二,同时计划推出 Muse Video 和 Content Seal 水印。
字节跳动推出Seedream 5.0 Pro,这是一款多模态图像生成模型,在复杂信息可视化、交互式精准编辑、逼真图像和原生多语言支持方面取得突破。
Meta将图像生成集成到社交和广告平台的做法,体现了一种转变:AI模型正成为平台功能,这使得基准测试的重要性不如分发能力和默认位置。
Meta 推出 Muse Image,这是来自 Meta Superintelligence Labs 的首个图像生成模型,已集成到 Meta AI 以及 Instagram、WhatsApp 等其他应用中。该模型支持高质量的文本到图像生成、编辑和创意预设,并提供房间重新设计、Instagram 个人资料标记等功能。
Meta发布了Muse Image,这是一款免费的AI图像生成器,可通过Meta AI应用、Instagram故事和WhatsApp使用,具备预设、基于提示的编辑功能,并集成于Facebook Marketplace。
Meta 发布了 Muse Image,这是一个具有代理能力的图像生成模型,它能够进行规划、搜索网络、编写代码,并在渲染前进行编辑。
Meta推出了Muse Image并预览了Muse Video,这是一个具有代理能力的图像和视频生成系统,支持精确编辑、多参考源、与Instagram上下文集成,将媒体生成转变为完整的创意操作系统。