标签
该推文强调了迭代循环在视频/图像生成工作流程中的重要性,并推广 Dreamina 上的 Seedance 2.5,提供 4 次免费生成,定价从每秒 $0.097 起。
微软发布了图像生成模型 MAI-Image-2.6,该模型在 Arena 文生图排行榜上排名第二,相较前代在文字渲染、照片真实感等方面均有提升。
Corbin Braun 表示,OpenAI 更新的 GPT Image 2 对缩略图来说是一个颠覆性的改变,他用 Thumio 中的一个提示词就创建了一个。
一条推文声称 OpenAI 悄悄发布了 GPT Image 2 的巨大升级,仅用一条提示就能生成令人印象深刻的结果,同时推广了一款 AI 缩略图工具。
谷歌宣布 Gemini 月活跃用户达到 10 亿,成为谷歌历史上增长最快的产品,语音输入和图像生成功能被广泛采用。
埃隆·马斯克在回复一条关于“蒸汽朋克”一词起源的推文时宣布,Grok Imagine可以制作蒸汽朋克电影。
埃隆·马斯克称赞 Grok 的图像生成能力,因为它正确描绘了一位数学家从亏格为1的物体中喝水的画面,而 ChatGPT 生成的则是亏格为2的甜甜圈马克杯。
该推文认为,图像模型一直以照片级真实感而非生产就绪性来评估,然后介绍了基于 NEO-Unify 架构的 SenseNova U1 Pro,该架构支持原生 8K 分辨率和迭代式设计推理。
xAI发布了Imagine Image 2.0,作为Grok的新质量模式,具备受控布局、精确编辑工具、可复用模板,以及在Arena排行榜上的强劲表现(文生图和编辑均排名第二)。
Guillermo Rauch 重点介绍了 Grok Imagine Image 2.0,该模型现已登陆 Vercel AI Gateway,并在 Arena.ai 排行榜上位列第二。Vercel 通过 AI CLI 和实时 Playground 提供访问。
Grok announces Imagine Image 2.0, a next-generation image model with precision editing, crisp text rendering, improved factuality, and real-world usefulness.
Grok 发布了 Imagine Image 2.0,这是一款下一代图像模型,具备精准编辑、清晰的文字渲染以及改进的事实准确性,适用于实际应用。
xAI的Grok Imagine Image 2.0(低)在文生图竞技场跃升至第2名,超越了自己旧版的质量模型,显示出显著进步。
一条推文认为,Claude Code 技能可以通过直接调用图像生成 API 来替代 79 美元/月的 Higgsfield 订阅,将每张图像的成本从约 31-34 美分降至约 5 美分,同时让输出保留在本地并由用户所有。
SenseNova U1.5-Lite-Preview 是一个开源的 8B MoT 多模态模型,能够原生生成和编辑 4K 超宽全景、产品海报和商业摄影,具有改进的材质渲染和更少的伪影。
PinkCherry_MiniMax-H3 的 Hugging Face 模型页面,这是一个专注于生成 NSFW 兽人与花卉图像的小众 AI 模型,并包含关于兔子动作、花瓣和独角兽角改进的更新说明。
QwenCloud 发布了 Qwen-Image-3.0-Pro,一款强大的图像生成模型,支持密集布局、微小文字渲染和原生多语言输出,将其定位为可部署的生产力工具。
介绍了ToolArtist,一个基于统一多模态模型构建的完全智能体图像生成模型,利用SFT和强化学习(RAD-GRPO)动态编排推理、工具使用和图像生成。
UniWorld-Design 是一个以语义 RGBA 图层为原子单元重新定义图像生成的框架,包含用于生成分层资产的 T2RGBA 和用于将图像分解为可编辑图层的 I2L,在 Crello 基准测试上取得了最先进的结果。
使用详细提示词对 Nano Banana 2 和 OpenAI 图像生成进行比较,结果图片分享在评论中。