ChatGPT Image 2.5 Is The New King (Fully Tested)

YouTube AI Channels 模型

摘要

ChatGPT Image 2.5 在复杂图像生成任务中表现最佳,新增了模板和草图转图像等功能,但在修改复杂文本时仍存在挑战。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/09/11 00:13

ChatGPT Image 2.5 在复杂任务测试中表现最佳,被认为是目前适用场景最广的图像生成模型,但仍存在一些缺陷。 ## 复杂任务表现惊艳 ChatGPT Image 2.5 在处理包含大量文字和细节的复杂生成任务时,表现出极高的精度。 ### 历史海报生成案例 测试要求生成一张关于美国革命的详细历史教室海报。模型首先进行了约一分半钟的研究和处理,最终生成的图像细节极其丰富。海报包含一个巨大时间轴,每个战役都配有独特图像,并包含引文、地图等元素。经检查,文字内容未发现明显错误。 ### 与其他模型对比 相同提示词在其他模型中测试效果不佳: * **Gemini:** 海报遮挡了学生,文字出现拼写错误、重复和乱码。 * **Nano Banana 2 和 Nano Banana Pro:** 结果稍好但细节仍不及ChatGPT,且错误更多。 * **GPT Image 2:** 表现良好,但细节不如2.5版本丰富。 ## 新增功能介绍 此次更新带来多项实用新功能,提升了图像生成的便捷性和灵活性。 ### 图像生成模板 侧边栏图像区现已“已更新”,新增了多个模板(即提示词预设)。点击即可自动填充提示词,许多模板会在生成前要求进一步澄清。例如,“趋势”标签页提供了包括“动物信息图”在内的多种可用提示词。 ### 草图转图像功能 新增了绘图板,允许用户绘制涂鸦草图作为生成基础。例如,绘制一个在摩天楼间跳跃的滑板手,并指定“照片风格+运动摄影风格”,生成结果完美还原了草图的构图和设计元素(如骷髅图案)。编辑时,可对局部涂鸦添加评论进行修改,但有时模型无法理解评论的具体指向,此时使用文字描述重新生成效果更佳。 ### 移除背景与透明度生成 新增“移除背景”一键功能,效果出色,能保留如发光效果等细节。更强大的是,可以通过提示词直接生成带透明度的复杂PNG图像(如透明水母),或通过“移除背景”处理复杂图像(如蜻蜓在水面)。 ## 一致性改进 图像生成的一致性是2.5版本的重大提升,这对专业工作流程至关重要。 ### 局部修改一致性 过去修改图像局部常影响整体,现在2.5版本对此有大幅改善。例如,在信息图中仅调整小部分内容而不影响整体布局。但在修改复杂海报中的小段文字时,仍可能引发其他文本的变化,需要多次修正才能完成。 ### 角色设计与多角色场景 角色一致性表现优秀。在多人物场景中,所有细节(如表情、光照)保持高度一致。生成的角色设计表在角度、表情、纹理、配色等方面也高度统一,质量近乎完美。 ### 风格迁移与写实提升 风格迁移能力出色,能精准还原指定的独特风格(如Midjourney风格)。写实效果同样提升,生成的多人物场景(如演唱会、中国足球场景、南美儿童足球场景)中,人物面孔自然,细节真实。 ## 研究能力与API表现 模型在自主研究和API调用方面有明确区分。 ### 自主研究能力 在网页端,模型拥有自主研究能力。例如,生成“视频技术信息图”时,它会自主研究超过4分钟,整合信息后生成文本密集且零错误的信息图。制作“每日新闻仪表盘”等复杂任务时,研究耗时可达8分31秒。 ### API版本表现 通过API调用时,模型**不触发**自主研究功能。API提供“Flare”(较快)和“Sunburst”(更高级)两种变体,画质优秀,但信息时效性不足。与Nano Banana系列相比,API版本在细节和写实性上占优。测试案例包括章鱼酒保奇幻场景,Sunburst效果整体惊艳,但触须液体处理略有瑕疵。 ## 已知问题与挑战 尽管能力强大,模型在处理极端复杂任务时仍有局限。 ### 修改复杂文本的困难 尽管官方展示了良好效果,但在实际操作中,要修改复杂图像中的小段文字而不影响其他部分仍然较为困难。在一个极端复杂的测试案例中,修改文字导致其他元素发生变化,需要多次调整。 ### 极端复杂任务的局限 在处理信息量极大的复杂图像(如包含大量文本和布局的海报)时,进行精准的局部修改仍具挑战性。最终成品可能因多次修正而在细节(如字体间距)上与初始版本产生差异。 Source: https://www.youtube.com/watch?v=bbmgWQKZ5ZU

相似文章

介绍 ChatGPT Images 2.5

OpenAI Blog

OpenAI 推出了 ChatGPT Images 2.5,这是一款改进的前沿图像模型,具有更锐利的细节、更精确的编辑和更快的生成速度。它为用户添加了草图和模板等新功能,并通过 API 为开发者提供 GPT-Image-2.5 Flare 和 Sunburst 模型。

推出 ChatGPT Images 2.5

Simon Willison's Blog

OpenAI 发布 ChatGPT Images 2.5,增强了图像生成功能,提供更好的指令遵循能力、更快的响应速度,以及新的 API 模型 ID,以提高精确度和日常使用性。

新版ChatGPT Images上线

OpenAI Blog

OpenAI发布了新一代旗舰图像生成模型,为ChatGPT Images提供支持。新模型生成速度提升4倍,编辑精度更高,并在ChatGPT中新增专门的Images功能,内置预设样式和滤镜。