@AdrianPunk115: This article was painstakingly crafted by me, cross-referencing the officially released documentation and drawing on my…
Summary
本文详细介绍了OpenAI发布的GPT-Image 2.5模型的新功能,并通过个人测试分享了从个人娱乐到电商应用的多种使用场景,包括制作GIF和表情包等实用教程。
View Cached Full Text
Cached at: 09/11/26, 10:42 PM
This article was painstakingly crafted by me, cross-referencing the officially released documentation and drawing on my own hands-on experience with creating diagrams. Every solution is the result of multiple rounds of personal testing, in the hope that it can help everyone.
Image2.5 玩法全公开,从个人到电商(附提示词教程)
昨天和大家分享了我对 Image 2.5 改进点和新增功能的实测。
Adrian Punk@AdrianPunk115·Sep 9Translated from ChineseShow originalOpenAI has released GPT-Image 2.5, bringing up to 50% reduction in latency, more stable multi-turn editing, and new capabilities such as sketches, annotations, templates, and prompt sharing. I ran 5 sets of tests in ChatGPT and will tell regular users exactly how to play with it.Show more ArticleGPT-Image 2.5 实测:普通人最容易上手,效果最好的生图模型OpenAI 突然发布了 GPT-Image 2.5。 官方一上来就给了几个很猛的升级:生成延迟最高降低 50%,局部编辑更准,连续修改不容易把前面的细节弄丢,还加入了 Sketch 手绘、图片批注和模板。OpenAI 同时公布,ChatGPT…7675238107K
今天接着聊:这些升级,具体能拿来做点什么?
模型更新看得再多,也得自己上手玩一遍。这次我从个人玩法一路整理到电商应用,挑一些有意思、能派上用场,也能检验新版能力的场景,看看那些以前容易翻车的细节,现在能做到什么程度。
每个玩法都附上完整提示词,大家可以直接复制使用。
一、个人玩法
1、上传一张图,让它变成会蹦跶的 GIF
自拍、宠物、卡通头像、玩具、日常物品,都可以作为输入。
我会先从贴纸式弹跳动画开始,让同一张素材动起来。这样不必逐帧重新生成角色。当然,这只是演示,可以做更多有趣的动作,直接可以做表情包!
GIF以𝕏 头像为例
以𝕏 头像为例
- 上传图片,生成贴纸素材
请将我上传的图片转化为一枚适合制作动态表情的独立贴纸。
自动识别图片中最主要的主体: 人物保留可辨认的五官、发型、服装和神态; 动物保留品种外形、毛色、花纹和表情; 物品保留独特轮廓、结构和主要配色; 如果图片主要是一处场景,则将整个场景设计成一枚轮廓简洁的场景贴纸。
采用轻微立体的卡通贴纸风格,轮廓清晰,造型饱满,有一点幽默感。不要把不同主体统一改成同一张脸,不要给原本没有四肢的物品强行添加四肢。
贴纸外围有一圈干净的白色模切边。主体居中,四周保留足够空间,不裁切主体。
只生成一枚贴纸,不要九宫格,不要附加文字,不要展示贴纸贴在其他物品上的效果。
1:1 方形画布,输出带真实 Alpha 透明背景的 PNG,不能将透明棋盘格画进图片。
- 拿到图片后,继续发送
请读取上一张贴纸图片,用 Python 将它制作成一个真正可以播放的循环 GIF。
先检查图片是否具有真实透明背景;如有不透明背景,先将主体与背景分离,不要让背景跟着主体一起移动。
在固定的纯白画布上,让主体完成一段轻快的弹跳: 静止片刻,向下轻轻蓄力,向上弹起,落下时轻微压扁,再恢复原样。
只使用同一张贴纸素材,通过位置、轻微旋转和小幅缩放制作动画。不要逐帧重画角色,不要改变五官、花纹、配色和服装。
动作幅度适中,过渡顺滑,主体始终完整地留在画布内,循环衔接自然。背景保持静止,不闪烁、不留残影。
输出 512×512 像素、约 2 秒、无限循环的 GIF 文件。实际检查文件包含多帧,再提供成品,不要只返回代码或静态预览。
如果当前环境无法运行代码或导出文件,请明确说明。
2、上传一张脸,生成自己的九宫格表情包
这组输入范围稍微收窄:人物、宠物、卡通角色都适合。
第一步:生成九宫格表情
ChatGPT官方模版里有一套九宫格表情包提示词
【图片(已更新)】-【热门】-【贴纸】里面的emoji你可以自由换
Create a Meme sticker pack based on the images attached, remixing with 😎😛💕🚀🥳. Use exaggerated internet-reaction expressions, including crying, confusion, shock, smugness, side-eye, and deadpan disbelief, with awkward poses, low-fi cutout textures, and absurd humor. Create a single square(1:1) transparent sticker sheet with nine distinct stickers arranged in a 3×3 grid, each showing a different expression, pose, or reaction. Separate the stickers with wide, fully transparent gaps. No background, shadows, or overlapping elements.
我自己也分享一套,我自用的
请将我上传图片中的主要人物、动物或卡通角色,转化成一套专属聊天表情包。
先提取这个主体最有辨识度的特征,再统一转化为简洁、生动、略带夸张的手绘贴纸风格。保留五官关系、发型或毛发、标志性花纹、服装和主要配色,不要变成普通的通用角色。
生成一张排列整齐的 3×3 九宫格图片。九个格子里的角色必须是同一个,外形和画风保持一致。
从左到右、从上到下,依次表现: 开心大笑、满脸疑惑、彻底无语; 突然震惊、委屈想哭、偷偷得意; 困得不行、气鼓鼓、表达喜欢。
每格都要有明显不同的表情和姿态,缩小后也能看懂。动作应适合主体自身的身体结构,不要给动物强行接上写实的人类身体。
每枚贴纸周围留白,彼此不要接触,不画分隔线,不添加文字。纯白背景,1:1 方形。
等六帧图实际生成出来,再在同一对话发送:
用Grok测试结果同时生成9个表情包,效果非常差,建议@zhidawang219555
imagine批量生成的。
这里提供单张的效果:
请使用图像生成工具,以我上传的单张图片为角色参考,生成一张用于制作循环 GIF 的六帧连续动作序列图。
这一步需要实际生成新的动作画面。不要使用 Python 对原图进行平移、旋转、缩放或局部拉伸来代替绘制。
【角色与动作】
识别图片中的主要人物、动物或卡通角色,保留其有辨识度的五官关系、发型或毛发、花纹、服装、配件和主要配色。
如果原图已经是贴纸或插画,沿用原有画风。 如果原图是照片,统一转化为简洁、生动的手绘贴纸风格。
本次只制作一个表情动作: 【在这里填写,例如:开心大笑;留空则根据上传图片自动选择一个适合的动作】
只围绕这一个动作展开,不要画成六种互不相关的表情。
【六帧连续表演】
从左到右、从上到下,呈现同一个动作的六个连续阶段:
第1帧:起始姿态,动作尚未充分展开。 第2帧:开始起势,面部和相关肢体开始变化。 第3帧:动作展开,表情明显加强。 第4帧:动作峰值,情绪最清晰。 第5帧:动作回落,逐渐恢复。 第6帧:接近起始姿态,为接回第1帧做好衔接。
请根据选定动作具体设计每帧的嘴形、脸颊、眉眼和肢体姿态。
至少一处面部特征必须出现清晰、连续的变化,身体动作作为配合。例如大笑时嘴巴逐渐张开、脸颊抬起;惊讶时嘴巴张大、下巴落下。
允许重新绘制同一角色在不同时间点的五官和肢体姿态。保持角色身份与造型一致,不要把眼睛、嘴巴和姿势全部锁死。
角色戴墨镜时保留墨镜,通过嘴形、脸颊、下巴与肢体表现情绪,不要凭空透视出眼睛。
动物的动作必须符合自身身体结构。
【帧间一致性】
固定镜头、视角、光线、绘画风格和角色的基础尺寸。
在每个格子中使用相同的构图坐标和身体基准位置。动作可以改变局部轮廓,但不要为了填满格子而逐帧放大或缩小角色。
服装、配件、四肢数量、毛发花纹不能无故改变。 已有道具和装饰可以随动作发生合理变化,不要随机新增或消失。
【序列图排版】
整张图为3列×2行,总画幅比例3:2,每个格子都是等大的正方形。
使用规则的隐形网格,不画分隔线、外框、文字或帧号。
每格只放一个完整角色,包含属于它的道具和装饰。四周保留约15%的安全留白,任何部分都不能跨入相邻格子。
背景使用真实 Alpha 透明,不要画白色底板或透明棋盘格。保留贴纸白边及主体内部的白色细节。
【交付】
直接生成这张六帧动作序列图,暂时不要制作 GIF。
**第二步:**6 帧动作图 → 一个可播放的 GIF
GIF
请使用 Python,读取上一张实际生成的六帧动作序列图原始文件,将它拆分并合成为一个真正可以播放的循环 GIF。
本轮只处理已经生成的六个动作画面,不重新绘制角色,不用原始静态贴纸替代这些画面。
【读取与拆分】
确认当前存在可读取的六帧原图,然后按3列×2行、从左到右、从上到下的顺序拆出六帧。
检查每帧是否完整,是否带入相邻格子的内容。
保留角色、四肢、尾巴、配件、道具、贴纸白边和所有属于该帧的装饰。
检查是否具有真实 Alpha 透明背景。
如果原图是纯色不透明背景,只分离外围背景,保留眼白、牙齿、高光、白色衣服和贴纸白边。不要直接删除所有白色像素,也不要将棋盘格当作透明背景。
【统一画布与对齐】
六帧输出画布均为512×512。
优先保留原序列图每格的统一坐标关系。
需要裁切或调整尺寸时,使用六帧完整内容的联合边界确定共同裁切范围,并对六帧使用相同的缩放比例和位置偏移。
禁止逐帧紧贴轮廓裁切,再分别缩放到最大尺寸。 禁止逐帧重新居中,破坏原本的动作位移。
只修正明显的排版偏差,保留有意设计的头部和肢体运动。确保所有帧都有足够安全边距。
【GIF 合成】
直接按照1→2→3→4→5→6→1循环播放。
保留六个实际生成的内容帧,不要添加整张贴纸漂移、旋转或缩放效果。
默认各帧时长为: 350、200、250、450、400、350毫秒。 总时长2秒。
可以根据实际动作微调停顿,但必须报告最终实际时长。
不要为了凑20帧/秒重复复制大量静态帧。 不要使用叠化、透明度交叉淡入淡出或模糊混帧来伪装动作。
使用基于全部六帧建立的统一调色板,预留专用透明色索引,正确设置透明色、背景索引和帧清除方式。使用无限循环,避免拖影、残影和背景闪烁。
【实际检查】
导出后重新打开 GIF,检查: 实际帧数、各帧时长、总时长、尺寸、无限循环设置、透明区域和文件大小。
逐帧检查角色是否出框、是否丢失装饰,以及最后一帧接回第一帧是否存在明显跳变。
同时观察面部和肢体,确认播放内容来自六个不同动作状态。不能仅凭像素变化率就声称表情变化合格。
如果六帧本身缺少动作变化,或角色一致性明显出错,请具体指出问题,不要用整体移动掩盖。
【交付】
提供一个独立的 GIF 文件链接。
另提供一个 ZIP,包含六张拆分后的 PNG 和该 GIF。
简要报告重新打开文件后实际读取到的帧数、尺寸、总时长和文件大小。
直接运行并导出成品,不要只返回代码、命令或静态预览。遇到无法读取素材或无法导出的情况,请如实说明,不要提供虚构链接。
二、电商玩法
1、商品慢扫光动态广告
关于商品慢扫光动态广告,我尝试了先生成6帧、10帧分镜头,再通过python制作Gif。但是,测试发现gif有明显抖动,原因在于:源关键帧本身的一致性问题
所以,后面我采用1 张商品底图 + Python 扫光的方式,解决最大的三个问题:瓶身不动、Logo 不动、文字不动。
具体做法是:先生成**一张最终商业商品图/直接提供一张产品图,**然后 Python 读取这一张图,商品像素从头到尾完全复用,只在上面叠加一个很宽、透明度很低、边缘高斯羽化的竖向光带,让光带从画面左侧缓慢扫到右侧。光带最好不要简单做纯白矩形,而是用类似摄影棚 softbox 的高斯亮度分布,同时轻微提升局部亮度和暖色,不改变几何内容。
整体生成顺序:上传任意商品图 → Image 负责得到一张漂亮商品照 → Python 只生成移动摄影棚光 → 输出高级循环 GIF。
GIF
- 生成稳定商品底图
请以我上传图片中的主要商品作为唯一商品参考,生成一张用于后续动态广告制作的高质量商品底图。请严格保留原商品的轮廓、比例、结构、颜色、材质、Logo、品牌名称、标签文字、包装信息和所有可以辨认的细节,不要重新设计商品,也不要添加原图中不存在的文字、卖点、价格、参数、装饰元素或配件。
画面采用高端商业商品摄影风格,商品正面朝向镜头,居中放置,镜头像固定在三脚架上一样稳定。保持自然真实的透视和产品比例,商品四周留出充足安全空间。背景使用简洁、中性、低干扰的摄影棚背景,可以根据商品本身的颜色自动选择米白、浅灰、暖灰或其他合适的中性色,但不要使用复杂场景、道具或明显纹理。
光线采用柔和、克制、均匀的基础棚拍布光。此时不要加入明显扫光、强烈条形高光、戏剧化阴影或局部过曝,商品整体曝光保持均衡,让玻璃、金属、塑料、织物、皮革、液体等材质保持真实质感。金属可以有自然反射,磨砂材质保持柔和,透明或半透明材质保留真实透光感,不要为了增强高级感改变商品原本材质。
这张图将作为后续动画中完全固定的基础帧,所以请优先保证商品结构、Logo、标签和文字准确稳定。最终画面应当干净、克制、高级,像已经完成布光的商业产品摄影原片,后续只需要在这张固定图片上增加移动灯光即可。
- Python 制作 GIF 提示词
请用 Python 将上一张连续关键帧拼图制作成一个真正可以播放的循环 GIF。上一张拼图固定为 5 列 × 2 行,共 10 帧,请严格按照这个网格裁切,不要自动改成其他排列。第一行从左到右为第 1、2、3、4、5 帧,第二行从左到右为第 6、7、8、9、10 帧。
裁切完成后,让所有帧保持完全一致的画布尺寸,并保留原始内容比例。禁止对商品进行非等比拉伸,不要把商品拉宽、压扁或重新构图。如果原始单帧尺寸不同,只能对整张单帧等比缩放后居中补边到统一尺寸,不要单独移动商品,也不要为了“校正”位置而修改每一帧中的商品坐标。
GIF 使用固定的往返顺序播放:1→2→3→4→5→6→7→8→9→10→9→8→7→6→5→4→3→2,然后重新回到第 1 帧。不要在两端重复第 1 帧和第 10 帧,这样可以避免光线到达最右侧后突然跳回最左侧。每帧固定约 120 毫秒,设置为无限循环,整体节奏保持缓慢、平顺、高级。
全部帧使用同一套统一的 256 色调色板导出 GIF,尽量避免因为每帧单独量化而产生的颜色闪烁。不要使用交叉溶解、透明叠化、光流插帧、AI 补帧、帧间混合或形变补间来掩盖生图阶段的问题,也不要在 GIF 阶段给商品添加位移、旋转、缩放或形变。GIF 阶段只负责裁帧、统一尺寸、统一调色板、排列播放顺序和导出文件。
完成后请实际读取生成的 GIF 文件进行检查,确认 GIF 包含 18 帧,每帧约 120 毫秒,并且已经设置无限循环。同时检查 10 个原始关键帧中的商品外轮廓是否存在位置漂移,Logo、品牌名称和标签文字是否跳动,商品大小是否变化,相邻帧之间是否存在明显亮度突变、颜色闪烁,以及整个往返循环是否存在明显断点。
请使用图像分析估算商品边缘以及 Logo/标签区域的最大帧间位置偏移,但不要自动修正这些偏移。如果源关键帧本身存在跳动,请如实指出这是生图阶段的帧间一致性问题,不要通过后期手段隐藏。
最终必须输出真正可播放的 GIF 文件,并告诉我原始关键帧数量、GIF 实际帧数、单帧尺寸、每帧时长、循环方式、实际播放顺序、商品边缘最大估计偏移、Logo/标签最大估计偏移,以及是否存在明显闪烁或循环断点。
2、上传一张定稿海报,再上传自己的商品:换款不动模板
参与方式:图 1 是可使用的广告模板,图 2 是自己的商品。
实际用途很明确:同一系列换颜色、换包装、换新品,沿用已经确定的广告版式。模板最好使用通用文案,避免残留旧商品专属的型号、参数或价格。
官方在精确编辑部分明确举出了替换商品、背景或文案,同时保留周围构图与品牌处理的场景。
通用提示词
请编辑图1,将其中的主商品替换为图2中的商品。
两张参考图的用途必须严格分开: 图1只负责广告构图、背景、灯光方向、装饰元素和商品之外的文字排版。 图2只负责新商品的真实外形、结构、材质、颜色、Logo和包装信息。
移除图1中的旧商品,将图2中的商品自然放入原商品所在区域。
保留图2商品的真实长宽比例,不要为了塞进原来的轮廓而压扁、拉长或修改结构。可以整体等比例调整大小,让新商品适合原版式。
只修改新商品占据的区域,以及由替换产生的必要接触阴影、遮挡和局部反射。不要重做整张海报。
商品之外的标题、文字内容、字体、字号、位置、背景纹理、装饰元素和画布尺寸保持不变。
禁止将两件商品混合设计。不要保留旧商品的瓶盖、把手、标签或其他零件。
不添加图2中没有的配件,不猜测看不清的包装文字,不改变商品颜色来迎合背景。
只输出一张替换后的完整海报。
再上传另一款实物照片,继续发送:再上传另一款实物照片,继续发送:
沿用刚才确认的海报模板,只将主商品替换为我新上传的这一款。
新上传照片是本轮商品外观的唯一依据。不要沿用上一款的结构、标签或颜色。
其余版式、文案、背景和装饰保持不变,仅更新必要的阴影与反射。
3、衣服试穿
比如“胖可”喽也是穿上了LV的新款,后面又给他配上了模特同款裤子
整体造型,模型会自己更改更合适的动作,从插裤兜变成。
请将图2中的上衣,穿到图1的人物身上,生成一张真实的试穿效果图。
图1只负责人物身份、身体比例、姿势、镜头角度和背景。 图2只负责上衣的款式、颜色、面料、剪裁、图案和细节。
保留人物的脸、发型、肤色、体型与原有姿势,只替换上衣。不要为了让衣服更好看而改变肩宽、腰围或身体比例。
准确保留上衣的领口、袖型、门襟、口袋、纽扣以及其他可见结构。
原有的印花、刺绣、Logo和文字应位于衣服对应的位置。它们可以随布料产生自然弯曲和褶皱,但不能被改写、镜像、增加、删减或移动到其他位置。
面料应根据肩部、手臂和躯干形成合理垂坠。保留原面料的厚薄感与表面质感,不要把针织变成光滑塑料,也不要把挺括面料变成贴身薄布。
采用正面展示,不主动展示参考图没有提供的背面设计。
保留原图的光线与环境,让替换后的衣服自然融入。只输出一张试穿图,不添加文字或前后对照。请将图2中的上衣,穿到图1的人物身上,生成一张真实的试穿效果图。
图1只负责人物身份、身体比例、姿势、镜头角度和背景。 图2只负责上衣的款式、颜色、面料、剪裁、图案和细节。
保留人物的脸、发型、肤色、体型与原有姿势,只替换上衣。不要为了让衣服更好看而改变肩宽、腰围或身体比例。
准确保留上衣的领口、袖型、门襟、口袋、纽扣以及其他可见结构。
原有的印花、刺绣、Logo和文字应位于衣服对应的位置。它们可以随布料产生自然弯曲和褶皱,但不能被改写、镜像、增加、删减或移动到其他位置。
面料应根据肩部、手臂和躯干形成合理垂坠。保留原面料的厚薄感与表面质感,不要把针织变成光滑塑料,也不要把挺括面料变成贴身薄布。
采用正面展示,不主动展示参考图没有提供的背面设计。
保留原图的光线与环境,让替换后的衣服自然融入。只输出一张试穿图,不添加文字或前后对照。
4、透明商品换场景:背景换了,瓶子里面看到的东西也得换
上传香水瓶、玻璃杯、透明收纳盒,或者装有液体的透明瓶子。换到新环境以后,要观察透过商品看到的背景、表面反射和接触阴影能否一起协调变化。
这正好能围绕官方提到的自然光照与材质改进设计测试;我会把“透光区域有没有残留旧背景”作为其中一个检查项。
请将我上传的透明或半透明商品,放入一个新的商业摄影场景。
保留原商品的轮廓、比例、厚度特征、瓶口或开口结构、标签位置和可辨认的包装文字。如果内部有液体,保留液体的颜色与液面高度。
新场景采用深灰色摄影棚背景,商品放在低反光的深色台面上。一侧有柔和的大面积光源,后侧有一道克制的暖色轮廓光。
重点处理商品与新环境的光学关系: 透明区域应看到新的背景,而不能残留原照片的背景颜色或物体; 根据商品形状呈现视觉上合理的透光和折射变化; 表面反射应与新光源相符; 底部保留自然的接触阴影。
允许反射、受光和透过商品看到的背景发生变化,但不要改变商品本身的结构、颜色、标签与内容物。
不要把透明玻璃变成不透明塑料,不要把磨砂材质变成完全透明,也不要给原本没有的区域增加镀铬效果。
保留原商品的拍摄角度,不展示没有参考的背面。只生成一张3:4竖版商品摄影图,不增加道具或文案。
5、一张人物照+一张商品照,让自己成为商品展示模特
上传一张人物半身照,再上传一张能拿在手里的商品照。目标是让照片中的人自然拿起那件商品,同时保住人脸、商品包装、手部接触关系。
请根据我上传的两张图片,生成一张自然、可信的真人商品展示照片。
图1是人物参考,决定人物身份、五官、发型、肤色和服装。 图2是商品参考,决定商品的外形、结构、颜色、材质、Logo和包装信息。
让图1中的人物自然地拿着图2中的商品,像是在镜头前展示它。商品位于胸前或身体侧前方,主要展示面朝向镜头,不遮挡人物脸部。
根据商品形状选择合理的握持方式。手指应自然包握、托住或捏住商品,有正确的前后遮挡、接触阴影和受力关系。手不能穿进商品,商品也不能悬浮在掌心上方。
保留人物可辨认的五官关系、年龄感、发型和皮肤细节,不换脸,不改变体型。允许手臂与手部为了拿起商品而调整姿势。
商品不能被重新设计。保留原来的轮廓、瓶盖或其他结构、标签位置、主要配色和可辨认文字。不要镜像Logo,不增加配件。
让人物和商品处于同一套光照中,避免生硬拼贴感。背景沿用人物照片,适当简化干扰元素。
3:4竖版,人物与商品都清晰可见,不增加标题、宣传语或购买评价。
6、几张单品照片,合成一张“同场拍摄”的组合主图
这组适合做同系列护肤品、不同口味饮料、文具组合、成套杯具。
上传三四张商品图,要求每件商品都来自对应参考,不能少一件、多一件,也不能把甲的瓶盖配给乙、把乙的标签贴到丙身上。
我会先用同系列、实物尺寸接近的商品测试,减少图片无法提供真实尺度带来的歧义。官方指南要求在迁移测试中检查商品形状、标签和参考细节,这里把检查对象扩展到多个商品同时出现。
请将我上传的多张商品照片,合成为一张统一拍摄风格的组合主图。
每张参考图中的主要商品,都作为一个独立且不可混淆的对象。每件商品在最终画面中只出现一次,不遗漏、不重复、不合并。
准确保留各商品自己的外形、结构、颜色、材质、Logo、标签和可辨认文字。不能把不同商品的瓶盖、配色、包装图案或标签混用。
让全部商品放在同一摄影棚台面上,形成简洁、有层次的组合陈列。商品之间可以有轻微前后关系,但主要展示面与品牌信息应清晰可见。
尽量沿用各商品参考图中已经展示的角度,不主动展示缺乏参考的背面。
统一光源方向、色温、清晰度和接触阴影,让它们像在同一次拍摄中完成,避免各自带着不同背景和不同光线的拼贴感。
背景采用与整组商品配色协调的简洁中性色,不抢主体。不要改变商品颜色来配合背景。
不添加未提供的商品、赠品、礼盒、包装袋、价格或宣传文字。
生成一张1:1方形组合主图,所有商品完整留在画面内。
7、上传包装展开稿,直接看到折成立体盒子的样子
这组面向包装设计、电商品牌和做周边的人。
重点放在平面稿上的文字、图案,折成立体以后能否落在正确的面上。正面、侧面、顶面不能乱贴,跨折线的图案也要对得上。
官方系统卡提到了布局准确性与改变构图时的细节保留改进;把包装展开稿转为样机,是我据此设计的一个高约束测试,尚未验证稳定性。
上传:带有清晰折线、裁切线和完整印刷内容的纸盒展开稿。
三、五种提示词写法技巧
OpenAI 的提示词指南强调:明确可见细节、区分修改项与保留项、给参考图分配用途,以及逐步迭代。下面这五种写法,我建议直接存成自己的常用片段。
- 修改项与保留项分开写
本轮只修改:【目标变化】。
必须保留:【身份、构图、物体位置、文字、配色等关键项】。
允许随修改产生的联动:【必要的接触阴影、反射、遮挡】。
例如换了一盏灯,灯光和阴影可能也需要变化。把这些例外说明白,约束就不会互相打架。
- 给多张参考图明确分工
图1只用于确定主体身份和外形。 图2只用于参考配色、笔触和材料质感。 图3只用于参考构图与主体占比。
不要将图2的人物或图3的物件带入最终画面。
- 把文字当成固定内容交付
画面必须出现以下文字,逐字保留,每项只出现一次: “【标题】” “【副标题】”
标题位于【位置】,副标题位于【位置】。 不要增加其他文字。
- 用可见细节替换“高级感”
我会把做得高级一点改成:
采用克制的配色和明确的视觉层级。 保留真实材质细节,减少装饰。 主体之外留出大面积安静空间。 通过柔和侧光呈现表面起伏,避免过度锐化和夸张高光。
- 给创意设置一个锚点
先提炼主题中最清晰的一组关系,再将它转译成一个可见的视觉事件。
一张图只使用一个核心隐喻。 让主体、动作和空间关系承担表达。 不要同时堆入多个象征物,也不要依赖解释文字才能看懂。
关于作者
Punk|中科大管理学硕士|AI提示词、AI小白教程|Punk系列Skills作者|3个月赚了8位数|Learn in Public|FDE文章浏览量240w|
@AdrianPunk115
Similar Articles
@FinanceYF5: It’s been barely 24 hours since OpenAI dropped ChatGPT Images 2.0 and people are already going wild—10 insane examples:
Within 24 hours of OpenAI’s launch of ChatGPT Images 2.0, users have unleashed a flood of creative, viral image demos.
@op7418: https://x.com/op7418/status/2074728162018152817
The user released an open-source AI illustration skill called guizang-material-illustration, based on GPT-Image 2.0 and Codex Agent, which can generate 3D material explanation diagrams with Chinese labels, suitable for articles, weekly reports, PPTs, etc.
Introducing ChatGPT Images 2.5
OpenAI releases ChatGPT Images 2.5, enhancing image generation with better instruction-following, faster responses, and new API model IDs for improved precision and everyday use.
Introducing GPT-Image-2.5 in the API
OpenAI has launched the GPT Image 2.5 series of image generation models, including the high-quality flagship Sunburst and the ultra-fast Flare, now available on the API, ChatGPT, and Codex platforms.
@OpenAI: Introducing ChatGPT Images 2.0 A state-of-the-art image model that can take on complex visual tasks and produce precise…
OpenAI released ChatGPT Images 2.0, a state-of-the-art image model that handles complex visual tasks, offers sharper editing and richer layouts, and integrates thinking-level intelligence.