本文转载自微信公众号「JacksonAIGC」,点此查看原文。
最近我集中看了一圈 OpenAI 对 ChatGPT Images 2.5 的介绍,也翻了不少 X 上已经跑出来的实战案例。

如果只看官方样片,很容易把这次更新理解成“画质更好了”“细节更强了”“人物更稳定了”。但实际测试下来,我觉得真正值得关注的并不是单张图片变得多漂亮,而是 AI 图片生成开始从“抽卡”变成一件越来越可控的事情。
以前大家做 AI 图片,最常见的方法是往提示词里不断塞形容词:电影感、8K、超写实、高级光影、大师风格、顶级质感。结果不好,就重新生成一张,再重新生成一张,直到碰巧抽中满意的结果。
Images 2.5 更适合的思路刚好相反:先把一张图做对,再告诉它哪里可以改,哪里绝对不能动。
这听起来只是提示词写法发生了一点变化,但其实背后是整个 AIGC 创作方式的变化。
过去更像是在说:“重新给我画一张差不多的。”
现在更像是在说:“这一版已经通过,接下来只修改这一项。”
这也是我觉得 Images 2.5 最值得记住的一句话:
你不仅要告诉 AI 你想要什么,也要明确告诉它什么不能变。
一、先别急着追求“神图”,先测试它到底听不听话
我现在测试一个图片模型,已经不太会只生成一张图,然后凭感觉判断“这个模型很强”。
因为第一张图漂亮,有时候只是运气。
真正影响我们以后能不能拿它做商业内容、短片、人物 IP、电商素材和影视分镜的,是另外一个问题:
当一张图已经基本正确之后,它还能不能继续按照你的要求修改,而不是重新画一张。
举一个最简单的产品广告测试。
先让它生成一张饮料广告:
生成一张高端商业产品摄影图。 画面比例为竖版 4:5。 主体是一罐虚构品牌气泡水“LUMA”,细长铝罐,哑光象牙白表面,带少量真实冷凝水珠。 罐身只出现“LUMA”“气泡水”“青柠薄荷”三组文字。 场景为暖米色极简摄影棚,产品放在浅色石灰岩台座上。 相机与产品高度基本持平,产品位于画面中下部,上方保留较大留白。 左上方使用大型柔光箱,右后方有轻微轮廓光,产品底部存在自然接触阴影。 整体是高级商业广告摄影,真实材质、极简、安静、现代。 不要添加水果、其他产品和额外文字。

如果第一张效果满意,下一步不要再重新描述整张图片,而是直接测试局部编辑:
编辑当前图片。 只把暖米色背景替换成浅薄荷绿色无缝摄影棚背景。 易拉罐外形、比例、位置、品牌设计、所有文字、相机角度、画面裁切、石材底座、主光方向和阴影位置必须全部保持不变。 只允许因为背景颜色变化而产生轻微、真实的绿色环境反光。 不要重新设计产品,不要移动产品,不要增加道具,也不要改变构图。

这个测试其实比“再生成十张漂亮产品图”更有意义。
如果换完背景之后,瓶子也偷偷变了,包装重新设计了,文字开始变形,那就说明它还不够稳定。
反过来,如果你连续换几次背景,产品始终保持一致,这种能力对品牌广告、电商主图和批量素材生产就非常有价值。
二、人物一致性,不要只看“像不像”,要看“改完以后还是不是这个人”
人物类 AIGC 一直有一个很典型的问题。
第一张人物很好看,第二张只想换件衣服,脸也跟着变了;第三张只想换个场景,人物直接变成了另一个人。
所以现在更合理的测试方法,不是一直生成人物肖像,而是先建立一个固定人物,再连续修改。
比如先生成这样一个角色:
生成一张写实人物时尚编辑肖像。 主体是一位虚构的 28 岁东亚女性创意总监,椭圆脸,黑色齐下巴短发,自然眉形,佩戴小号银色圆环耳饰,皮肤保留真实毛孔和轻微纹理。 人物穿黑色圆领基础款 T 恤。 采用半身构图,人物面对镜头,表情自然平静,85mm 人像镜头感,相机与眼睛平视。 背景为暖灰色摄影棚,左侧大面积柔光,少量正面补光,整体是现代时尚杂志编辑摄影风格,克制、真实、极简。

生成以后,再让它只换衣服:
编辑当前图片。 只把人物的黑色 T 恤替换成一件廓形宽松、结构感明显的钴蓝色西装外套,内搭白色背心。 人物脸部身份、五官比例、发型、耳饰、表情、姿势、身体比例、镜头角度、裁切范围、灯光和背景必须全部保持不变。 西装需要有真实的缝线、褶皱、肩部结构和面料质感。 不要改变人物长相,不要改变发型,不要改变姿势。

下一轮再换场景:
保持当前人物身份完全一致,只改变环境。 将人物放置在东京一间现代建筑设计工作室内,时间为夜晚。 场景中有裸露混凝土墙、建筑模型、长桌和落地窗,窗外能看到东京城市夜景。 室内为暖色照明,窗外为偏冷蓝色城市光。 人物身份、五官结构、发型、耳饰、西装、姿势、表情、身体比例、镜头焦段感、相机高度和人物在画面中的大小全部保持不变。 只允许环境光自然影响人物的综合色和边缘反光。

这个过程其实就是在测试:模型能不能真正把“人物”和“衣服”“场景”“镜头”分开理解。
如果能做到,那人物 IP、短剧角色、品牌模特和数字人连续内容都会好用很多。
三、做 AI 短片,别一上来就直接生成视频
最近 X 上有一类很值得参考的玩法,就是先做完整人物资产,再进入故事板和视频。
这对影视创作尤其重要。
比如你想做“齐天大圣大闹天宫”,很多人的第一反应是直接让视频模型生成“孙悟空大战天兵天将”。
但这种方法很容易出现一个问题:第一镜头的孙悟空和第二镜头不是同一个,金甲会变,金箍棒会变,南天门也会跟着变。
更稳的方法,是先把角色和世界定下来。
第一步,可以先做齐天大圣的角色设定表:
为“齐天大圣大闹天宫”创建影视制作角色资产表。 角色为齐天大圣孙悟空。 同一张角色设定表中必须全部保持为同一个孙悟空。 内容包含正面全身、侧面全身、背面全身、三分之四侧面、挥舞金箍棒、腾空跃起、战斗防御姿态,以及桀骜冷笑、愤怒、战斗怒吼、警觉和受伤但不服输等不同表情。 必须固定脸部特征、猴脸比例、金甲设计、凤翅紫金冠、红色披风、金箍棒设计、身体比例和配色。 背景使用干净中性浅色,整体采用影视角色概念设定图形式。 不要出现多个不同版本的孙悟空。

这张角色表其实就像后面所有镜头的“身份证”。
接下来再做南天门、天兵天将、金箍棒和天宫建筑,最后才进入正式分镜。
这样后续做出来的镜头,更容易属于同一个世界。
四、复杂动作不要一句话说完,把它拆成过程
X 上最近另一个很火的玩法,是一次生成 4×4、共 16 格的连续动作。
很多人把它拿来做 Sprite Sheet、GIF 和定格动画,但我觉得这个方法放到电影分镜里一样实用。
例如不要只告诉 AI:
“让孙悟空挥舞金箍棒大战天兵。”
可以改成:
根据当前齐天大圣角色设定,制作一张 4×4、共 16 格的电影动作分解图。 动作主题为齐天大圣挥动金箍棒横扫天兵天将。 第 1 到 4 格为蓄力阶段,身体向后扭转,金箍棒后摆。 第 5 到 8 格为高速转身,金箍棒开始横扫。 第 9 到 12 格为金箍棒扫过天兵阵列,产生最强冲击。 第 13 到 16 格为动作结束,孙悟空重新站稳,但披风和飘带因为惯性继续运动。 16 格中必须保持同一人物、同一套金甲、同一根金箍棒、同一身体比例、同一镜头距离、同一南天门环境和同一光线。 所有画面必须按照动作发生的时间顺序排列。

这种提示方式最大的价值,是让一个模糊动作变成了一段明确过程。
越复杂的动作,越不要一句话说完。
这个方法对战斗、舞蹈、人物走路、转身、起跳、产品拆解,甚至教学示意图都适用。
五、影视分镜可以这样测:别只看第一张,要连续改四轮
我最近比较喜欢拿“齐天大圣大闹天宫”做分镜测试,因为它同时包含人物、群像、复杂动作、建筑、光线和大场景。
比如第一张可以这样写:
生成一张“齐天大圣大闹天宫”的电影感分镜图,比例为 16:9,场景固定在南天门。 主体为齐天大圣孙悟空,身披金甲,头戴凤翅紫金冠,手持如意金箍棒,正处于强闯南天门的激烈战斗瞬间。 孙悟空作为绝对视觉中心,周围有大量天兵天将被击飞、后退或围攻。 南天门使用巨大的白玉与鎏金结构,云海翻涌,背景能看到天宫飞檐、神殿楼阁和战旗。 使用低机位广角视角,孙悟空位于前景,南天门和天兵位于中后景,通过破碎石阶、兵器和烟尘制造空间纵深。 主光来自云层上方的金色天光,金甲、金箍棒和建筑边缘形成明显高光与轮廓光。 整体采用中国神话史诗电影分镜风格,不要卡通,不要现代元素,不要西方超级英雄化。

第一张出来以后,再连续测试:
第二轮只让孙悟空从地面战斗变成凌空跃起,其他保持不变。
第三轮只把镜头从中景拉成更大的远景。
第四轮只把白天天光改成黄昏。
如果四轮以后,孙悟空还是同一个孙悟空,南天门仍然保持相同设计,服装和金箍棒没有变,说明这个模型的连续编辑才真正开始具备实用价值。
所以我现在更建议大家采用一种很简单的“四轮测试法”:
第一轮从零生成,第二轮只修改一个元素,第三轮继续修改另一个元素,第四轮回到最初母版,再做一个新的版本。
这样测出来的不是“运气”,而是模型真实的可控性。
六、草图可能比一大段提示词更有效
Images 2.5 还有一个很值得普通创作者重视的变化,就是草图。
以前大家很习惯用一大段文字解释构图:
人物在左边三分之一,产品在右下角,上面留标题空间,背景建筑往右延伸……
但很多时候,直接随手画一下会更快。
你甚至不需要会画画,原谅我粗旷的画工。

一个圆可以代表人物,一个方块可以代表产品,一条线可以代表地面,几个框可以代表建筑。
然后直接告诉 AI:
根据我提供的草图生成完整商业海报。 最重要的要求是严格保持草图中的空间关系和版式结构,不要重新设计构图。 草图中的顶部是主标题区域,中间偏右是核心产品,左下是辅助文字,底部是品牌 Logo。 将它完成为一张高端新能源汽车发布会海报。 场景使用深色摄影棚,一辆银灰色未来感轿跑,地面有少量真实反射,背景存在极简建筑光带。 整体采用高端汽车品牌发布视觉,写实摄影、极简、大量负空间。 不要改变产品在草图中的位置,不要调整标题区域大小,也不要增加额外装饰。

这个方法很好理解:
草图负责位置,文字负责质感。
你不用花十分钟描述“放左边一点,再往下,再大一点”。
画一下就行。
这对海报、建筑、服装、产品广告和影视分镜都非常实用。
七、参考图不要一股脑丢进去,要先分工
另一个很实用的习惯,是不要一次上传好几张参考图,然后只说“参考这些图片”。
因为对 AI 来说,“参考”到底是什么意思其实很模糊。
更好的方法是明确告诉它,每一张图负责什么。
例如:

我上传了两张参考图。 第一张只作为内容参考,只使用其中的主体、人物姿态、空间关系、构图和镜头。 第二张只作为视觉风格参考,只使用其中的配色、光影、材质、画面颗粒、色彩分级、渲染方式和整体气氛。 生成一张新的画面。 不要把第二张参考图中的人物、建筑或具体物体复制到结果中,也不要改变第一张图的核心构图。

甚至可以继续增加角色:
第一张负责人物。
第二张负责服装。
第三张负责构图。
第四张负责色彩和光影。
这样模型更容易理解每张图到底该学什么。
如果你只是喜欢某一张电影截图的氛围,也不一定要直接说“模仿这张图”。
可以先让 AI 拆一下:
分析这张参考图片的视觉语言,不要描述图片中的具体人物和物体,只提取可迁移的视觉特征。 分析内容包括色彩体系、主色与辅助色、光源方向、光比、阴影、高光、空气透视、对比度、饱和度、镜头语言、景深、材质、颗粒和整体电影感。 随后把这些视觉语言应用到我的新画面中,只迁移视觉语言,不复制参考图中的人物、场景和构图。
简单来说:
不要只会抄图,要学会拆图。
八、中文海报也值得单独做压力测试
如果你平时做小红书封面、公众号配图、品牌海报或者电商物料,中文文字能力一定要单独测试。
比如可以直接出一道固定题:
设计一张竖版 4:5 极简科技主题海报,主题是人工智能创作与人类想象力。 画面中必须准确出现三组文字。 主标题:“重新想象创造力”。 副标题:“AI 不是终点,而是新的起点”。 底部小字:“2026 · AIGC 创作者实验室”。 三组文字必须分别只出现一次,不得增加、删减或改写。 主标题位于画面上半部分,字号最大;副标题位于主标题下方;底部小字放在画面最下方。 视觉元素是一枚抽象的人类头部轮廓,由半透明玻璃和柔和粒子构成。 整体未来感但克制,使用黑色、灰白和金属质感,大量留白。 不要添加英文,不要添加二维码,不要出现任何其他中文。

这种测试重点就不是“海报好不好看”,而是看文字有没有错、有没有重复、有没有偷偷多出来一堆无关字符。
对中文内容创作者来说,这比单纯测写实人像更实际。
九、如果不知道怎么写提示词,记住一个简单中文框架就够了
很多人看到提示词案例,最容易走向另一个极端:又开始背模板。
其实没必要。
日常生成图片时,只需要把几个问题讲清楚。
你要做什么?
主体是什么?
场景在哪里?
镜头怎么看?
整体什么感觉?
哪些东西不能变?
这一轮到底只改什么?
例如我现在常用的中文结构就是:
【交付物】我要生成什么,最终用在哪里,比例是多少。 【主体】主体是谁,长什么样,在做什么。 【场景】在哪里,什么时间,周围有什么。 【构图】镜头远近、机位、人物位置和留白。 【灯光与材质】光从哪里来,画面主要是什么材质。 【视觉方向】写实、摄影、插画、电影分镜或者其他明确风格。 【文字】需要准确出现哪些文字。 【必须保持】哪些已经正确,绝对不能改变。 【只允许修改】这一轮到底只改什么。 【禁止】不要出现什么,以及哪些常见错误必须避免。
这套东西不需要每次全部写满。
简单需求可以只写几项,复杂任务再写完整。
核心不是模板,而是把事情说清楚。
十、真正值得保存的,不是 100 条“神级提示词”
我越来越觉得,未来 AI 作图水平的差距,可能不会体现在谁收藏了更多提示词。
而是在于谁更会拆需求。
真正有用的,是建立几套可以反复使用的创作流程。
比如做影视内容,可以是:
角色设定 → 场景设定 → 动作设计 → 分镜 → 关键帧 → 视频。
做品牌广告,可以是:
产品母版 → 换背景 → 换颜色 → 换版式 → 批量广告素材。
做海报,可以是:
草图 → 确定构图 → 确定视觉 → 局部修改 → 最终成品。
做人物 IP,可以是:
角色母版 → 表情表 → 动作表 → 场景变化 → 连续内容。
这些东西一旦跑通,后面换一个人物、换一个品牌、换一个主题,都能继续复用。
所以真正值钱的,不一定是某一句提示词,而是一套你以后每次都能重新使用的方法。
写在最后
如果要用一句话总结 Images 2.5 给我的最大启发,我会说:
AI 创作正在从“会不会写提示词”,变成“会不会做导演”。
导演不会每拍一个镜头,就把演员、服装和场景重新设计一遍。
他会先确定人物,确定世界观,确定镜头,然后一项一项调整。
我们现在用 AI 做图,也正在变成类似的过程。
以后你可能不需要不断对 AI 说:
“再来一张。”
而是越来越多地说:
“这张已经对了,接下来,只改这里。”
我已经把这次整理和测试的 Images 2.5 中文提示词、齐天大圣分镜案例、角色设定表、16 格动作分解、人物一致性、产品广告、中文海报、草图转成品、参考图拆解等完整模板 做成了一套可以直接复制使用的资料。
如果你也想自己跑一遍测试,可以到我的公众号主页,进入微信群领取完整提示词合集。
不用从零研究,直接把这些案例跑一轮,你基本就能判断 Images 2.5 到底适不适合自己的 AIGC 创作流程。
以上,既然看到这里了,如果觉得不错,随手点个赞、在看、转发三连吧,如果想第一时间收到推送,也可以给我个星标⭐~谢谢你看我的文章,我们,下次再见
作者:Jackson
邮箱:jacksonchen90@163.com
(原文此处嵌有视频,见原文)