文生图最浪费时间的,往往不是「第一张」,而是:整体已经 80 分,只差光线太平、标题挤了、背景杂了一个瓶——你一重抽,脸变了、构图散了、字又乱了。
传统流程只能「重新生成 + PS 修」,成本高。Image 2 的强项之一是 多轮自然语言编辑:在已有画面上用对话指出「改什么、保留什么」,像跟修图师沟通。本文用 5 组实测 image-2 指令,说明如何 改一处不毁全图。

📌 下文编辑指令以英文为主(Image 2 对结构化英文更稳);每轮都写清
keep … unchanged。正式投放前请人工校对文字、商标与合规表述。
一、为什么 Image 2 适合「对话改图」而不是重抽?
相比「把整段 prompt 改完再 roll 一张新的」,Image 2 的优势在于:
- 局部意图理解更强
你说「only brighten the key light from the left, keep pose and face identical」,模型会优先动光,而不是重抽整个人物。 - 可显式锁定不可变项
Logo、脸、产品轮廓、已正确的标题行——用verbatim/unchanged钉住,减少「修 A 毁 B」。 - 迭代成本接近聊天
3–5 轮微调通常比 10 次盲抽 + 手工合成更快,尤其适合营销主视觉与电商详情图。
对增长与设计团队来说,这意味着:AI 改图从「抽卡」变成「可控修图会话」。
二、标准工作流(五步)
-
先出一张「结构可用」的底图
构图、主体、大致风格对了即可;别在第一轮追求完美细节。 -
列「锁定清单」与「本轮只改一项」
锁定:脸 / Logo / 产品外形 / 已正确文案;本轮只改:光、或背景、或一行字——禁止一次提五件事。 -
用三段式指令:目标 + 锁定 + 禁止
Change: …/Keep unchanged: …/Do not: … -
每轮只验收一个目标
光修好了再改字;字对了再清杂物。混在一起会互相干扰。 -
导出前全量校对
尤其是 画面内文字、手指/边缘伪影、品牌色是否漂移。
三、五组实测指令(可复制)
案例 1:只改光线,不动人脸与姿势
场景:人像主视觉偏平,需要左侧轮廓光,但不能换脸。
Image 2 编辑指令:
Multi-turn edit on the current image with Image 2.
Change ONLY lighting: add soft cinematic rim light from camera-left,
slightly deepen shadow on the right cheek for depth.
Keep unchanged: face identity, expression, hairstyle, pose, wardrobe, framing, background layout.
Do not regenerate the person. Do not change skin tone dramatically.
Photorealistic, natural contact shadows, Image2 commercial portrait quality.
效果:氛围立刻「立住」,主体身份仍可认——典型的 对话式改图 用法。
案例 2:只改构图留白,给标题腾位置
场景:海报主体太大,顶部没地方放 Headline。
Edit the current poster layout with Image 2.
Change: push the main subject slightly downward and scale to ~85%,
create clean negative space in the top 20% for a future headline.
Keep unchanged: subject identity, outfit colors, overall art style, color grade.
Do not add new objects. Do not mirror the subject.
Maintain high-end marketing poster look, Image 2 quality.
效果:为后续 自然语言修图 加字留出安全区,避免字压脸。
案例 3:只改正一行海报文案(其余字不动)
场景:标题写错促销力度,价格与按钮已正确。
In-image text edit using Image 2 multi-turn editing.
Replace the headline text ONLY with exactly: "SUMMER SALE 40% OFF"
Keep unchanged: all other on-image text (price, button, footer) verbatim,
font style hierarchy, poster artwork, subject, colors.
No gibberish, no mirrored letters, no missing strokes.
Crisp legibility, commercial poster typography, Image2 text accuracy.
效果:不必因一个词重抽整张 AI 海报;改字成功率显著高于「整段 prompt 重来」。
案例 4:局部去杂 / 去多余道具
场景:桌面多了一个干扰瓶,抢产品焦点。
Local cleanup edit with Image 2.
Remove the small bottle on the far right of the table only.
Fill the area with consistent table texture and lighting.
Keep unchanged: main product shape, logo, label text, camera angle, overall lifestyle mood.
Do not restyle the product. Do not add new props.
Photorealistic e-commerce secondary image, Image 2 high detail.
效果:比 PS 修补更接近「场景原生」,适合电商副图快速清场。
案例 5:三轮递进示例(光 → 背景 → CTA 文案)
场景:一张还行的 App 上线图,要在对话里修到可投放。
第 1 轮:
Keep UI mockup and headline unchanged. Increase contrast slightly and add cool blue ambient fill from the right. Do not alter icon shapes.
第 2 轮:
Keep subject and text unchanged. Simplify the background: reduce grid noise, keep a clean dark navy gradient only.
第 3 轮:
Change the CTA button label ONLY to exactly: "Try Free". Keep button shape, color, and all other text verbatim. No extra characters.
效果:演示 多轮编辑 的正确节奏——每轮一个目标,三轮后达到可投放质量。
四、通用指令模板(填空即用)
Multi-turn natural-language edit with Image 2 on the CURRENT image.
Change (ONE goal only): [lighting / layout / one text line / remove object / color grade].
Keep unchanged: [face / product / logo / other text lines / pose / style].
Do not: [full regenerate / new people / invent logos / change aspect ratio].
Success criteria: [e.g. readable headline, same identity, clean background].
Output: commercial-ready, Image 2 quality.
五、重抽 vs 多轮改图对比
| 环节 | 整张重抽 | PS 手工修 | Image 2 多轮对话改图 |
|---|---|---|---|
| 保留主体身份 | 不稳定 | 高 | 高(需写 keep) |
| 只改一行字 | 常连带毁掉版式 | 精确但慢 | 快,适合迭代 |
| 单次耗时 | 反复抽卡 | 0.5–2 小时 | 约 5–20 分钟/轮组 |
| 学习成本 | 低 | 设计技能 | 学会「一次改一项」 |
| 最适合 | 结构完全不对 | 像素级精修 | 80→95 分冲刺 |
六、最适合谁?
✅ 市场 / 增长同学
用 Image 2 快速试光线与文案 A/B,不必每次找设计重出图。
✅ 电商运营与独立站卖家
详情图、主图小问题(杂物、偏色、一行错字)用 对话式改图 当场修。
✅ UI / 品牌设计师
把 image-2 当「草图会话」:锁定版式,多轮逼近终稿,再进 Figma 精修。
✅ 内容创作者
封面差一口气时,用自然语言改情绪光与标题,而不是从零生成。
七、三条避坑
-
❌ 不要一轮指令塞五件事
「改光 + 换背景 + 改三行字 + 换姿势」会让 Image 2 顾此失彼;严格一次一项。 -
❌ 不要省略 Keep unchanged
不写锁定项,模型更容易「好心」重画脸或重排全部文字。 -
❌ 不要把多轮编辑当成免校对
改字后仍可能出现缺笔;导出前必须人眼核对 AI 改图 结果。
八、结语
Image 2 的多轮自然语言编辑,把「重抽碰运气」变成了「像修图师一样下指令」。
下次当画面已经八成可用,只差光、布局或一行文案时,先别按下重新生成——用本文模板跑 3 轮 image-2 对话。改一处、锁一处、验一处,你会发现 Image2 真正省下的,是那些被重抽毁掉的好构图。
本文为实操笔记,指令可自由复制修改;正式投放请核对文案合规与品牌视觉规范。