今天试了一次很直观的 AI 改图流程。
一开始,我只给了一个简单要求:生成一张 9:16 的图,画面是在农村小道上,小道两旁是松树,路上跑着一只中华田园犬。
生成出来的第一版已经接近想要的感觉:竖版构图,松树林把小路夹在中间,一只黄白色的田园犬从路上跑过来,光线也比较自然。检查图片时,我发现右下角有一点小伪影,于是先把边缘裁掉,保留 9:16 比例,再把干净版本放进 Cowart Canvas 画布里。
接下来是这次最有意思的部分。
我没有重新写一大段提示词,而是直接在画布上标注:在右下方路面圈出一个区域,写上"在这里生成一只小狗"。这一步很像平时和设计师沟通改图,哪里要改就圈哪里,文字说明也不用太复杂。
随后,Codex 根据这张标注图理解了修改意图:保留原来的松树、小路、大狗和光线,只在标注区域生成一只小狗,并且不要把红框和文字带进最终图片。生成后的结果里,小狗出现在右下方路面上,体型比前面的大狗小,毛色和光照也比较一致,看起来像是跟着大狗一起在乡间小路上跑。

这次流程给我的感觉是,AI 改图正在变得更接近真实的协作方式。
以前想改一张图,往往要反复描述:“右下角偏中间一点,靠近路面,不要挡住主体,大小要自然。” 这种描述很容易产生歧义。现在直接在画布上圈出来,模型看到位置,再结合文字说明,改图效率明显高很多。
整个过程其实只有三步:
先生成一张基础图。
然后在画布上做视觉标注。
最后让 AI 按标注重新生成,并把结果放回画布对比。
它不一定每次都一次完美,但这种"生成、标注、再生成"的循环,已经比单纯靠提示词猜来猜去舒服很多。尤其适合做封面图、插画草图、场景微调这类工作。
这次的小实验最终得到了一张乡间松树林小路上的双狗图:一只大狗在前面跑,一只小狗从右下方跟上来。画面很简单,但流程很值得记录。
以后做图,我大概会更多使用这种方式:先让 AI 出第一版,再把真正想改的位置直接画出来。比写一长串提示词更省心,也更接近人和人之间沟通设计稿的方式。