记录一下: AI 图片 prompt 越写越长,不如先把参考图的职责拆清楚

7 月 20 日
 quanmengli

最近给一个图像生成相关页面做测试,发现自己很容易陷进一个坑:图不对,就继续往 prompt 里加词。

比如一开始是:

modern editorial image, clean, premium, cinematic, minimal

然后发现不对,又开始补:

not too futuristic, not too dark, clean but not empty, premium but not luxury

写到最后,prompt 已经不像需求了,更像在跟模型讨价还价。

我测试的页面是这个: https://krea2.io/
主要是拿它试 reference image / image-to-image 这类控制方式,不是说这个站一定比别的强。

这次比较有用的经验是:文字适合描述“画什么”,参考图更适合描述“怎么看起来”。

我现在一般会先把参考图拆成几个职责:

  1. 一张只管光线,比如明亮、柔和、偏 editorial
  2. 一张只管构图,比如中间留白,适合放标题
  3. 一张只管色彩,比如蓝灰系或者低饱和
  4. 反例图也可以有一张,明确不要赛博霓虹/过度科幻

这样 review 的时候也更容易说清楚问题:

另一个坑是不要每次生成都同时改所有东西。prompt 、参考图、比例、风格强度一起改,下一张变好了也不知道是哪个变量起作用。

比较稳的流程:

  1. 先固定用途,比如 blog header / hero image / social card
  2. 第一批只看构图
  3. 第二批只调风格强度
  4. 第三批放进真实布局里看

尤其是最后一步,单独看图和放进页面完全不是一回事。很多图在 gallery 里挺好看,一放到标题下面就发现主体被挡、颜色抢 CTA 、移动端裁切很难受。

所以我现在觉得 AI 图片生成不太像“写一个完美 prompt”,更像做一个小型视觉实验。文字、参考图、比例、布局预览,每个变量分开测,比堆形容词靠谱很多。

有做设计/前端的朋友也这么用参考图吗?你们一般怎么避免每批图风格飘太远?

1116 次点击
所在节点    程序员
2 条回复
lovekernel
7 月 20 日
做“参考图”素材会不会是一个赛道?做出能让模型快速识别的构图、风格强度等各类别的素材。
383394544
7 月 20 日
AI 画图都是套模版排列组合,给参考图相当于给模型提供训练数据以外的模版。

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://v2ex.ih06.com/t/1228630

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX