最近给一个图像生成相关页面做测试,发现自己很容易陷进一个坑:图不对,就继续往 prompt 里加词。
比如一开始是:
modern editorial image, clean, premium, cinematic, minimal
然后发现不对,又开始补:
not too futuristic, not too dark, clean but not empty, premium but not luxury
写到最后,prompt 已经不像需求了,更像在跟模型讨价还价。
我测试的页面是这个: https://krea2.io/
主要是拿它试 reference image / image-to-image 这类控制方式,不是说这个站一定比别的强。
这次比较有用的经验是:文字适合描述“画什么”,参考图更适合描述“怎么看起来”。
我现在一般会先把参考图拆成几个职责:
这样 review 的时候也更容易说清楚问题:
另一个坑是不要每次生成都同时改所有东西。prompt 、参考图、比例、风格强度一起改,下一张变好了也不知道是哪个变量起作用。
比较稳的流程:
尤其是最后一步,单独看图和放进页面完全不是一回事。很多图在 gallery 里挺好看,一放到标题下面就发现主体被挡、颜色抢 CTA 、移动端裁切很难受。
所以我现在觉得 AI 图片生成不太像“写一个完美 prompt”,更像做一个小型视觉实验。文字、参考图、比例、布局预览,每个变量分开测,比堆形容词靠谱很多。
有做设计/前端的朋友也这么用参考图吗?你们一般怎么避免每批图风格飘太远?
这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。
V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。
V2EX is a community of developers, designers and creative people.