最近给一个图像生成相关页面做测试,发现自己很容易陷进一个坑:图不对,就继续往 prompt 里加词。
比如一开始是:
modern editorial image, clean, premium, cinematic, minimal
然后发现不对,又开始补:
not too futuristic, not too dark, clean but not empty, premium but not luxury
写到最后,prompt 已经不像需求了,更像在跟模型讨价还价。
我测试的页面是这个: https://krea2.io/
主要是拿它试 reference image / image-to-image 这类控制方式,不是说这个站一定比别的强。
这次比较有用的经验是:文字适合描述“画什么”,参考图更适合描述“怎么看起来”。
我现在一般会先把参考图拆成几个职责:
- 一张只管光线,比如明亮、柔和、偏 editorial
- 一张只管构图,比如中间留白,适合放标题
- 一张只管色彩,比如蓝灰系或者低饱和
- 反例图也可以有一张,明确不要赛博霓虹/过度科幻
这样 review 的时候也更容易说清楚问题:
- 这张构图对,但颜色不对
- 这张颜色对,但主体太靠边,移动端会裁掉
- 这张单看不错,但放到 landing page hero 里太吵
另一个坑是不要每次生成都同时改所有东西。prompt 、参考图、比例、风格强度一起改,下一张变好了也不知道是哪个变量起作用。
比较稳的流程:
- 先固定用途,比如 blog header / hero image / social card
- 第一批只看构图
- 第二批只调风格强度
- 第三批放进真实布局里看
尤其是最后一步,单独看图和放进页面完全不是一回事。很多图在 gallery 里挺好看,一放到标题下面就发现主体被挡、颜色抢 CTA 、移动端裁切很难受。
所以我现在觉得 AI 图片生成不太像“写一个完美 prompt”,更像做一个小型视觉实验。文字、参考图、比例、布局预览,每个变量分开测,比堆形容词靠谱很多。
有做设计/前端的朋友也这么用参考图吗?你们一般怎么避免每批图风格飘太远?