记录一下:AI 图片 prompt 越写越长,不如先把参考图的职责拆清楚

发布于

最近给一个图像生成相关页面做测试,发现自己很容易陷进一个坑:图不对,就继续往 prompt 里加词。

比如一开始是:

```text
modern editorial image, clean, premium, cinematic, minimal
```

然后发现不对,又开始补:

```text
not too futuristic, not too dark, clean but not empty, premium but not luxury
```

写到最后,prompt 已经不像需求了,更像在跟模型讨价还价。

我测试的页面是这个:[https://krea2.io/](https://krea2.io/)
主要是拿它试 reference image / image-to-image 这类控制方式,不是说这个站一定比别的强。

这次比较有用的经验是:文字适合描述“画什么”,参考图更适合描述“怎么看起来”。

我现在一般会先把参考图拆成几个职责:

1. 一张只管光线,比如明亮、柔和、偏 editorial
2. 一张只管构图,比如中间留白,适合放标题
3. 一张只管色彩,比如蓝灰系或者低饱和
4. 反例图也可以有一张,明确不要赛博霓虹/过度科幻

这样 review 的时候也更容易说清楚问题:

- 这张构图对,但颜色不对
- 这张颜色对,但主体太靠边,移动端会裁掉
- 这张单看不错,但放到 landing page hero 里太吵

另一个坑是不要每次生成都同时改所有东西。prompt、参考图、比例、风格强度一起改,下一张变好了也不知道是哪个变量起作用。

比较稳的流程:

1. 先固定用途,比如 blog header / hero image / social card
2. 第一批只看构图
3. 第二批只调风格强度
4. 第三批放进真实布局里看

尤其是最后一步,单独看图和放进页面完全不是一回事。很多图在 gallery 里挺好看,一放到标题下面就发现主体被挡、颜色抢 CTA、移动端裁切很难受。

所以我现在觉得 AI 图片生成不太像“写一个完美 prompt”,更像做一个小型视觉实验。文字、参考图、比例、布局预览,每个变量分开测,比堆形容词靠谱很多。

有做设计/前端的朋友也这么用参考图吗?你们一般怎么避免每批图风格飘太远?

---

原文链接:[点击查看](https://www.v2ex.com/t/1228630)

评论(3)

感觉专门做这种“参考图”素材包能成为一个新赛道?比如整理出一批专门用来控制构图、风格强度的图,让模型能秒懂。

· 0 个赞

AI 画图本质上就是套模板排列组合吧。喂参考图其实就是给模型提供训练集之外的现成模板,让它去抄。

· 0 个赞

做“参考图”素材可能是一个不错的方向,可以试试制作一些能够帮助模型快速识别的构图、风格强度等类型的素材哦。

· 0 个赞