生成图片不一致时,最直觉的动作通常是继续改提示词。再加几个形容词,补上相机、镜头、光线、色彩情绪和参考风格。某一张图可能真的变好了,可下一张又往另一个方向漂,于是提示词继续变长。
问题通常不是提示词里的字还不够多。提示词描述的是一张图片,产品需要的却是一套视觉系统。这套系统要让不同主题、不同尺寸、不同页面里的许多图片,看上去仍然属于同一个世界。
提示词优化的是单次输出
提示词很擅长描述局部意图,它可以要求近距离裁切、硬朗侧光、安静背景,或者克制的色彩。可一致性存在于关系里。主体在画面中应该有多大?哪些颜色承担信息含义?允许多少纹理?什么东西绝不能出现?哪些变化能让系列更丰富,哪些变化会直接破坏身份?
把这些要求全部塞进每一次提示词,会形成一套很脆弱的仪式。不同的人强调不同句子,模型也不会平均理解一大段指令。后来增加的一条规则,可能修好一个症状,同时悄悄改变另外三个属性。团队拥有很多文字,却没有一套共同判断结果的方法。
更好的提示词可以改善一张图,视觉圣经改善的是每一张图背后的决定。
视觉圣经把品味变成约束
有用的视觉圣经,不是一页摆满漂亮参考图的情绪板。它是一套紧凑的决策系统,说明反复出现的构图方式、颜色角色、光线逻辑、材质、字体关系、素材类别,以及明确的反例。它还应该展示边界附近的例子,而不只是最完美的中心答案。
反例尤其重要,因为生成系统太擅长生产一种看起来合理的漂亮。没有边界时,每张图单独看都很精致,放在一起却越来越不像一个系列。明确不要亮面渐变、不要悬浮玻璃物体、不要电影式虚化,可能比再写一段应该添加什么更能保护视觉身份。
这套结构会直接改变审核方式。团队不再只争论这张图感觉对不对,而是能找到关系在哪里断了。构图可能正确,材质却不对。颜色可能符合,素材承担的角色却错了。反馈之所以能够复用,是因为它更新了一条规则,而不是只修补一个结果。
一致并不等于相同
视觉圣经不应该把生成变成模板流水线。好的系统定义稳定的语法,同时允许表达在里面变化。主体、裁切、节奏和隐喻都可以不同,只要更深层的关系仍然能够被认出来。它更像一本编辑杂志,每个跨页都不一样,却没有哪一页像从别的出版物里借来的。
实际工作流并不复杂。在扩大生成以前先定义视觉圣经。先生成一小组素材,故意测试规则的边界。审核时把整组图片放在一起,而不是一张张孤立评价。出现漂移以后,更新共享规则,只重做真正受到这条规则影响的内容。
提示词当然仍然重要,它负责让一张具体图片进入系统。但让一条提示词承担完整视觉身份,就像让一句话替代艺术指导。真正可以规模化的资产,不是最长的指令,而是一套共享视觉判断,让更短的指令也能稳定工作。
