很多人刚开始用 Midjourney 时都有类似经历:明明把别人分享的关键词原样复制进去,出来的图却和原图差了一大截;自己随便改两个词,画面又完全跑偏。问题多半不在于词不够多,而在于不知道这些词各自负责什么。把关键词的组织方式想清楚,出图的稳定度会明显不一样。
一套关键词里,谁管什么
一条能用的 Midjourney 指令,通常按"主体—场景—风格—参数"来分层。主体说清楚画什么、什么姿态;场景负责环境、光线和时间氛围;风格决定整张图的气质,比如水彩、赛博朋克、莫奈式的油画笔触;最后用参数收尾,控制画幅和风格化强度。Midjourney 对英文描述的理解最稳定,中文想法最好先翻成简洁的英文再输入。长度上不必贪多,二三十个英文单词左右的描述往往比堆满形容词更可控,概念一多,画面焦点反而散。
--s、--c、--no 三个参数的分工
这三个参数出镜率最高,也最容易混。--stylize(--s)控制画面的艺术化程度,取值 0 到 1000,默认 100:调低更贴着你的文字走,调高则让模型自由发挥,画面更有"艺术感"但可能偏离描述。--chaos(--c)控制同一批四张图之间差多远,取值 0 到 100:想要稳定复现就用低值,想多看几种完全不同的方向可以试着拉高。--no 用来排除不想要的元素,比如 --no text 可以减少画面里的乱码文字。
有一个新手常踩的坑:直接在描述里写"不要出现文字""画面里没有路人",这类否定句式经常适得其反,模型反而把被否定的东西画了出来。不想要的元素应该交给 --no,而不是写进正向描述里。
还有一件容易被忽略的事:画幅。默认生成的正方形图未必符合用途,做壁纸要竖版、做封面要横版,这些都可以用 --ar 参数直接指定,比如 --ar 9:16 对应竖屏,--ar 16:9 对应宽幅。与其生成之后再裁剪,不如一开始就按最终用途选好比例,构图也会跟着比例更合理。
权重微调:让画面偏向你真正想要的
如果画面里有两个以上的重点,可以用双冒号给不同部分分配权重,比如"城堡::3 天空::1",城堡就会比天空更主导。搭配参考图时,--iw 决定图片和文字各占多少分量。
风格词不太可能靠自己凭空想全,更现实的积累方式是反向拆解:看到喜欢的图,先猜它是哪个画种、什么光线、什么年代质感,再去核对他的关键词,比对自己缺了哪一层。积累十来次之后,你就会有一组自己用顺手的风格词,比收藏别人的长列表有用得多。
这些微调不用一开始就全用上,更实际的做法是:找到一张接近目标的成图,对着它的关键词一次只改一处——换个光线词、调一个参数——再对比两次结果。改动多了,就说不清是哪一处起了作用。
一份按题材整理的关键词库,用起来是什么样
如果打算照这个思路多练,手边有一批"成图+对应关键词"的参考会很省事。这份 Midjourney 关键词资料就是按题材组织的:风景系列、十二生肖(铠甲、唐装、汉服等几种造型方向)、动物类、婚纱系列,以及一个"多种类型系列"收纳混合题材;风格向的文件里有莫奈风格、赛博朋克、星空极光这类主题表。文件多为表格和文档,部分体积很大,从目录来看应该是关键词条目配上了对应成图。顶层还单独放了"--s 和 --c 的运用""--no 指令的作用""如何添加权重"几张参数教学图,可以先看这几张再翻表。
