空着提示词框发呆,是很多人第一次打开 AI 绘画工具时的真实状态。心里明明有一张图:傍晚的天台,一只橘猫趴在栏杆上,远处的霓虹刚刚亮起。落到输入框里却只剩一句"一只猫在屋顶",出来的画面平淡得像随手拍的游客照。问题不在工具,而在你没把画面翻译成它能读懂的语言。好在这件事现在可以请另一个 AI 帮忙。

为什么心里有画面,笔下没词

Midjourney 这类工具不读心,它只认描述:主体长什么样、在什么环境、什么光线、什么风格、什么构图。缺一块,它就自己补一块,补出来的往往不是你想要的。而新手最容易缺的恰恰是词汇——"氛围感""高级感"这类评价词,AI 是听不懂的,它需要的是"暖黄色的串灯""浅景深""水彩颗粒感"这种能落成画面的具体描述。

把模糊想法扩写成这种描述,正是 ChatGPT 这类对话工具擅长的事:它不需要会画画,只需要会"说画"。

让对话工具当翻译,怎么交代才好用

直接扔一句"帮我写个 Midjourney 提示词",得到的结果通常也很平庸。好用的交代方式分三步。第一,给它定角色和格式:告诉它"你是提示词助手,只输出英文提示词,按主体、动作、场景、光线、风格、构图分块组织"。第二,把你的想法尽量说具体,也说明用途——电商主图和社交媒体配图,合适的画幅和画风完全不同。第三,让它先提问再动笔,比如"先问我三个问题再写",它问出来的往往正是你会漏掉的细节:几点钟的光?镜头离主体多远?背景要不要虚化?

拿到结果别直接用,先检查有没有堆砌。提示词不是越长越好,官方文档明确提示过,冗长杂乱的描述反而会稀释重点。

一次要三个版本,改一处发一次

对话工具最大的优势是可以"批发"。同一个想法,可以让它分别按"写实摄影感""扁平插画感""3D 渲染感"各出一版,三版同时丢进 Midjourney 对比,比反复改一句高效得多。出图后如果方向对了但味道不对,回到对话里只改一个变量:换光线、换镜头距离或换配色,一次只动一处,你才能知道到底是哪个词在起作用。这和练手绘时"控制变量练线条"是同一个道理。

反过来用:从一张图倒推提示词

看到别人的图很喜欢,却说不出它好在哪?Midjourney 自带的 Describe 功能就是为此设计的:把图片拖进去,它会给出四条可能生成类似画面的提示词。官方文档特别说明,这四条不会精确复现原图,更像四份"看图说话"式的灵感草稿;同一张图刷新一次就换一套建议。真正有用的用法不是照抄,而是对照原图读这四条描述,看它用什么词概括了光线、材质和构图——这是积累描述词汇最快的方式之一。

这套课程里有什么

这份《且曼AI智能绘画Midjourney》共十二节课,主题从前期搭建工具、关键词获取、提示词框架与图生图,讲到 Seed 的多种用法、品牌 IP 形象与三视图,第十二课的主题正是 ChatGPT 联动 Midjourney,与本文内容互相呼应。文件按课程编号排列,另附有关键词实用工具的下载说明。

当然,"联动"不是让 AI 替你审美。描述词可以批发,判断力只能自己练——每一版图出来,说得出哪里好、哪里不对,下一轮才改得动。让对话工具负责词汇量,你负责挑出那张对的图,这才是两个 AI 协作时人该站的位置。