Midjourney角色一致性控制方法(Cref)详解
近期,Stable Diffusion的强劲对手Midjourney发布了控制人物一致性的解决方案。控制人物一致性为何重要?当我们希望将AI绘画应用于实际工作场景——例如创作插画、绘本、剧本或短视频剧集时,主角形象在多张图像中保持连贯性就成为关键需求。事实上,当前已涌现出不少AI虚拟博主,其账号主角均依托高度一致的AI生成人物形象,在平台上获得了广泛关注。
接下来,我将通过两个案例进行讲解:人物图与产品图。
我的初始提示词大致如下:冬天背景,天空飘雪;主角为一名男性,呈现不同姿势与表情,风格为中国古代电影风;他有黑色长发,双眼蒙着一条白色布条(但实际出图未体现该细节);身着深蓝色服饰,配黑棕色腰带,手持一把剑;背景为瀑布,身旁环绕松树;整体风格参考张艺谋导演的影像美学。
基于该提示生成了四张图。后续使用的后缀是我常用的参数组合。如对相关参数不熟悉,可参考此前发布的入门教程视频。
其中第四张图最符合预期,于是我执行U4操作下载该图,并复制其图片链接。随后在新提示中加入--image-control v[图片链接],再附上文字描述,即可基于原图生成相似风格的新图像。
现在进入本次重点:序列作图(Cref)方法。
首先需获取满意图像的C值(Control ID)。若对C值生成方式不熟悉,可回顾此前入门视频中关于“信封”参数的说明,系统会自动发送对应C值。获取后,将其复制备用。
将C值粘贴至新提示中,格式为--c [C值](注意:C为大写,冒号需删除,仅保留空格分隔)。该C值即为图像的编码ID,能显著提升生成图像的角色一致性。
以本例为例,提示词主体不变:“冬天,天空飘雪,帅气男性角色,多种姿势和表情,中国古代电影风格”。唯一调整是在武器描述处使用英文括号标注微调项:(sword, dagger, knife),表示对三种武器进行差异化尝试。
由于输入法限制难以直接输入大括号,此处采用手动复制方式完成。同时添加图像比例参数--ar 3:4,并将前述C值正确填入--c后方。
特别注意格式规范:C必须大写,中间不可含冒号,仅用空格连接C值。若误复制冒号或小写字母,系统将无法识别。
确认无误后发送指令,系统会提示是否生成三组图像,选择“Yes”即可同时输出三组结果。这三组图像均以原始提示为核心,仅在指定元素(如武器)上做细微变化。
观察生成结果:第一组出现猫,第二组则持刀而非剑(AI对冷兵器类型区分尚不精准,可通过更细致描述优化);但三组人物的整体面部特征、发型、服饰及氛围高度一致,从中可筛选出最符合预期的若干张作为后续延展基础。