在 Midjourney 创作中,我们常面临一个核心需求:在保留参考图独特风格的前提下,不改变或替换其主体内容。这一操作即为“垫图”(Image Prompting),指将一张已有图片作为视觉参考输入模型,引导其生成风格或构图高度相似的新图像。
垫图本质上是一种视觉提示(Image Prompt),其作用类似于文本提示词(Text Prompt),但传递的是图像信息而非文字描述。Midjourney 提供四种主流垫图方式:
--s 参数生成风格一致的变体。此方式依赖模型内部随机种子,需启用 --v 5.2 或更高版本,并使用 --seed [编号] 指令。/describe 命令上传图片,Midjourney 将自动分析并返回 4 组文本描述。用户可选取其中一组或组合优化后作为文本提示重新生成图像。/imagine 命令中引用该图链接,并配合 --iw(Image Weight)参数调节其影响权重。/blend 命令一次性上传最多 5 张图片,模型将尝试融合其视觉特征生成新图。该方式结果较难精准控制,适用于创意探索场景。除 --seed 需配合特定参数外,其余三种方式均通过在 /imagine 命令中插入图片链接实现。以下为具体操作流程:
Ctrl,macOS 按住 Cmd 多选)→ 点击“打开” → 回车确认。上传成功后,图片将以链接形式显示在对话中。引用时需注意以下要点:
/ 开头,输入 /imagine 后,将图片链接拖入命令行;a cat),同样需以空格分隔。此外,还可通过以下方式获取并复用图片链接:
/imagine 命令中,与其他元素以空格分隔即可。Midjourney 中的 prompt 并非仅指“提示词”,而是包含两类输入:
a cat),用于补充语义或修正方向。官方文档明确区分二者,因此将 prompt 统一译为“提示词”并不准确。更严谨的说法是:“图像提示”与“文本提示”。值得注意的是,Midjourney 的图像提示字段为复数形式(image prompts),这也印证了其设计逻辑——需至少两张图或“图+文”组合才能激活图像引导机制。
通过 --iw(Image Weight)参数可调节图像提示对最终输出的影响强度,取值范围为 0–2,支持小数(如 0.25、1.5):
--iw 0.25),模型越倾向遵循文本提示,图像参考影响较弱;--iw 2),输出越贴近所引用图片的整体风格、色彩与构图;.25 等同于 0.25),大于等于 1 的数值不可省略(1.25 不可写作 .25)。需特别注意:图像提示与文本提示始终共同作用。当二者存在冲突(如图片为猫、文本为“a dog”)时,