Midjourney 垫图功能详解:如何上传与引用图片、控制相似度

midjourney中文站 2026-07-26 13:34:51

在 Midjourney 创作中,我们常面临一个核心需求:在保留参考图独特风格的前提下,不改变或替换其主体内容。这一操作即为“垫图”(Image Prompting),指将一张已有图片作为视觉参考输入模型,引导其生成风格或构图高度相似的新图像。

垫图本质上是一种视觉提示(Image Prompt),其作用类似于文本提示词(Text Prompt),但传递的是图像信息而非文字描述。Midjourney 提供四种主流垫图方式:

  1. 基于生成图编号复用(--seed):先让 Midjourney 生成一张图,再通过其唯一编号(Seed)配合 --s 参数生成风格一致的变体。此方式依赖模型内部随机种子,需启用 --v 5.2 或更高版本,并使用 --seed [编号] 指令。
  2. 图像分析提取关键词(/describe):在 Discord 中使用 /describe 命令上传图片,Midjourney 将自动分析并返回 4 组文本描述。用户可选取其中一组或组合优化后作为文本提示重新生成图像。
  3. 直接上传图片引用(Image Prompt):将本地图片拖入 Discord 输入框,或通过“+”号上传。上传成功后,需在 /imagine 命令中引用该图链接,并配合 --iw(Image Weight)参数调节其影响权重。
  4. 多图融合生成(Blend):使用 /blend 命令一次性上传最多 5 张图片,模型将尝试融合其视觉特征生成新图。该方式结果较难精准控制,适用于创意探索场景。

--seed 需配合特定参数外,其余三种方式均通过在 /imagine 命令中插入图片链接实现。以下为具体操作流程:

上传图片方法

  • 拖拽上传(推荐):选中桌面图片文件,直接拖入 Discord 对话框,按回车键等待上传完成。
  • 点击上传:点击输入框旁的“+”号 → “上传文件” → 选择单张或多张图片(Windows 按住 Ctrl,macOS 按住 Cmd 多选)→ 点击“打开” → 回车确认。

引用图片方法

上传成功后,图片将以链接形式显示在对话中。引用时需注意以下要点:

  • 必须使用英文输入法下的斜杠 / 开头,输入 /imagine 后,将图片链接拖入命令行;
  • Midjourney 要求至少引用两张图片(或一张图片 + 一段文本提示)才能识别为有效图像提示;
  • 若仅粘贴一张图片链接,系统会提示“Invalid parameter”;
  • 多图之间必须用空格分隔,不可连写;
  • 支持混合引用:一张图片链接 + 文本提示(如 a cat),同样需以空格分隔。

此外,还可通过以下方式获取并复用图片链接:

  • 点击已上传图片 → “在浏览器中打开” → 复制地址栏 URL;
  • 安装官方 Discord 客户端 → 点击图片右下角“复制链接”按钮;
  • 将复制的链接粘贴至 /imagine 命令中,与其他元素以空格分隔即可。

理解 Prompt 的构成

Midjourney 中的 prompt 并非仅指“提示词”,而是包含两类输入:

  • Image Prompt(图像提示):即上传的图片链接,本质是以 URL 形式嵌入的视觉参考;
  • Text Prompt(文本提示):即用户输入的描述性文字(如 a cat),用于补充语义或修正方向。

官方文档明确区分二者,因此将 prompt 统一译为“提示词”并不准确。更严谨的说法是:“图像提示”与“文本提示”。值得注意的是,Midjourney 的图像提示字段为复数形式(image prompts),这也印证了其设计逻辑——需至少两张图或“图+文”组合才能激活图像引导机制。

控制垫图相似度:--iw 参数详解

通过 --iw(Image Weight)参数可调节图像提示对最终输出的影响强度,取值范围为 0–2,支持小数(如 0.251.5):

  • 数值越低(如 --iw 0.25),模型越倾向遵循文本提示,图像参考影响较弱;
  • 数值越高(如 --iw 2),输出越贴近所引用图片的整体风格、色彩与构图;
  • 书写规范:小于 1 的数值可省略前导零(如 .25 等同于 0.25),大于等于 1 的数值不可省略(1.25 不可写作 .25)。

需特别注意:图像提示与文本提示始终共同作用。当二者存在冲突(如图片为猫、文本为“a dog”)时,