如何在 Mj 中创建一致的角色
Midjourney 是一个生成式AI绘图工具,可以帮助您创建各种类型的图像,包括角色设计。但是,如何在 Midjourney 中创建一致的角色呢?这是一个挑战,因为使用生成式AI工具时,要让您的图像保持一致并不容易,但是有了正确的过程,您就可以实现您想要的结果。这可能会让一些初学者感到困惑,但是只要您按照正确的步骤进行操作,您就可以轻松地实现您想要的结果。
在这篇文章中,我将指导您如何在 Midjourney V5 中创建一致的角色。
我们将使用肖像作为示例,但这种技术适用于卡通、产品、插图,只要你能想到。请记住,这只是其中一种方法。
给角色起个名 Alice,这是接下来我们测试的基准模型。

我们先聊点基础的
Midjourney 是一种 AI 扩散模型,它使用关于您希望 AI 生成的内容的人工书面提示(描述),从噪音中创建图像。
在微调或训练您自己的模型时,Midjourney 不像 Stable Diffusion。您不能在 Midjourney 上训练模型并将其用于特定需求。
使用 Stable Diffusion 创建一致的角色要简单得多。但我们来这里是为了看看 Midjourney 能做什么。
在 Midjourney 中,我们可以使用所谓的“图像提示”。这是一种技术,我们使用图像作为提示的灵感来源。这并不是针对 Midjourney 的训练,而是像ChatGPT中的“few shot prompting”一样工作,您可以提示您想要的内容或样式,Midjourne y 在生成输出时将以此为灵感来源。
Midjourneys 自己的文档,这是图像提示的样子。

要使图像提示正常工作,您需要存在于 Internet 上的图像,如果图像存在于 discords CDN 上则更好。要将图像放入 discord,您只需将它们上传到 discord 并获取 URL 并粘贴到您的提示中。
我们通过这种办法把图像上传到 DIscord 上:

Midjourney 命令快速指南
快速查找功能和指令 。它应该涵盖了常用的基本内容和一些高级参数。

在本示例中,我们将以人像为参考
所以当涉及到在 Midjourney 中重新创建真实人物的照片时,我不得不退后一步,看看周围有什么。我们发现插画师在创造角色和特别是脸部时的工作方式。他们创建这些表格,脸部的多个角度变成角色的蓝图。这样,当他们画出新场景时,他们就有了参考艺术品。这就是我们认为 Midjourney 在幕后处理图像提示和参考保留时所做的事情。
在人脸训练 Stable Diffusion 模型时,这很相似,你想要高质量的训练数据。因此,如果您正在使用 Stable Diffusion 进行训练,这种技术也可能会改进您的模型。
人物插图参考人物

第 1 步 - 让我们生成一个人像
人像的生成方式有很多种,我就用这种方式,大家可以自行修改。
我演示的所有提示都将使用最新版本的 V5 版本,所以我在这里没有使用任何参数(—v 5 —q 2 等),只是将提示直接写入 Midjourney 机器人。
street style photo of a beautiful girl, shot on Kodak Gold 200
我们最初的模型集

一旦我们有了我们的初始模型,我们就会选择一个,我选择了 3 号。这是我们的 gen0。
如果你想尝试不同的风格,你也可以试试这个提示。
studio style photo of a woman light background shot on Kodak Gold 200

第 2 步 - 提高品质并扩大规模
所以现在我们做了一个选择,我们使用 U 放大,并确保我们的放大看起来清晰,我们不希望图像中有任何主要的伪影。选择一张最理想的。

接下来,我们想要这个图像的种子编号,只需用字母表情符号回复“信封”,你就应该得到种子编号。


现在我们要获取初始图像 URL 和种子短语并制作一个新提示。

我们将从 Discord 中获取图像 URL,右键单击并选择复制图像地址。

在此提示中,我们将使用图像 URL + 文字提示 + seed编号,但这次我们想要侧视图或侧面照片 + 初始种子。
street style photo of a woman, side view, shot on Kodak Gold 200--seed 15847958

我们可以根据需要多次运行此程序,直到获得 1-2 张左右侧面图或侧角视图的图像。当拥有与最初的人最相似的人时,我们会对他们进行放大下载。


此时,我们至少应该有3张照片或更多:
- 正视图(1-2 张图片)
- 左侧视图(1-2 张图片)
- 右侧视图(1-2 张图片)
让我们拍下我们的图像并将其与新提示结合起来,让我们获得面部上方的角度。我们仍然想使用初始种子编号。确保重新生成直到满意为止,请记住我们希望获得尽可能接近现有选择的输出。

对下面的角度重复这个过程,记得我们一开始看的图片,我们要画出脸,正面,左侧,右侧,俯视,仰视,尽可能覆盖更多的角度。
第 3 步 - 结合前面所有内容
所以在这一点上,我们投入了 7 张以上的图像作为灵感基础,我们选择的所有图像都代表了面部的不同角度。我们的模特很可能会穿一件黄色夹克。因为我们所有的灵感图片都有黄色或金色夹克。现在我们不再添加 --seed 不需要它,我们不想再从相同的噪声模式开始。
举例:将五个垫图的url 全部放进去
https://s.mj.run/QgErFhEZUoIhttps://s.mj.run/Uye_O920a3o https://s.mj.run/GuZtFgd-OmM https://s.mj.run/c9FnKCREhAw https://s.mj.run/GgKYzh2ocYQ https://s.mj.run/Ijfd3ukNZi8 street style photo of a woman, shot on Kodak Gold 200 --v 5
正如我们在这里看到的,并非每张图片都很好,可能需要重新生成。然而,大多数时候有 2 个或更多可用的。

让我们放大第3张图片,在这里放一个 Midjourney 屏幕截图,这就是我们填充了之前各个视角的人像,从 Midjourney 得到的图。跟我们最初的基准模型还是很像的。

我们现在无需使用 seed 即可获得一致的模型。相反,MJ 正在使用上传的照片作为灵感。我们现在可以将其视为生成更多“Alices”的新基线。现在这是我们的 gen1。

第 4 步 - 将我们的模型放在不同的场景中
所以到目前为止,我们已经生成了 1:1 的图像,我们还没有使用纵横比或广角镜头。实际上,我们根本没有告诉 MJ 任何细节。
因此,让我们尝试将我们的模型放入工作室拍摄。我们会改变背景,镜头类型,试着让她微笑,改变灯光和电影类型。
通过移除一些对象,我们可以让它看起来更好

这是其中一个镜头

让我们试试别的。我们可以尝试穿上一些非常疯狂的衣服,这里是相同的提示,但颜色在粉红色和黄色之间变化。

我们可以把“Pink fluffy blowup dress 粉色蓬松充气裙”改成“LEGO dress”

有细心的伙伴可能会发现,为什么 Alice 不会笑,好吧,我们得到的 gen0 图片恰好是这种情况。但是通过一些小技巧和重新生成 ,可以让她微笑。通过将以下内容添加 smiling::5到提示中。
studio photo, white background, of a woman in a white outfit, ultra wide shot, full body, center view, smiling::5 studio lighting, shot on Fujifilm Pro 400H --ar 16:9

但,感觉她有点不想笑的样子。我们可以修改提示,并从中添加/减去,有时我们需要与 MJ 斗智斗勇,有时结果很好,有时也很糟。
第 5 步 - 尝试其他场景
这里我们开始有一些问题,她会开车吗?她可以去健身房吗?
因为最开始是从街头照片中制作了“灵感”图像,所以我们不断得到街头照片风格的照片。所以当我们想要制作其他类型的照片时,使用街头风格的照片可能效果不太理想。更好的方法是在训练图像时使用干净的白色背景。
无论如何,让我们看看目前能得到什么。
我们先让她成为一名赛车手,不指定使用或不使用头盔。
A woman driving a car, a woman sitting in the driver seat holding the steering wheel, wearing a racing outfit, and wears a white balaclava, ultra-wide shot from outside the car, center view, shot on Fujifilm Pro 400H --ar 16:9

让我们把模特放在太空舱里。现在我们看到了使用街头风格照片作为灵感的缺点。背景都是街道,我们可以尝试提示绕过它。
A woman in a space suit, wearing a helmet, a woman sitting in a space capsule, ultra-wide shot on the interior of the capsule, center view, HDR, crisp shot on ARRI --ar 16:9

.我们设法通过在提示中添加“星际空间背景”来删除一些“街道”背景。
A woman in a white space suit with red details, wearing a helmet :: a woman sitting in a space capsule, ultra-wide shot on the interior of the capsule, center view, HDR, crisp shot on ARRI, interstellar space background --ar 16:9

indoor::3 studio photo of a woman in a pink fluffy blowup dress, ultra wide shot, full body, center view, smiling:5 studio lighting, shot on Fujifilm Pro 400H --ar 9:16

到这里是不是发现 MJ 真是太棒了,我认为仅此一项就非常强大。我可以使用 gen0 图像并进行附加提示,并使用 --seed 生成更多风格的 Alice 并重复这些步骤以获得 gen1 和基线。然后可以为不同的用例提供不同的灵感图像组合。
换为黄色
indoor::3 studio photo of a woman in a yellow fluffy blowup dress, smoke, fog, ultra wide shot, full body, center view, smiling:5 studio lighting, shot on Fujifilm Pro 400H --ar 9:16

再来一组雪地照
street style photo of a woman in a silver dress, in a snowy desert, ultra wide shot, 80mm, f2.0, center view, natural lighting, aurora borealis, shot on Agfa Vista Plus 200 --ar 9:16

结论
完全有可能使用这种技术来获得极其一致的角色,修改它们并将它们放置在不同的环境中。你也可以探索使用或不使用 --seed 编号。
我觉得这种技术类似于使用 ChatGPT 的提示技术,其中你的灵感图片作为你想要的先决条件。提示词决定了图的理想状态和质量。
收获
不要使用“街头风格”照片来创建您的灵感图像集。相反,创建一张更自然的肖像,然后创建中性姿势和图像。会让背景更容易去符合场景。
studio-style photo of a woman white background shot on Kodak Gold 200
使用 Kodak Gold 200 拍摄的干净背景女性工作室风格照片

Midjourney 不像 Stable Diffusion。如果想要基于一个模型或自己的一致角色输出,还是得使用 Stable Diffusion 自定义模型来输出。