
简介面向零基础用户的Midjourney AI绘图入门教程以docx文档形式系统讲解从注册Discord账号到正式使用Midjourney绘图的完整操作流程。教程先从Discord与Midjourney的关系入手解释Midjourney没有独立客户端、需要搭载在Discord中使用的基本逻辑再逐步演示账号注册时的出生日期选择、邮箱验证、人机验证、个人服务器创建等细节并提示共享账号官方认可、可放心使用。随后详细介绍如何查找并加入Midjourney官方服务器包括再次人机验证等易出错环节同时补充说明Midjourney服务器的主要功能与AI绘图技术基础。内容紧扣实际操作中的常见问题适合希望快速上手AI绘画、对海外平台不熟悉的读者。资源为单个Word文档8.3MB格式清晰便于阅读、打印或对照操作。已有721人学习下载教程步骤完整且配有说明零基础用户也能顺利搭建绘图环境开启AI绘图之旅。1. 从一句描述到一张可用图Midjourney 到底帮你省了什么你大概已经见过那些让“甲方看了沉默、同行看了流泪”的 AI 绘图作品也听人说过 Midjourney 只要输入几个英文单词就能生成海报级画面。但真到自己上手时大概率会遇到这些情况出图风格完全不受控、人脸崩坏、想要“赛博朋克城市”却得到一堆霓虹灯废土、想用自家产品图做底图却怎么都融合不进去。这些问题的根源往往不是工具不行而是你对 Midjourney 的工作方式和提示词语法缺一套系统认知。Midjourney 的本质不是“AI 画师”而是一台运行在 Discord 上的多模态生成引擎。它以文本提示词为输入通过扩散模型在潜空间迭代去噪最终输出 1024x1024 像素默认的位图。这个“输入一段文本 → 选择迭代方向 → 细化得到成品”的流程才是它和其他 AI 绘图工具最大的区别。本教程会从账户准备开始带你走完从注册、写提示词、控制参数到产出可用素材的全流程直接对着操作即可。2. Midjourney 运行环境与账户准备从零开始的第一条生成命令2.1 为什么 Midjourney 必须跑在 Discord 里Midjourney 没有独立客户端它所有的交互都在 Discord 服务器内完成通过斜杠命令Slash Command与机器人交互。这意味着你首先要有一个 Discord 账号然后把 Midjourney 机器人拉进你自己的服务器这样才能在私人频道里不受打扰地生成图片。这样做的好处在于Discord 的频道结构天然适合做团队协作。你可以建一个“设计评审”频道把 Midjourney 机器人拉进去所有人共享同一个生成记录也可以建多个频道分别跑“人物设定”“场景概念”“材质测试”每个频道拥有独立的生成历史。这种工作流对个人创作者和设计团队都适用。2.2 注册与订阅没有付费版基本没法用Midjourney 提供免费试用额度但额度非常少大约 25 次生成而且生成速度极慢排队现象严重。因此实际使用时通常需要订阅。订阅入口在https://www.midjourney.com/account或直接在 Discord 里输入/subscribe这个命令会返回一个带链接的消息点击进入订阅页面。Midjourney 提供三档 PlanBasic10 美元/月约 200 张图/月、Standard30 美元/月无限慢速生成 15 小时快速生成、Pro60 美元/月更高并发与隐私模式。对于重度使用者Standard 是性价比最高的选择。提示常有用户问“Midjourney 促销码怎么获得”。官方会不定期在社交媒体和邮件推送优惠但第三方渠道发布的促销码来源不明不建议使用——轻则订阅失败重则账号被标记风险。直接在官网订阅最稳妥。2.3 最小可用命令imagine 与 U/V 操作完成订阅后在 Discord 中输入/imagine prompt: a red apple on a wooden table, soft lighting回车后机器人会返回 4 张网格图。这 4 张图下方有两行按钮U1~U4Upscale放大对应编号的图V1~V4Variation以对应图为基础生成变体第一次跑通这个流程你的 Midjourney 使用就算入门了。接下来我们要做的是把你从“能出图”提升到“能稳定出想要的图”。提示如果提示Invalid parameter检查/imagine是否被识别为命令而非普通文本。在 Discord 里输入斜杠/后会自动弹出命令列表选择imagine再输入prompt:即可。3. 提示词结构拆解写出一段能稳定出图的 prompt3.1 提示词的五个基础要素Midjourney 的提示词不是自然语言作文而是“要素的排列组合”。经过大量测试业内形成了一个相对稳定的结构要素作用示例主体画面核心对象a red fox环境场景与背景in a snowy forest光照光影氛围golden hour lighting材质/风格渲染质感octane render, cinematic构图视角与镜头close-up shot, shallow depth of field实践中最容易犯的错误是“一句话场景式描述”把提示词写成一整段散文。正确做法是把要素用逗号分隔每个词组独立可替换这样便于后续做 A/B 测试。以“一只穿着宇航服的柴犬”为例拆分写法如下/imagine prompt: a shiba inu wearing a spacesuit, standing on the moon, earth in the background, cinematic lighting, volumetric fog, ultra detailed --ar 16:9这里--ar 16:9是比例参数指定输出横屏宽幅。逐项来看主体是shiba inu wearing a spacesuit环境是moon与earth in background光照是cinematic lighting加volumetric fog风格强调是ultra detailed。这种写法比“一只狗在月球上穿着宇航服”清晰得多出图的可控性也随之提升。3.2 风格修饰词与权重控制在 Midjourney v6 中提示词末尾的艺术风格词对结果的影响非常大。常见的有效风格词包括cinematic电影感强调光影对比editorial photography杂志摄影感构图精致isometric等距视角适合 UI 图标和建筑示意3d render, pixar style三维渲染圆润可爱watercolor水彩质感cyberpunk赛博朋克霓虹色调权重控制的核心语法是双冒号::。例如/imagine prompt: a futuristic city::2 cyberpunk style::1 blue tone::0.5 --ar 21:9这个提示词表示“未来城市”的权重为 2“赛博朋克风格”为 1“蓝色调”为 0.5。权重越高该要素对最终图像的影响越大。注意权重不能为负值v6 已移除.5以内的负权重功能通常 0.5 到 3 这个区间最有效。3.3 常见失败案例与修正策略第一类主体偏了。你写a cat and a dog结果画面里只有猫或比例失调。解决办法是把其中一个要素的权重调高a cat::2 and a dog::1或者直接拆分生成再合成。第二类风格模板化。如果你在提示词末尾加了一堆trending on artstation, 8k, hyperrealistic结果图反而显得油腻、像廉价壁纸。建议只保留 1~2 个风格词并且优先选择“可描述性”强的词如golden hour、long exposure而不是空泛的beautiful。第三类文字乱码。想让图中出现标语或品牌名时Midjourney 经常拼错。这不是你的问题——Midjourney 本身对文字生成的支持较弱。如果必须出带文字的图建议用--style rawv6 可用降低风格化干预或先生成无文字背景图再用 Photoshop 或 Figma 叠加文字。提示v6 版本默认对提示词有更强的理解力但仍建议把主体放置在提示词前 5 个词内——越靠前的词模型对其的权重越高。4. 进阶场景实战从 niji 模式到垫图与迭代参数4.1 niji 模式日本动漫与二次元风格如果你画的是日漫风、轻小说插画或者二次元角色通用的 v6 模型表现并不理想。此时需要切换到 niji 模式这是 Midjourney 专门针对动漫风格训练的子模型/settings在弹出的面板里选择Niji Mode或者直接在/imagine命令中添加--niji 6参数/imagine prompt: anime girl with silver hair, blue eyes, school uniform, cherry blossoms in background, soft pastel colors, detailed eyes --niji 6niji 模式在“眼睛细节”“头发层次”“线条干净度”上明显优于默认模型。它同样支持风格化参数例如--stylize 200表示更强的风格化表现适合让画面更华丽--stylize 50则更忠实于提示词本身的描述。4.2 垫图Image Prompt把参考图融入生成流程Midjourney 最强悍的能力之一是基于参考图生成新图。在提示词中图片链接必须放在最前面/imagine prompt: https://example.com/ref_image.jpg a cyberpunk character, similar composition, different outfit and hair color --ar 2:3图片链接的来源可以是网络图片也可以是之前生成的 Midjourney 结果。操作方式是在 Discord 中右键目标图片选择“复制链接”粘贴进 prompt。注意链接后必须紧跟文本描述不要留多余空行或符号。还有一种常见需求是“我想让 A 图的脸型搭配 B 图的服装”。这时可以传入两张图用权重区分/imagine prompt: imgA.jpg imgB.jpg a character, face from first image, clothing from second image, full body shot这里系统会自动融合两张图的信息文本提示词负责告诉模型“取谁的特征”。4.3 融合与变化Blend 命令如果不想写任何文字只想把两张图揉在一起可以用/blend这个命令会弹出两个图片上传框上传后直接输出混合结果。它适合快速尝试颜色、构图的融合但可控性比“垫图文本描述”弱很多。做正式项目时建议优先使用完整 prompt 方式。4.4 科研绘图场景中的 Midjourney 使用技巧“科研绘图 ai”这个词最近热度很高但很多科研工作者把 Midjourney 用错了方向。论文配图如示意图、流程图、机理图需要的是精确和可编辑而 Midjourney 生成的是位图难以直接用于论文出版的矢量图中。正确做法是用 Midjourney 生成概念参考图即你想要的画面构图、配色和氛围然后交给 PPT 或 Illustrator 手动绘制。提示词可以这么写/imagine prompt: schematic diagram of lithium battery charging process, isometric view, clean white background, blue and orange color scheme, minimalist 3d render style --no text --style raw关键参数是--no text消除图中文字干扰--style raw降低“艺术滤镜感”。这样出的图可以作为架构参考而不是直接投稿的最终图片。5. 常用参数全表与迭代策略让每一版都比上一版好5.1 参数速查表参数取值范围作用最佳实践--ar任意宽高比如16:9、2:3控制画面比例头像用1:1封面用16:9竖版海报用2:3或9:16--stylize0~1000v6控制艺术化程度默认 100要精确实体用 50要艺术氛围用 250--chaos0~100控制结果的多样性探索灵感用 50~80交付合规图用 0--seed随机整数固定初始噪声保证可复现同一 seed 同 prompt 出图结果趋同--no负向词排除特定元素--no text, watermark, people--tile无参数生成无缝纹理用于背景图、布料纹理、游戏素材--iw0.5~2.0v6控制参考图影响程度数值越高越忠于参考图无参考图时该参数失效5.2 seed 值的妙用稳定迭代的工作流你花了半小时调出一个 90% 满意的构图只是需要换个配色。此时随机碰运气效率太低正确做法是锁定 seed 后只修改关键词。/imagine prompt: a futuristic city skyline at sunset --ar 21:9 --seed 12345得到结果后记录满意的一张图的 seed 值接着微调/imagine prompt: a futuristic city skyline at night, neon lights --ar 21:9 --seed 12345同样的 seed 保证了初始噪声一致画面主体结构、构图基本相同只有你修改的“晚上霓虹灯”发生变化。这个流程在 icon 设计、分镜脚本、游戏场景迭代时极其好用。提示获取一张已生成图片的 seed 有几种方式。最简单的是在 Discord 消息上点击添加反应选择信封表情✉️机器人会私信你完整生成信息包括 seed 值、提示词和所有参数。5.3 Remix 模式变体不再是小修小补默认模式下点击 V1~V4 会在原图基础上做“同质化微调”比如改个表情、换个光影角度但很难大幅度改变内容。打开 Remix 模式后点击 V 按钮会允许你修改提示词从而实现真正的“换衣不换人、换景不换人”。打开 Remix 的方法/settings在弹出面板中找到Remix Mode并点击启用。之后每点一次 V1系统会弹出一个 prompt 编辑框你可以保留或重写提示词。比如原图是“穿红色裙子的女孩在咖啡厅”你可以把提示词改成“穿黑色皮衣的女孩在酒吧”构图和人物姿态会被保留但服装和环境完全更换。5.4 角色一致性方案固定人物脸型Midjourney 官方在 v6 中推出的角色一致性参数是--crefCharacter Reference/imagine prompt: a woman walking on the street, cinematic lighting --cref https://example.com/face_ref.jpg --cw 100--cw的范围是 0~100控制角色特征脸、发型、服装的保持程度。数值越低越只保留脸部特征数值高则连服装风格也想保持。不过要清醒认识它的边界--cref能保持“同一张脸”去做不同场景和动作但不能保证服装、细节高度一致。如果你需要严格的商品图级别一致性如同一模特穿三套衣服更可靠的是先生成一张干净的人像图再用 PS 换装或搭配--iw 2提高参考图权重。6. 从生成到落地放大、精修与常见问题的快速排查清单6.1 高清放大不是直接 U 就完了很多用户把 U 按钮理解为“高清化”实际上 U 只是增加了原始分辨率下的细节重绘。如果你想要海报级大图需要用 Midjourney 的外链到其他放大工具或利用/describe功能反推提示词后到其他平台去重绘。Midjourney 自带的放大命令是/upsample部分版本为/zoom或/custom_zoom其中/upsample 2x表示放大两倍并重构细节。注意放大后画面可能会丢失部分细节如果放大后脸部出现变形优先检查原图是否已足够清晰而不是反复放大同一张图。6.2 图生图的最佳接棒姿势Midjourney 生成的图默认有极高的“审美下限”但如果你要对细节做精确修改例如产品去logo、背景替换Midjourney 并不是这类任务的最优解。常见做法是你先用 Midjourney 出“创意底盘”然后在 SDStable Diffusion或 Photoshop配合 AI 填充里完成局部修图。对于大部分设计需求Midjourney 占 70% 的创意工作流剩下 30% 交给传统工具处理效率远高于在 Midjourney 里死磕局部修改。6.3 常用排错命令速查症状原因处理方法生成结果全是模糊艺术照提示词没有明确主体或风格词过多删掉至少一半风格词突出主体和构图词文字乱码或拼写错误Midjourney 对文字支持弱使用--no text排除文字后期用设计工具补字人脸结构崩坏、眼距异常可能是图片经过多次上采样检查 seed 是否丢失、图片是否被压缩回到干净的原始图重连生成速度极慢免费额度耗尽或处于慢速模式查看账户 Plan排队高峰时段国内 20:00~24:00慢速概率最高想要“类似这张图”的效果你没有描述参考图用/describe上传参考图让系统反推提示词后微调使用6.4 给常用工作流的一点点自动化建议如果你的使用频率很高建议把高频提示词片段存成“提示词模板块”例如环境模板golden hour, backlit, atmospheric haze 材质模板octane render, subsurface scattering, 8k texture 构图模板wide-angle shot, rule of thirds, negative space每次写提示词时直接拼接主体词环境模板材质模板比例参数。这种方式比每次从头写更稳定也更便于团队内统一视觉风格。Midjourney 支持的/describe命令也可以让你反向拆解喜欢的图快速搭建模板库。本文还有配套的精品资源点击获取