AI 绘画已经不只是"玩一玩"了
还记得 2022 年 Midjourney 刚火起来的时候吗?大家乐此不疲地输入各种关键词,看着 AI 生成的奇幻图片啧啧称奇。但四年过去了,Midjourney 早已不再是"玩具"——它已经成为游戏原画、影视概念设计、广告创意、产品包装等商业领域不可或缺的专业工具。
2026 年的 Midjourney V7 在图像质量、风格控制和一致性上都有了质的飞跃。但真正拉开专业创作者和普通用户差距的,已经不再是"谁能写出更好的 prompt",而是"谁有更系统的工作流程"。
用 Midjourney 生成一张好看的图很容易,但要"稳定地、可预期地、高效地"生成符合商业需求的图——你需要的是一套完整的工作流。
这篇文章将拆解我过去两年中积累的 Midjourney 专业创作流程,包括概念设计、提示词工程、风格控制、迭代优化、后期处理,以及面向游戏、影视、广告等行业的商业交付实战。
第一阶段:概念构思——画之前先想清楚
很多新手犯的第一个错误就是:打开 Midjourney,想到什么就输入什么,然后被出来的图牵着鼻子走。专业工作流的第一步恰恰相反——在画之前,先想清楚你要什么。
需求拆解
拿到一个商业需求后,不要急着写 prompt。先回答以下几个问题:
- 目标是什么?是游戏角色概念图?是品牌海报?是建筑可视化?不同目标对应完全不同的审美标准和细节要求。
- 受众是谁?是面向游戏玩家(可能偏好夸张风格)?是面向企业管理层(可能偏好简约专业)?是面向儿童(可能偏好明亮可爱)?受众决定审美方向。
- 用途是什么?是用在手机屏幕(竖构图、焦点突出)?是用在横幅广告(横向、留白多)?是用在印刷品(高分辨率、300DPI)?用途决定技术参数。
- 品牌约束是什么?有固定的配色方案吗?有必须出现的品牌元素吗?有不能出现的敏感元素吗?
建立"情绪板"(Mood Board)
在正式开始创作之前,收集 10-20 张参考图片。这些图片不需要是你想要的最终效果,而是帮你建立"视觉方向感":
- 3-5 张"风格参考":比如"我想画得像《爱死机》第三季的某集"
- 3-5 张"色彩参考":比如"我想要这种黄昏暖色调的感觉"
- 3-5 张"构图参考":比如"我想要这种人物居中、背景虚化的构图"
- 3-5 张"细节参考":比如"我想让角色的盔甲有这种锈蚀质感"
情绪板的作用不是让你"照着画",而是让你在开始生成之后,有一个客观的参照系来评判"这张图对吗?"。这是区分"业余随机碰运气"和"专业可控创作"的关键一步。我个人的习惯是把情绪板放入 Notion 或 Figma,并在上面标注每个参考图的具体借鉴点——越具体越好。
第二阶段:提示词工程——Midjourney 的"编程语言"
Midjourney Prompt 的结构公式
经过大量实践,我总结出一个适用于大多数商业场景的 prompt 结构:
[主体描述], [场景/环境], [风格/艺术家/流派], [光线/氛围], [构图/视角], [技术参数], [特殊指令]
举例——假设我们要为一个赛博朋克题材的游戏设计一个角色:
A female cyborg assassin with a translucent visor, neon-lit back alley of a futuristic Tokyo, cyberpunk aesthetic inspired by Blade Runner 2049, dramatic rim lighting with purple and cyan tones, low angle shot from ground level looking up, photorealism with a cinematic grain, 8K --ar 3:4 --style raw --s 350
翻译:一个女性半机械人刺客,戴着半透明面罩,在霓虹灯照亮的未来东京后巷,风格受《银翼杀手2049》启发,戏剧性的边缘光,紫青色调,低角度仰拍,照片级写实带电影颗粒感,8K分辨率,3:4画幅,raw风格化,风格化参数350。
这个 prompt 包含了六个维度,每个维度都有明确的"锚点"——不是泛泛地写"cyberpunk",而是具体到"Blade Runner 2049"。越具体,Midjourney 的输出越可控。
参数详解
- --ar(Aspect Ratio,画幅比例):最基础也最容易被忽略的参数。商业用图中,你必须在生成时就用正确的比例——别指望后期裁切,裁切会损失关键信息。
- --style raw:这个参数告诉 Midjourney 减少"美化滤镜",更忠实地执行你的描述。在做概念设计时强烈建议开启,能减少审美意外。
- --s(Stylize,风格化强度):范围 0-1000。数值越高,Midjourney 越自由发挥艺术风格;数值越低,越严格遵循 prompt。一般商业创作建议在 100-400 之间。
- --c(Chaos,随机性):范围 0-100。四张图的差异性。探索阶段可以高一些(50-80),收敛阶段尽量低(0-20)。
- --iw(Image Weight,图片权重):控制参考图的影响力。0.5-2.0,数值越高参考图权重越大。
- --no:排除特定元素。比如 --no text, watermark, signature(排除文字、水印、签名)。
Image Prompt(参考图提示)的高级用法
Midjourney 支持在 prompt 前加图片 URL 作为参考。这是实现风格一致性的重要手段:
- 单图参考:一张参考图 + prompt 文字,适合"参考构图和氛围"。
- 多图混合:两张或多张参考图,Midjourney 会混合它们的特征。用 :: 控制权重——比如 /imagine [url1]::2 [url2]::1 description 表示第一张图权重是第二张的两倍。
- Style Reference(--sref):专门用于风格参考,不参考构图和内容,只参考风格。非常适合品牌风格统一——先做好一张"品牌风格锚图",后面所有图都 --sref 这张锚图。
- Character Reference(--cref):角色一致性参考。在设计系列角色时至关重要——先确定角色的参考图,后续所有该角色的生成都 --cref 这张图。
第三阶段:迭代优化——从"还不错"到"就是它了"
金字塔迭代法
很多人陷入了"无限重试"的陷阱——不停地 /imagine,生成了几百张图,但没有一张真正满意的。问题在于缺乏系统的迭代策略。我推荐"金字塔迭代法":
第 1 层:广度探索(10-20 组)——用高 Chaos 参数,尝试不同的艺术风格、构图、色调,目的不是找到"对的那张",而是找到"对的方向"。这就像设计师画草图,不是画细节,而是寻找感觉。
第 2 层:方向收敛(5-10 组)——锁定 2-3 个有潜力的方向,降低 Chaos,逐步细化 prompt,排除不想要的元素。这时候你应该能明确说出"我想要的方向是 A 而不是 B"。
第 3 层:细节打磨(3-5 组)——选定一个最优方向,开始关注细节:面部表情、光影、质感、边缘处理。使用 Vary (Subtle) 做微调,使用 Vary (Strong) 做较大的变化。
第 4 层:完美化(2-3 组)——对胜出的那张图使用 Zoom Out、Pan、Vary Region 等工具做局部修正。如果某些区域 AI 画得不好(比如手的形态),用 Vary Region 框选修正。
实用迭代技巧
- 善用 /describe 反向工程:上传一张你喜欢的图,Midjourney 会给你 4 组可能的 prompt。这是学习别人是怎么写 prompt 的最快方式。
- 善用 Remix Mode:开启 Remix 模式后,每次点击 V(变体)都可以修改 prompt。这让你可以在生成的同时微调方向,而不需要从头开始。
- 建立 prompt 库:把验证过的有效 prompt 短语(比如某种材质、某种光效、某种风格)整理成库。专业创作者不是每次都从零开始写 prompt——他们有一套经过验证的"乐高积木",按需组合。
- 记录种子值(Seed):当你对某张图的方向满意但细节不够时,记下它的 --seed 值。固定 seed + 微调 prompt 可以让你在保持整体构图的同时修改细节——这是 Midjourney 最有用的"可控"技巧之一。
第四阶段:后期处理与商业交付
必要的后期处理
AI 生成的图片很少能直接交付——它可能需要这些处理:
- 高清放大:Midjourney 最高支持 2048×2048 的输出,对于印刷需求(通常要求 300DPI,A4 画幅需要约 2480×3508 像素)可能不够。可以配合 Topaz Gigapixel AI、Upscayl 等 AI 放大工具做 2-4 倍放大而几乎不损失质量。
- 细节修正:用 Photoshop 手动修正 AI 常见问题:手部形态异常、文字乱码、不自然的纹理重复。对于商业交付,这些"手工活儿"是品质的底线。
- 色彩校正:AI 生成的色彩有时偏灰或偏暗。用 Lightroom 或 Photoshop 做基础的色阶、对比度、饱和度调整,让画面更有冲击力。
- 文件格式与命名:商业交付需要规范的命名 + 分层 PSD 或 TIFF 格式。不要只给客户一张 JPEG。
商业交付检查清单
在发给客户之前,用这个清单自查:
- □ 分辨率满足使用场景要求(网页 72DPI / 印刷 300DPI)
- □ 色彩模式正确(网页 RGB / 印刷 CMYK)
- □ 画面中没有未授权的 IP 元素(比如出现了迪士尼角色的特征)
- □ 人物手足形态自然(AI 的老问题)
- □ 文字(如果有)拼写正确、可读
- □ 品牌色与视觉规范一致
- □ 构图考虑了文字预留空间(如果需要加文案)
- □ 文件命名规范(项目名_版本_日期),附带原始 seed 值和 prompt 记录
- □ 有备用方案(至少提供 2-3 个合格的版本供客户选择)
行业实战案例
案例1:游戏角色概念设计
需求:为一款东方幻想题材的手游设计 3 个主角的概念图,需要风格统一、有辨识度。工作流:先确定统一的"风格锚"(一张融合了水墨风与现代 CG 的参考图)→ 用 --sref 锁死风格 → 用 --cref 分别为每个角色生成 30-40 组方案 → 金字塔收敛到每个角色 3 个候选方案 → 人工选出最优组合 → 后期做细节统一调整(服装纹理、武器质感)。结果:3 个角色概念图,从启动到交付共 4 个工作日,客户零修改通过。而在 Midjourney 出现之前,同样的工作需要至少 2 周。
案例2:品牌视觉升级
需求:一个新兴茶饮品牌需要一套"未来感东方美学"的视觉体系,包含 Logo 概念、包装设计、社交媒体海报。工作流:先通过 Midjourney 大量探索"东方元素 + 赛博朋克 / 极简 / 田园等"的各种融合方向,生成 200+ 张 mood board → 与客户对齐 3 个方向 → 用 Midjourney + Photoshop 组合深度打磨 → 最终在一周内完成了之前需要外包设计公司一个月的工作量。客户最满意的是"前期方向探索的丰富度"——之前找设计公司做,一个方向不行就要重新来过,时间成本极高。
案例3:影视前期概念设计
需求:一部科幻短片的场景概念设计和关键帧。工作流:根据剧本情节拆解出 12 个关键场景 → 每个场景先用手绘草图确定构图(即使是简笔画也行)→ 将草图作为 Image Prompt 输入 Midjourney → 用 --style raw + 精确的艺术指导 prompt 生成概念图 → 导演确认后进入详细设计。这个流程的核心创新在于"草图引导"——不是让 AI 凭空发挥,而是用草图提供构图和布局的"硬约束",让 AI 填充风格和氛围。
高效创作的工具箱
| 阶段 | 工具 | 用途 |
|---|---|---|
| 概念构思 | Notion / Figma / Miro | 需求拆解、情绪板整理、参考图收集 |
| 提示词 | Midjourney + 自定义 prompt 库 | 核心创作 |
| 风格控制 | --sref / --cref / Image Prompt | 保持视觉一致性 |
| 放大 | Topaz Gigapixel AI / Upscayl | 高清放大到印刷级分辨率 |
| 后期 | Photoshop / Lightroom | 细节修正、色彩校正、合成 |
| 交付 | Google Drive / 百度网盘 | 文件交付与版本管理 |
关于 AI 版权与商业使用
2026 年,Midjourney 的商业使用条款已经相对成熟:付费用户拥有所生成内容的商业使用权(但 Midjourney 保留展示权)。但这里有一个重要但容易被忽视的点——如果你用 --sref 参考了他人的作品风格,而那个风格本身受版权保护,你可能面临法律风险。我的建议是:尽量用自己的原创图片作为风格参考,或者使用版权明确允许(如 CC0/公共领域)的素材。
另外,2026 年初美国版权局的最新指导意见再次确认:纯 AI 生成的内容(没有人类实质性创作贡献)不受版权保护。这意味着如果你想对 Midjourney 生成的图片主张版权,需要展示"人类创作贡献"——比如详细的 prompt 工程、大量的迭代选择、实质性的后期修改等。所以,保留完整的创作过程记录(prompt、seed 值、迭代版本、后期修改的 PSD)非常重要。
Midjourney 的未来与创作者的角色
Midjourney V7 展现的趋势很明确:AI 绘画工具越来越易用,技术门槛越来越低。这意味着"会用 Midjourney"的价值在下降,而"知道要画什么、画给谁看、怎么用"的价值在上升。
未来的顶尖创作者,可能不是技法最好的画家,也不是 prompt 写得最精妙的人,而是那个能深刻理解客户需求、准确把握审美方向、高效管理创作流程的人。工具在变快,但"理解人"的能力不会过时。访问星枢 AI,发现更多 AI 创作工具和教程。