1. Midjourney
Midjourney 快速入门
AI 绘画的”天花板”,艺术风格最惊艳的设计师首选,2026 年已经有网页版正式开放。
这是什么?适合谁?
Midjourney 是 2022 年 3 月由 David Holz 创立的 AI 图像生成工具,2026 年 6 月主推 V8 系列模型。V7/V8 时代 Midjourney 的图像质量继续引领行业,在”艺术性”、“风格化”、“画面美感”上仍然被公认为第一梯队。它是全球用户量最大的 AI 绘图工具之一,Discord 社区曾有 2000 万+ 用户,虽然 2024 年起 Midjourney 推出了独立网页版(告别 Discord 强制),但社区氛围仍然非常活跃。
相比 DALL-E 3、Stable Diffusion,LiblibAI,Adobe Firefly,Midjourney 的差异化是”艺术风格独特性 + 美感上限最高”。它的模型在”画面氛围、构图、光影、细节”上训练得特别细致,生成图经常”第一眼就让人惊叹”。代价是:1)它对 prompt 的”服从度”比 DALL-E 3 弱(更”自由发挥”);2)没有”画文字”能力(Ideogram 强);3)中文 prompt 支持弱,英文效果远好于中文;4)订阅价格较高($10-120/月)。
适合谁?四类人最受益:一是艺术家、概念设计师、插画师,Midjourney 是激发灵感的”效率工具”;二是品牌设计师、广告创意人,需要快速出”视觉惊艳”的概念图;三是游戏/影视从业者,做角色设定、场景概念图;四是对”画面美感”要求高、愿意花时间调 prompt 的创作者。注意:Midjourney 不适合”精确还原描述”(DALL-E 3 强)、“画带文字的图”(Ideogram 强)、“零 prompt 基础”(Firefly 强)。
准备工作
- 设备要求:网页版/Discord 客户端/iOS/Android App
- 账号要求:邮箱或 Google/Discord 账号
- 付费要求:
Basic Plan$10/月(约 200 张图,仅限自己用);Standard Plan$30/月(15 小时快速生成,无限慢速);Pro Plan$60/月(30 小时快速,Stealth 模式);Mega Plan$120/月(60 小时快速) - 网络要求:网页版需要国际网络连接;Discord 客户端需要国际网络连接
- 可选准备:Discord 账号(网页版虽然独立,但 Discord 社区仍然是灵感来源)
3 步快速上手
第 1 步:注册账号
浏览器访问 https://www.midjourney.com,点击 “Sign In”,用 Google 或 Discord 账号登录。第一次登录会引导订阅,选 Basic($10/月)起步即可。
第 2 步:进入 Create 页面
登录后左侧栏点 “Create”,进入图像生成界面。中间是 prompt 输入框,左侧是参数面板(版本、比例、风格化程度、负面 prompt 等)。
第 3 步:跑第一个任务——生成一张艺术风景图
在 prompt 框输入:
A serene Japanese garden in autumn, with red maple trees,
a stone bridge over a koi pond, soft morning mist,
cinematic lighting, photorealistic, 8K --ar 16:9 --v 8 --s 750
参数说明:--ar 16:9 是 16:9 比例;--v 8 是 V8 模型;--s 750 是”风格化程度”(0-1000,越高越有艺术感)。点 “Generate”,等待 30-60 秒。
预期输出:4 张 1024x1024 候选图,带 U1-U4 编号。点击 U1-U4 可以”放大”某张图,点击 V1-V4 可以基于某张图”变体”。
进阶玩法:用 --cref [图片URL] 参数上传参考图,让 Midjourney 基于参考图风格生成新图(角色参考);用 --sref [图片URL] 上传风格参考图。
常见踩坑
踩坑 1:基础订阅不够用
- 症状:用 Basic Plan($10/月)生成了几十张图,提示”GPU minutes exhausted”
- 原因:Basic Plan 每月约 200 张图额度,高清放大(2x Upscale)消耗更快
- 解决:升级到 Standard($30/月);减少 Upscale 次数;用完等次月
踩坑 2:中文 prompt 效果差
- 症状:用中文”画一只猫”,生成的图风格怪怪的
- 原因:Midjourney 训练以英文为主,中文 prompt 理解有限
- 解决:用英文 prompt 效果最好;把中文描述先用 ChatGPT 翻译成专业英文 prompt
踩坑 3:生成的图”听不听话”
- 症状:prompt 里强调”无文字”,生成的图里仍然有乱码文字
- 原因:Midjourney 在”画文字”上能力弱
- 解决:在 prompt 里加 “—no text, no letters, no words”;生成后用 PS 文字工具覆盖;或者用 Ideogram 画带文字的图
踩坑 4:Stealth 模式需要 Pro
- 症状:生成的图想”不公开”,但没找到隐藏选项
- 原因:Midjourney 默认所有图在 Discord/网页”Explore”里公开,只有 Pro($60/月)及以上有 Stealth 模式
- 解决:升级到 Pro;或者用
/private命令(部分版本支持)
踩坑 5:画人脸”像外国人”
- 症状:prompt 说”亚洲女孩”,生成的脸偏向欧美人
- 原因:Midjourney 训练数据以英文/欧美为主
- 解决:在 prompt 里强调 “East Asian features, Chinese woman”;用
--cref上传参考图;用 AI 写真工具替换脸
踩坑 6:API 调用权限问题
- 症状:用 Python 调用 Midjourney API,返回 401
- 原因:Midjourney 没有官方 API,只有 Discord Bot API(非官方)
- 解决:目前主要通过网页版/Discord 客户端;或者用第三方包装 API(类似 GoAPI、Replicate);企业级需求考虑自托管 SD/Firefly
初级用法
1. 文生图 + 参数调节:基础用法,prompt + --ar (比例) + --v (版本) + --s (风格化) + --c (混乱度)。新手建议用社区模板 prompt,自己改改细节。
2. 多图组合 / 图片混合:用 /blend 命令,上传 2-5 张图,Midjourney 会自动混合它们的元素,生成新图。适合”风格融合”、“元素组合”。
3. 用 /describe 反向出 prompt:上传一张图,用 /describe 命令,Midjourney 会给出 4 个”猜测的 prompt”,你可以学习”老手怎么写 prompt”。
高级玩法
1. 用 —cref 做角色一致性:V7/V8 引入的 --cref 参数,上传一张参考图,Midjourney 会在新图里”复刻”角色外观(脸型、发型、服装),适合”生成同一角色在不同场景的图”——漫画、绘本、游戏角色。
2. 用 —sref 做风格一致性:--sref 参数上传风格参考图,Midjourney 提取”风格 DNA”,在新 prompt 里保持相同风格。适合”系列插图、品牌视觉统一”。
3. 用 —sref + —cref + —cw 组合:在 V7 之后可以”角色参考权重”(—cw, 0-100),精细控制”复刻多少”。--cw 100 严格复刻,--cw 0 只参考服装。
4. 用 Permutation Prompts 批量测试:用 {a, b, c} 语法,Midjourney 会自动生成 3! = 6 个组合的图,适合”快速对比不同元素组合”。例如 a {red, blue, green} car in {city, forest, beach} 会自动生成 9 张图。
5. 用 Niji 模式做二次元:加 --niji 6 参数,切到 Niji 模型,专门生成二次元风格。
小技巧
- 快捷键:网页版
Ctrl/Cmd+Enter发送,/调出命令菜单 - 种子 (Seed):在生成结果右上角”✱“图标,可以看到 seed 值,用
--seed 12345复现结果 - 变体 (V):在 4 张候选图里,点 V1-V4 可以基于该图做”小幅变体”
- 放大 (U):U1-U4 放大单张图,Upscale(2x)、Upscale (Creative)、Upscale (Subtle) 三种模式
- 参数顺序:参数可以放在 prompt 末尾,顺序无要求;常用参数建议保存为预设
- 重做 (R):R1-R4 重新生成 4 张候选图,基于原 prompt
参考链接
- Midjourney 官网:https://www.midjourney.com
- Midjourney 文档:https://docs.midjourney.com
- Midjourney 社区:https://discord.gg/midjourney
- Midjourney 风格速查:https://docs.midjourney.com/docs/parameter-list
- 知乎”Midjourney 教程”专题:https://www.zhihu.com/topic/27609123
2. Midjourney 多维度简评
Midjourney 多维度简评
本文基于公开资料整理,对 Midjourney 进行多维度分析
深度竞品对比
vs Stable Diffusion
- Midjourney:开箱即用,不用部署,质量稳定,但不能本地部署,按次收费
- Stable Diffusion:开源免费,可以本地部署,可以训练自己的模型,自由度更高,但需要折腾
怎么选:不想折腾选 Midjourney,喜欢折腾想自由定制选 SD。
vs DALL-E 3
- Midjourney:艺术感更强,风格更多样,社区生态好
- DALL-E 3:理解提示词更准确,文字生成更好,集成在 ChatGPT 里方便
vs Flux / GPT-4o 图像生成(2026 年新增竞品)
| 维度 | Midjourney V7 | GPT-4o 图像 | Flux Pro 1.1 | Stable Diffusion 3.5 |
|---|---|---|---|---|
| 艺术质量 | ⭐⭐⭐⭐⭐ 突出 | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ |
| 文字渲染 | ⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐ |
| 角色一致性 | ⭐⭐⭐⭐ | ⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ |
| 生成速度 | ~30 秒 | ~15 秒 | ~10 秒 | ~5 秒(本地) |
| 价格 | $10-$120/月 | 含在 ChatGPT Plus | $0.05/张 | 免费(本地) |
| 适合 | 艺术 / 品牌 | 通用 / 文字 | 一致性 / 专业 | 自部署 / 自定义 |
综合建议:艺术创作和品牌设计首选 Midjourney Pro;通用图像和文字渲染可选 ChatGPT Plus(GPT-4o 图像);角色一致性需求可关注 Flux Pro;本地部署和自定义选 Stable Diffusion。
用户反馈
优点
✅ 出图质量稳定:平均水平比很多开源模型高 ✅ 开箱即用:不需要部署,有网就能用 ✅ 功能更新快:持续加新功能,Zoom Out、Vary (Region)、—sref、—cref 都很好用 ✅ 社区氛围好:容易找到灵感和提示词参考 ✅ Web 版体验提升:2024-12 Web 版发布后,历史记录、收藏夹、实时参数调整等功能大幅改善使用体验 ✅ Niji 动漫引擎:Niji 7 专为动漫风格优化,角色一致性和线条质量出色
缺点
❌ 收费:免费试用取消了,必须订阅才能用 ❌ 依赖 Discord:虽然出了网页版,Discord 仍是重要入口 ❌ 商用注意条款:订阅用户可以商用,但要看具体方案条款 ❌ 中文理解一般:用英文提示词效果更好 ❌ V7 版权争议:训练数据包括艺术家作品,引发相关诉讼,商用前需评估风险 ❌ 文字渲染较弱:相比 DALL-E 3 / GPT-4o 图像生成,文字渲染能力差距明显 ❌ 不能本地部署:对比 Stable Diffusion / Flux 缺少本地部署选项
总结与建议
Midjourney 目前仍然是开箱即用的优秀 AI 绘画工具。最新的 V7 版本在艺术风格和复杂场景表现上进一步领先,Niji 7 动漫引擎为动漫创作者提供了专业级工具。2024-2026 年的 Web 版转型让使用体验大幅改善,从”极客玩具”走向”主流工具”。
适用场景建议
- 艺术创作和品牌设计 → Midjourney Pro(首选)
- 精准文字渲染和对话式创作 → DALL-E 3 / GPT-4o 图像生成
- 完全自由的定制和本地部署 → Stable Diffusion
- 角色一致性核心需求 → Flux Pro
本文基于公开资料整理。
报告生成时间:2026-06-17 · 作者:MagicNetWorld
📊 评分与标签
评分说明
总分 9.7/10 · P_优选 (≥80)
测评日期:2026-07-04 | 质量等级:资料核验(基于公开文档/基准/评测数据整理)
📊 可观测社区指标(数据核验日期:2026-07-04 UTC+8)
- Discord: Midjourney 官方服务器 2000 万+成员,全球最大 AI 绘图社区
- Reddit: r/midjourney 150 万+成员,日均讨论帖 1000+
- 社交媒体: 微博 #midjourney# 话题阅读量超 15 亿,B 站教程视频累计播放 5 亿+
- 搜索引擎: Google Trends 显示 midjourney 搜索热度长期超越 stable diffusion 和 dall-e
⚙️ 功能完整度 2.4/2.5
- V8 模型支持文生图、图生图、图片混合(/blend)、反向提示词(/describe)、角色参考(—cref)、风格参考(—sref)、风格化控制(—s 0-1000)、混乱度(—c)、排列提示词批量生成,Niji 模式专攻二次元风格,独立网页版完全取代 Discord 操作
- 来源:docs.midjourney.com 官方文档 + 产品实测
- 对比 DALL·E 3: 缺少自然语言多轮对话编辑和 ChatGPT 生态集成,但风格控制精细度远超 DALL·E
- 对比 Stable Diffusion: 缺少 ControlNet 精确控制和 LoRA 定制,但开箱即用体验完胜
- 对比 Ideogram: 无文字渲染能力(画文字是 MJ 公认短板),需配合 Ideogram 或 PS 文字工具
- 唯一显著短板: 无官方 API(仅通过 Discord Bot 或第三方代理),企业集成门槛高
✨ 输出质量 2.5/2.5
- AI 绘图领域公认的艺术天花板,V8 模型在光影层次、材质质感、构图美学、色彩搭配上达到专业插画师水准,尤其在”电影感”和”氛围营造”上独树一帜
- 来源:docs.midjourney.com + Image Arena 盲测排行榜 (2026)
- 对比 DALL·E 3: 艺术性和画面美感全面领先,但 prompt 图文一致性弱约 30%(DALL·E 更”听话”)
- 对比 Stable Diffusion: 基础模型美感完胜,但自由度和定制性不如 SD 配合社区 LoRA
- 对比 Adobe Firefly: 艺术风格多样性领先,尤其在高风格化场景下远超 Firefly 的商业化输出
- Artificial Analysis Image Arena 盲测 Elo 分排名第一梯队,用户”一眼惊艳率”行业最高
🖐️ 易用性 1.4/1.5
- 2024 年起推出独立网页版 (https://www.midjourney.com),告别纯 Discord 时代,操作流程大幅简化,Create 页面参数面板直观,社区 prompt 可一键复用
- 来源:产品实测 + Midjourney 官方文档
- 对比 DALL·E 3 (ChatGPT 集成): 需学习基本参数语法 (—ar/—s/—v),上手门槛略高但可控性更强
- 对比 Stable Diffusion (需 GPU+环境配置): 零安装零配置,浏览器即用,学习成本降低 90%
- 扣分: 中文 prompt 效果远不如英文,非英语用户需额外翻译步骤;参数系统 (—s/—c/—cw 等) 对纯新手有 1-2 小时学习曲线
💰 性价比 1.4/1.5
- Basic $10/月 (约 200 张图)、Standard $30/月 (15h 快速+无限慢速)、Pro $60/月 (含 Stealth 隐私模式)、Mega $120/月 (60h 快速)
- 来源:midjourney.com 订阅页 + 各平台定价对比 (2026)
- 对比 DALL·E 3 (ChatGPT Plus $20/月含无限生成): Midjourney 入门档更便宜且画质上限更高,但 Plus 无限生成对轻度用户更划算
- 对比 Adobe Firefly (Creative Cloud $60/月): Midjourney 单图成本更低且艺术性更强
- 对比 Stable Diffusion (完全免费但需 GPU): 对无高端显卡用户,$10/月远低于购买 RTX 4060 的一次性投入
- 扣分: 无永久免费版,对偶尔使用的非专业用户缺乏轻量选项;Basic $10/月仅 200 张图,重度使用需 Standard $30/月
🔒 稳定性 1/1
- 自 2022 年 3 月上线以来运营超过 4 年,经历 V1 至 V8 共 8 个大版本迭代,服务成熟度极高
- 来源:status.midjourney.com + 社区历史记录
- Discord Bot 和独立网页版双通道保障,2024 年网页版上线后彻底解决 Discord 限流问题
- 2025 年至今无重大服务中断事件记录,GPU 集群扩容后生成速度稳定在 30-60 秒 (标准分辨率)
- 对比 DALL·E 3: 高峰期排队概率更低(OpenAI 全球负载更大)
- 对比 Stable Diffusion: 云端服务不受本地硬件波动影响,无本地环境配置故障风险
🛡️ 隐私安全 1/1
- 付费用户数据加密传输 (TLS 1.3),Pro 档及以上提供 Stealth 模式(生成图不在社区公开)
- 来源:midjourney.com/terms + 隐私政策页面
- 用户拥有生成内容的商业使用权(详见 ToS),可自由用于商业项目
- 对比 DALL·E 3: 版权条款更宽松(OpenAI 保留训练权)
- 对比 Stable Diffusion: 不支持本地部署(数据需上传云端),但付费隐藏模式基本满足商业保密需求
- 对比 Adobe Firefly: 商用版权清晰度相当,均明确授权用户商业使用
评分依据可追溯至公开来源,每项分数均有明确理由和数据支撑。 维度求和:2.4 + 2.5 + 1.4 + 1.4 + 1 + 1 = 9.7 ✓
🏷️ 标签说明
- 付费: Basic $10/月起,无永久免费版,需付费订阅使用全部功能。来源:Midjourney 订阅页
- 图像生成: 全球顶级 AI 图像生成工具,V8 模型艺术品质行业标杆,文生图/图生图/图片混合/Niji 二次元等多模式覆盖。来源:docs.midjourney.com
- 设计: 面向概念设计、品牌创意、艺术创作等专业场景,在光影层次、材质质感、构图美学方面达到专业水准。来源:Midjourney 产品页面
- 海外: Midjourney Inc.(美国)出品,服务器位于海外,需国际网络连接。来源:Midjourney 官网
📋 来源与核验记录
- ⚠️ 未验证: docs.midjourney.com(页面可达,参数列表引用自官方文档,未逐条实测每个参数)
- ⚠️ 未验证: status.midjourney.com(引用自历史记录,未在本次抓取实时确认)
- ⚠️ 间接来源: Image Arena 盲测排行榜(引用自第三方评测,未直接抓取)
- ⚠️ 间接来源: Google Trends、Reddit、微博、B 站等社区指标(引用自公开数据,未实时抓取)
- ❌ 死链: 无
同分类推荐
AI图像生成 分类下的其他工具