
Midjourney 是由 David Holz(Leap Motion 联合创始人)创立的独立研究实验室推出的 AI 图像生成平台,2022 年 7 月以 Discord 机器人形式开启公测,现主战场已转移至 midjourney.com 网页端 。它通过将文本提示词转换为高分辨率艺术作品,在插画、概念艺术、摄影式输出、风格化品牌视觉等场景建立了”美学标杆”口碑。其核心差异化在于“视觉品质与风格一致性”——V7 模型在动态场景、运动构图、手部与人体比例、小物体细节上相较 V6.1 明显更稳 ,配合 --sref(风格参考)、--cref(角色参考)、--stylize、--chaos 等参数系统,为专业创作者提供显著的风格控制能力 。平台采用纯订阅制,无免费档,四档方案从 $10/月到 $120/月,年付八折 。
产品介绍
Midjourney 由 Midjourney, Inc. 开发,创始人 David Holz,公司 2022 年成立,总部位于旧金山,自筹资金独立运营,公开报道称其在公开推出后数月内即实现盈利 。它要解决的痛点是:早期 AI 生图工具(如 DALL·E 2 时代)虽然能”生成图”,但普遍面临”六指怪物、模糊抽象块、美学平庸”的困境,难以产出真正具备艺术完成度的视觉作品。Midjourney 的思路是用自研的专有扩散模型(非 Stable Diffusion 衍生、非 DALL·E 系列),持续迭代 V1 到 V7 多个大版本,每一代都在细节锐度、连贯性、提示词理解深度上向前推进 ——它不是让 AI “画出东西”,而是让 AI “以艺术家的审美画出东西”。
核心平台能力:
Midjourney 围绕”提示词 → 生成 → 选优 → 编辑 → 输出”构建了专业级 AI 生图闭环:
– 文生图与多版本输出
- 输入文本提示词,模型一次性生成 4 张变体图像供选择
- 当前主力模型为 V7(截至 2026 年中),V8.1 已在 Alpha 测试,出图速度较早期版本提升 4-5 倍,支持原生 2K HD 输出
- V7 模型在手部、人体比例、小物体细节上相较 V6.1 明显更稳,文字渲染有改善(长词与小字号仍会出错)
– 网页端编辑器(2025 年上线)
- 2025 年推出的 midjourney.com 网页界面,解决了长期被诟病的”Discord-only”问题
- 图像管理:有序的集合(Collections)、生成历史、过往提示词一键重跑
- 编辑器工具:
- Inpainting(局部重绘):选中图像特定区域用新提示词重新生成,救手指、换元素
- Outpainting(外扩):突破原图边界扩展画面
- Retexture(材质重绘):改变指定区域的材质
- Upscale(放大):最高 2048×2048 像素输出,达到印刷级精度
- 企业团队协作:图像库可浏览、集合可内部共享、生成历史提供创作审计轨迹
– 参数化创作控制系统
Midjourney 的参数系统为专业用户提供精细控制 :
--ar:设置画面宽高比--stylize:控制 AI 美学诠释强度 vs. 字面提示词遵循度--chaos:在 4 张变体间引入多样性--quality:调整生成时间与细节程度--style/--sref:引用现有图像实现跨项目风格一致性--cref(Character Reference):角色参考,保持人物连续性--tile:创建无缝重复图案--p(Personalization):个性化风格档案
– 变体模式与专业化模型
- Variant Modes:基于单张底图快速生成多版本,加速创意探索
- Pan & Zoom:平移与缩放,创意重构构图
- Image-to-Image Prompting:以现有图像影响新生成的风格、构图或内容
- Niji 模型:专门针对动漫、漫画、插画风格优化的定制模型
- Remix Mode:融合两个不同提示词或图像的元素,创造混合作品
- /describe:反向提示词——上传任意图像,MJ 生成可复现该风格的提示词(学习提示词技巧的神器)
- /blend:多图融合为新构图
– 视频生成能力
- Pro 和 Mega 方案支持 SD 视频生成(Relax 模式无限)
- 2026 年中,V8.1 默认生产模型已支持 SD & HD 视频输出
– 双入口:Discord + 网页端
- Discord 机器人:原始工作流,在服务器频道输入命令生成,社区文化浓厚,非峰值时段生成速度最快
- 网页端 midjourney.com:2025 年推出的专业工作流界面,适合企业创意团队
- 两者账号体系打通,订阅通用
商业授权:
- 所有付费方案均包含商业使用权(受服务条款约束)
- 年收入超过 100 万美元的公司必须使用 Pro 或 Mega 方案
- 隐私生成(Stealth Mode)仅 Pro 和 Mega 提供
典型使用场景 :
- 品牌与营销视觉:广告活动影像、社媒视觉、广告概念
- 概念可视化与情绪板:产品设计、建筑设计、创意总监在项目早期快速可视化概念
- 编辑插画:出版商与博主为文章、书籍封面、编辑内容创建自定义插画
- 时尚与产品设计:服装概念、纹理、产品美学可视化
- 建筑与室内设计:情绪板与照片级空间渲染
- 游戏开发:概念艺术、角色设计、场景探索
收费模式
Midjourney 采用纯订阅制,无免费档,所有方案自动续费,年付享 20% 折扣 。官方方案对比页明确四档 :
| 方案 | 月付 | 年付(等效月付) | Fast GPU 时间 | Relax 模式 | Stealth 模式 | 最大并发(图像) |
|---|---|---|---|---|---|---|
| Basic | $10/月 | $96/年($8/月) | 3.3 小时/月 | ❌ | ❌ | 3 Fast |
| Standard | $30/月 | $288/年($24/月) | 15 小时/月 | ✅ 无限图像 | ❌ | 3 Fast 或 Relax |
| Pro | $60/月 | $576/年($48/月) | 30 小时/月 | ✅ 无限图像 + SD 视频 | ✅ | 12 Fast 或 3 Relax |
| Mega | $120/月 | $1,152/年($96/月) | 60 小时/月 | ✅ 无限图像 + SD 视频 | ✅ | 12 Fast 或 3 Relax |
关键规则:
- 额外 GPU 时间:$4/小时(所有方案通用)
- 年收入 > 100 万美元的公司:强制 Pro 或 Mega
- 支付方式:仅接受 VISA、Mastercard、American Express、Discover & Diners、JCB 签发的借记卡/信用卡(通过 Stripe 处理),不支持 PayPal、电汇
- 取消与变更:可随时在账户页面设置取消,取消后到期停止续费
选型建议:
- Basic $10/月:适合轻度个人尝鲜,3.3 Fast GPU 小时用完后即停
- Standard $30/月:大多数个人创作者的实际起步档——Relax 模式无限出图能消化绝大多数日常试验,性价比最高
- Pro $60/月:做客户项目需要隐私(Stealth)或需要更高并发的重度用户起步档
- Mega $120/月:极高用量创作者与团队,Fast GPU 时间翻倍到 60 小时
重要更正:早期资料(包括部分中文教程)提到 MJ 有”免费试用档”,但截至 2024 年起 MJ 已取消免费试用,当前所有方案均需付费订阅,网页应用对所有人开放登录(Google 或 Discord 账号),但生成图像必须订阅 。任何声称”MJ 免费版”的资料均已过时。
优势与局限(基于官方披露与 2026 年第三方评测综合)
优势:
- 美学质量公认最佳:在艺术性、光影深度、风格一致性上,MJ 的输出质量是主流消费级 AI 生图工具中最高的,插画、概念艺术、摄影式输出”开箱即达出版级”
- 自研专有模型:不依赖 Stable Diffusion 或 DALL·E 系列,独立的技术路线带来独特的视觉风格
- 参数化精细控制:
--stylize、--chaos、--sref、--cref、--ar等参数系统为专业用户提供显著的创意控制 - 网页端专业工作流:2025 年推出的 midjourney.com 网页界面提供了图像管理、生成历史、编辑器(Inpainting/Outpainting/Retexture/Upscale),企业团队可用性大幅提升
- V7/V8 模型持续进化:V7 在手部、人体比例、小物体细节上相较 V6.1 明显更稳;V8.1 Alpha 出图速度提升 4-5 倍、支持原生 2K HD 输出
- 商业授权清晰:所有付费方案均含商业使用权,年收入超 100 万美元公司强制 Pro/Mega 的规则明确
- 社区生态活跃:Discord 社区近 2100 万成员,提示词技巧与作品分享文化浓厚,学习曲线虽陡但回报显著
- Draft Mode 快速迭代:草稿模式以 1/2 GPU 成本实现 10 倍速出图,适合探索方向
- 视频生成:Pro/Mega 方案支持 SD 视频生成,V8.1 已支持 HD 视频
局限:
- 无免费档:2024 年起取消免费试用,所有方案 $10/月起,新手零成本试错门槛高
- 提示词遵循度非最佳:MJ 倾向于优先美学质量而非字面提示词遵循,有时会产生偏离具体指令的美丽图像;DALL·E 3 在复杂提示词的字面遵循上更胜一筹
- 长文本渲染仍弱:V7 文字渲染有改善但长词和小字号仍会出错,V8 虽有改善但仍不可靠;Ideogram 和 GPT-4o 图像生成在文字渲染上更领先
- 默认公开生成:默认情况下创作出现在 midjourney.com 公开画廊,除非启用 Stealth Mode(仅 Pro/Mega)
- 无公开 API:官方不提供公开 API,不允许未授权自动化或第三方应用,企业集成需直接联系企业团队
- 缺乏 LoRA/ControlNet:不提供 Stable Diffusion 生态的 LoRA 微调或 ControlNet 精准控制,技术向用户受限
- Discord 工作流遗留:虽然网页端已推出,但大量老用户仍依赖 Discord,对新手不够直观
- 国内访问与支付门槛:需信用卡支付 + 稳定访问境外服务,国内个人用户存在门槛
- 内容审核偶有过度:Reddit 用户反馈无辜提示词偶尔被标记,而类似提示词却能通过,审核一致性有待提升







