Midjourney

Midjourney V8.2 图像生成平台,可通过网页和 Discord 创作图片与短视频,采用付费订阅制

  • 热度
  • AI绘画
  • 付费
Midjourney 界面预览

工具速览

出图的艺术质感仍是这个品类的天花板:开箱即用、不需要技术背景,但没有免费额度,商业版权要看清订阅档位。

  • 免费
适合
  • 设计师和插画师
  • 内容创作者
  • 游戏和影视从业者
  • 摄影师
优点
  • 美学质感和风格化能力是公认的天花板,DALL·E 3 更"正确"但更"无聊",国内产品的差距主要也在这里
  • 开箱即用、稳定性好,不需要像 Stable Diffusion 那样配环境、挑模型
  • V8.2 是 2026 年 7 月上线的当前默认图像版本,可直接在网页和 Discord 使用
  • 同一平台同时覆盖图像生成、编辑与短视频创作,静态概念可以继续制作成动态素材
  • 参数体系成熟:--ar 控比例、--chaos 控随机性、--no 排除元素、--style raw 减少自动美化、--iw 调参考图权重
缺点
  • 没有永久免费计划,最低约 $10/月起,美元计价
  • 年营收超过 100 万美元的公司需要 Pro 或 Mega 套餐才能取得所需的商业使用权,商用前仍应核对条款
  • 中文提示词效果普遍不如英文,很多人要先用别的 AI 把中文需求译成英文 prompt
  • 手指、文字、镜面反射、远处人群仍是高频出错点,放大确认后再用
  • 出图有明显的随机性,同一个 prompt 跑十次可能只有两三次出彩
价格

没有永久免费计划,需付费订阅(美元计价):基础版约 $10/月,200 张快速出图/月;标准版约 $30/月,无限慢速出图 + 15 小时快速出图/月;专业版约 $60/月,30 小时快速出图/月并支持隐身模式;大型版约 $120/月,60 小时快速出图/月

价格随官方调整,请以官网为准

如果你在设计圈或内容创作圈混过一段时间,Midjourney 这个名字基本不会陌生。它不是那种“体验一下就算了”的工具,而是真的改变了不少创作者的工作流程。从早期 V4 到 2026 年的 V8.2,产品已从 Discord 生图扩展到网页创作、编辑与短视频。

它到底是什么

Midjourney 是一个基于 AI 的图像生成工具,你输入一段文字描述(也就是提示词,prompt),它会生成对应的图片。听起来很简单,但实际上它的出图质量在所有同类产品里一直处于第一梯队——尤其在艺术风格、光影质感、画面构图这些方面,很多专业设计师也承认它出来的东西"肉眼可见地好看"。

它可通过独立网页版(midjourney.com)和 Discord 使用。网页版适合希望在画布与图库中完成生成、编辑和视频工作流的用户;Discord 仍适合习惯命令与频道协作的人。

Midjourney 是一家独立公司,没有大厂背景,创始人 David Holz 之前做过 Leap Motion。公司规模不大(据说全职员工不到 50 人),但产品影响力极大——这本身就说明了一些问题。

2026 年的当前版本

Midjourney 官方版本文档显示,V8.2 于 2026 年 7 月 24 日发布,并成为当前默认图像版本。旧教程里的 V7 参数仍可用于复现旧风格,但不应再写成“最新版本”。

图像工作流。 文字提示、图像参考、局部编辑和变体仍是核心能力。版本升级会改变默认审美和提示词响应,长期项目最好固定模型版本并保存种子与参考图。

短视频工作流。 Midjourney 已把静态图继续生成短视频的能力纳入同一平台,适合把概念图、分镜或营销视觉快速转为动态素材。

使用方式。 网页端与 Discord 都能进入创作流程。新用户不必再把 Discord 当作唯一入口,但团队仍需根据素材管理、协作和导出习惯选择界面。

提示词怎么写才有效

这是很多人刚开始用时最挫败的地方——随手打几个词,出来的图要么平庸,要么根本不是你想要的。提示词是有技巧的,但也不用想得太玄乎。

结构化思路:主体 + 环境 + 风格 + 技术参数

比如你想要一张城市夜景:

a lone figure walking on a rainy Tokyo street at night, neon reflections on wet pavement, cinematic lighting, shot on 35mm film, shallow depth of field, photorealistic --ar 16:9 --v 7

拆解一下:

  • 主体:a lone figure walking on a rainy Tokyo street at night
  • 光影/环境:neon reflections on wet pavement, cinematic lighting
  • 风格:shot on 35mm film, shallow depth of field, photorealistic
  • 参数:--ar 16:9(横版比例)、--v 7(指定版本)

中文描述行不行? 可以用,但效果普遍比英文差一些。它见过的英文 prompt 远多于中文,所以英文描述出来的图在细节还原上通常更准。如果英文不好,可以用 ChatGPT 帮你把中文需求优化成英文 prompt,这是很多人的实际做法。

常用参数说明:

  • --ar:图片比例,如 --ar 16:9(横版)、--ar 9:16(竖版/手机壁纸)、--ar 1:1(方形)
  • --v 8.2:指定当前 V8.2 图像模型
  • --chaos:随机性,0-100,数字越高每次出图差异越大,适合探索风格
  • --no:排除元素,--no text, watermark, extra fingers 减少常见翻车
  • --style raw:减少 AI 自动美化,更忠实于你的描述
  • --iw:图片参考权重,0.5~2 之间,配合参考图使用

适合什么人用

设计师和插画师: 快速出概念草图、风格参考、客户提案的视觉初稿,效率提升是实打实的。以前跟客户对风格要半天,现在当场生成三四种方向,直接选。品牌设计、包装设计、海报创作都是高频使用场景。

内容创作者: 做公众号、小红书、YouTube 封面,需要大量配图但没有专职设计的情况下,Midjourney 是最高性价比的解决方案。

游戏和影视从业者: 概念设计阶段用来快速验证视觉方向,不少独立游戏开发者直接用它出角色和场景素材,也有影视制作用它来做分镜参考、美术概念验证。

摄影师: 用来做前期视觉规划,构思拍摄场景和光影效果,也有人用它生成合成背景。

完全不懂设计的普通人: 只要愿意花时间摸索 prompt,做出好看图片的门槛并不高。但如果你想要非常精确的定制效果,还是需要一定的学习投入。

和竞品比怎么样

vs DALL-E 3(ChatGPT 内置): DALL-E 3 中文理解好、对话流程顺畅,生成带文字的图片更准确。但出图的艺术感和风格化程度远不如 Midjourney,更"正确"但更"无聊",对审美有要求的人很难满足。

vs Stable Diffusion: SD 完全免费、开源、可本地部署,适合有技术能力的用户深度定制。但学习曲线陡峭,光是配环境就能劝退一大批人,出图质量高度依赖你用的模型和工作流。Midjourney 胜在开箱即用、稳定性好,不需要任何技术背景。

vs Adobe Firefly: Firefly 商用版权清晰(完全用授权数据训练),适合有版权顾虑的商业场景,且与 PS 等 Adobe 工具深度集成。但在出图质量和风格多样性上,目前还是弱一截。

vs 国内产品(即梦、通义万象): 近两年进步很快,中文理解是优势,价格也便宜,人物生成不错。但在整体美学质感和风格化能力上,跟 Midjourney 还有差距,主要差在"那种说不清楚但肉眼能分辨的品味"。

订阅价格

Midjourney 没有永久免费计划,需要付费订阅(美元计价):

  • 基础版(Basic):约 $10/月,200 张快速出图/月
  • 标准版(Standard):约 $30/月,无限出图(慢速模式),快速出图 15 小时/月
  • 专业版(Pro):约 $60/月,快速出图 30 小时/月,支持隐身模式(图片不出现在公共画廊)
  • 大型版(Mega):约 $120/月,快速出图 60 小时/月,重度商业用途

关于商业版权:专业版及以上用户(或年收入超过 100 万美元的企业)才有完整的商业使用权。用于商业项目,务必看清楚订阅条款。

如果只是偶尔玩玩,基础版够了。如果是设计工作的生产力工具,标准版的成本相比它能节省的人力来说很划算——一个外包设计稿动辄几百几千,而 Midjourney 帮你搞定初稿和灵感参考,省的时间远不止这点月费。

实际使用注意事项

版权问题要小心。 不要在 prompt 里写具体在世艺术家名字来模仿风格,这在法律上是灰色地带。可以描述风格特征,比如"油画风格,厚涂笔触,暖色调"。

生成的图先检查细节再用。 手指、文字、镜面反射、远处人群仍可能出错,放大确认无误后再交付是好习惯。

善用"Vary (Subtle)"功能。 某张图大体不错但有些地方想调整,用轻微变体功能,而不是重新跑 prompt,能保留你喜欢的部分同时做微调。"Vary (Region)"可以局部修改指定区域。

多出几批再选。 每次出四张,同样的 prompt 跑十次可能有两三次出彩,剩下的都平平无奇,这很正常。不要因为第一批没有满意的就放弃,调整描述多跑几次。

收藏好用的 prompt,建自己的提示词库。 好的 prompt 是积累出来的,哪些词汇组合出你满意的结果,记下来下次还能用。

入门建议

从网页版(midjourney.com)开始,界面比 Discord 直观很多。

第一次不要追求"完美",先随便描述一个你想看到的画面,感受一下它的能力范围。然后从别人的 prompt 里学习——Midjourney 的公共画廊里能看到其他用户的作品和对应的 prompt,这是最快的学习方式。

花一个小时摸索,大部分人都能开始做出自己满意的图。真正精通需要时间,但入门真的不难。

Midjourney 目前仍然是 AI 图像生成领域的标杆产品,学习曲线不陡但有深度,花时间研究 prompt 的人和随手打几个词的人,出图效果会差距悬殊。如果你的工作或创作涉及视觉内容,值得认真学一下。