Midjourney

-

Midjourney 是主流 AI图像与设计 平台之一,支持文本到图像、风格参考、参数化控制与网页创作工作流,广泛用于广告创意、概念设计、插画与视觉探索。

Midjourney 产品界面

Midjourney

Midjourney 的核心参数与统计

一句话简评:Midjourney 不是一个"万能 AI 设计平台",而是一套以审美稳定性为核心的视觉生成引擎——它把高质量的图像生成拆解为可控制的参数组合,让设计师和创意团队能像调相机参数一样控制 AI 输出的方向。

定位边界:Midjourney 官方将自己定义为"社区资助的研究实验室",团队约 60 人,自盈利而非风投驱动。这个背景直接影响了它的产品节奏——不追求企业级功能全覆盖,而是在视觉质量和创作体验上持续深挖。适合用它的人很清楚:这不是一个素材管理系统,也不是一个协作设计平台,它是一个高审美的"视觉前端引擎"。

维度 关键事实
产品定位 面向创意与设计团队的高质量 AI 图像生成平台
核心能力 文本到图像、图像参考、风格参考、参数化控制、变体与放大
最新主线模型 V8.1 Alpha(2026-04-14,已设为默认模型)
主要入口 Midjourney Web(alpha.midjourney.com)、Discord Bot
参数控制系统 --ar(画幅比)、--stylize(风格化强度)、--chaos(随机性)、--sref(风格参考)、--iw(图像权重)、--hd(高清模式)
商业授权 订阅计划内支持一般商业使用(具体条款以官方 Terms of Service 为准)
团队规模 约 60 人,自盈利,无外部融资
基础设施 基于 Google Cloud TPU 训练与推理

参数体系的决策价值:Midjourney 的竞争力不只是"能出图",而是把风格、构图、随机性、参考强度封装成一套可复用的控制系统。对于设计团队而言,这意味着 --sref 可以当作"品牌风格锚点"来用,--stylize 控制风格介入深度,--iw 决定参考图的影响力权重——这些参数的组合能力,决定了团队能否把一次偶然的好结果变成可重复的标准化产出。

Midjourney 的用户与市场认可

Midjourney 的市场认可很少通过公开的企业客户名单或融资新闻来表达,而是通过创作者生态、行业心智和公共影响力来体现。它在插画、广告视觉、概念设计、独立出版和社媒视觉圈层中长期保持高存在感,且多次进入大众视野的"AI 生成图片"事件都与其相关。

公共影响力事件:2022 年,Midjourney 生成的《Théâtre D'opéra Spatial》在美国科罗拉多州博览会数字艺术比赛中获得一等奖,成为 AI 生成艺术首次在传统艺术竞赛中获奖的标志性事件。2023 年,一张 AI 生成的"教皇方济各穿白色羽绒服"的图片在社交媒体上广泛传播,引发全球关于 AI 图像真实性和误导性的讨论。同年,Midjourney 生成的"五角大楼爆炸"假图片一度导致股市短暂波动。这些事件虽然争议巨大,但也从一个侧面证明了 Midjourney 的图像真实感已达到难以肉眼分辨的程度。

行业采用情况:The Economist 使用 Midjourney 为 2022 年 6 月期刊制作封面;意大利《Corriere della Sera》报纸使用了 Midjourney 创作的漫画;多家广告公司和创意工作室已将 Midjourney 纳入其视觉探索工作流。建筑师使用它生成项目初期的情绪板,替代传统的 Google Images 搜索流程。Harvard Business Review 也发文探讨 Midjourney 等生成式 AI 如何增强人类创造力。

社区壁垒:官方长期经营 Discord 社区、帮助中心和更新站(updates.midjourney.com),形成了极高密度的 Prompt、参数、案例与二次创作经验沉淀。这个社区的独特价值在于:好的工作流是被社区"试出来"的,而不是官方文档写出来的。对于新人来说,社区中的参数组合、风格参考图和 Prompt 模板等比任何教程都更有实操参考价值。

宣传核验:官方宣称"构建世界上最美 AI 模型",这个表述虽然主观,但在当前主流文生图平台中,Midjourney 的输出在审美一致性、色彩调性和风格凝聚力上确实有可感知的领先。它的定位不是"最像照片",而是"最好看"——这种差异决定了它的核心用户群是对审美有要求的创意工作者,而不是追求文档配图"能用就行"的泛化人群。

合规与诉讼风险:Midjourney 面临多起版权诉讼。2023 年 1 月,三名艺术家针对 Stability AI、Midjourney 和 DeviantArt 提起集体诉讼,指控它们在未经授权的情况下使用艺术家作品训练 AI 模型。2025 年 6 月,有球影业(Universal Pictures)和华特迪士尼公司(Disney)对 Midjourney 提起版权侵权诉讼,称其为"无底洞式的剽窃"。2025 年 9 月,华纳兄弟探索(Warner Bros. Discovery)也提起了类似诉讼,指控 Midjourney 系统性地盗用其知识产权,包括超人、蝙蝠侠等角色。这些诉讼的走向将直接影响 Midjourney 的商业授权边界和模型训练策略,是采购评估中不可忽视的风险维度。

Midjourney 的成本优势:固定订阅制下的低边际成本

Midjourney 采用纯粹的订阅制,不按 API Token 或图像生成张数计费。对于"日常大量试错 + 风格打磨"的使用方式,这种计费模型天然降低了心理门槛——用户不需要每次点击生成都要计算成本。

方案 月付价格 年付折算价格 并行作业数参考 适用人群
Basic 10 美元/月 96 美元/年(约 8 美元/月) 约 3 个并发 轻量创作与入门探索
Standard 30 美元/月 288 美元/年(约 24 美元/月) 约 15 个并发 高频个人创作者
Pro 60 美元/月 576 美元/年(约 48 美元/月) 约 30 个并发 专业创作者与工作室
Mega 120 美元/月 1152 美元/年(约 96 美元/月) 约 60 个并发 重度生产团队

C 端/个人成本解读:Basic 和 Standard 的门槛在 AI 视觉工具中属于中等偏低。真正的价值在于订阅后可以放心地反复抽风格、试参数、调参考图,而不需要每次盯着"还剩多少额度"。对于个人创作者来说,Standard 方案的并行能力已经足够支撑日常的"多方向同时探索"工作模式。

开发者/API 成本层面:Midjourney 本质上不是 API 基础设施产品——它没有公开的标准 API 端点供开发者二次集成,也不提供按 Token 计费的调用方式。这意味着,如果团队需要将图像生成能力嵌入到自己的产品流水线中(如电商批量主图生成),Midjourney 不是最合适的选择。这种"无 API"的定位既是边界,也是成本结构清晰的体现——你不用为用不到的 API 基础设施付费。

企业/工作室成本解读:Pro 与 Mega 的实际隐性成本并不在订阅费本身。真正的成本来自三个方面:提示词管理与团队协作——多人共创时如何维护统一的 Prompt 库和风格模板;素材筛选成本——生成量越大,从大量输出中筛选可用素材的人工耗时越长;精修与落地成本——AI 出图很少能直接交付,品牌定稿通常需要设计师在 Photoshop 中做二次精修。这些隐性成本往往数倍于订阅费用本身。

免费的真相:Midjourney 从一开始就没有把"免费额度"作为获客手段。它的策略更像"先付费,后体验"。这意味着它对轻度尝鲜用户不够友好,但对认真做视觉产出的用户反而更清晰——你不用猜测免费额度什么时候用完,一切都在订阅计划中透明可见。

Midjourney 的主要功能

文本到图像生成:通过自然语言提示词快速生成多风格视觉草案。V8.1 默认使用标准分辨率(Standard Resolution),速度比 V7 的草稿模式还快,适合快速迭代探索。HD 模式可生成约 2K 分辨率的图像无需额外放大。

图像提示(Image Prompts)与图像权重(Image Weight):用户上传参考图,通过 --iw 参数控制参考图对最终输出的影响程度。--iw 值越高,输出越贴近参考图的结构与细节;越低则提示词主导。V8.1 重新恢复了这一在 V7 社区中极受欢迎的功能。

风格参考(Style Reference / --sref:上传一张参考图作为风格指引,Midjourney 提取其色调、纹理和整体氛围,应用于新生成的图像。V8.1 中官方明确表示"Moodboards 和 sref 现在超级稳定,效果会让你爱不释手"。这个功能是品牌风格统一的核心工具。

角色参考(Character Reference / --cref:上传角色图像,系统将其作为角色外观参考,在多张输出中保持角色一致性。这对于漫画、绘本、系列插画等需要角色身份统一的项目至关重要。

变体(Vary)与放大(Upscale):在已有结果上生成变体或放大分辨率,不需要每次从头生成。V8.1 新增了"Run as HD"按钮,可将标准分辨率作业一键转为 HD 模式重新生成。

参数化控制系统:Midjourney 的参数体系是其区别于大多数文生图工具的核心壁垒。核心参数包括:--ar(画幅比例)、--stylize(风格化强度,范围 0-1000)、--chaos(结果随机性,范围 0-100)、--v(模型版本选择)、--sref(风格参考)、--iw(图像权重)、--hd(高清模式)。这些参数的组合使用,使得团队能够把一次偶然的风格发现,固化为可复用的参数模板。

网页工作流(Web Editor):自 V6.1 起推出的 Web 编辑器,将图像编辑、平移(Pan)、缩放(Zoom Out)、区域变体(Vary Region)和局部重绘(Inpainting)整合到统一界面。同时支持 Discord 频道与 Web 房间之间的对话同步。

专家视点——隐藏联动:Midjourney 真正的工程价值不在于任何一个孤立功能,而在于"提示词 → 参考图 → 参数 → 变体 → 放大 → 风格固化"形成了一个完整的探索闭有。具体来说:先用文本提示词发散方向 → 用 --sref 锚定风格基调 → 通过 --stylize--chaos 控制风格介入程度和随机性 → 用变体在确认的方向上微调 → 用 HD 模式出最终高清版 → 将最终确认的参数组合保存为团队模板。这个闭有越成熟,团队对新项目的启动速度就越快。

Midjourney 的模型与版本演进

Midjourney 的版本演进和基础大模型的"参数规模竞赛"不太一样:它的每次升级价值很少体现在 benchmark 排名上,而更体现在"审美是不是更稳""结构是不是更准""参考图是不是更听话""风格是不是更能复现"这些创作者真正在意的维度上。

主线发布

  • V8.1 Alpha(2026-04-14):当前默认模型。审美风格回归 V7 的稳定性基调;HD 模式速度提升 3 倍、成本降低 3 倍;标准分辨率速度提升 50%、成本降低 25%,全质量下的标准分辨率比 V7 草稿模式还快。重新引入图像提示(Image Prompts)与图像权重(--iw)功能。新增 Prompt Shortener(提示词缩短器)与更新版 Describe 工具(生成更长的详细提示词)。已推出草稿模式(Draft Mode)和随机风格功能(Random Styles)。

  • V8 Alpha(2026-03-17):新一代模型主线开启,强化模型底座,为后续的编辑、放大与视频链路升级做架构准备。V8.0 已在 V8.1 发布数周后下线。

  • V7(2025-04-01):长期主力版本。强调高一致性的风格表现与参数控制体验。--sref 和 Moodboards 在该版本中达到高度可用状态,成为社区广泛使用的核心工作流。

  • V6.1(2024-07-30):进一步优化写实质量与提示词遵循能力。同期正式推出 Web 编辑器,将图像编辑、平移、缩放、区域变体和局部重绘整合到单一网页界面,标志着 Midjourney 从"Discord 附属工具"向"独立 Web 平台"的关键转型。

候选验证

  • V6(2023-12-21):从头训练的模型,历时 9 个月。显著提升文本渲染能力(能在图像中生成可读的文字)和提示词的文字遵循能力。此为 Web Alpha 版本的起点。

  • V5.2(2023-06):引入"美学系统"和"Zoom Out"扩图功能,支持基于已有图像向外生成周围有境。Vary(Region)区域变体功能在该版本发布。

  • V5.1(2023-05):比 V5 更具风格化倾向,同时推出了更"字面意义"的 RAW 模式。同期从关键词屏蔽系统切换到 AI 驱动的审核系统,允许上下文敏感的词使用。

  • V5(2023-03-15):在写实感和"恐怖谷"问题上取得明显突破,图像质量飞跃式提升。

版本阅读方式:Midjourney 的主版本通常以 Alpha 形态先在 alpha.midjourney.com 发布,社区测试数周后在主站和 Discord 全面推送。关注版本发布的最佳信息源是 updates.midjourney.com 和官方 Discord 的 #announcements 频道。

Niji 分支:Midjourney 还有专门针对动漫风格的 Niji Journey 分支。Niji V6 于 2024 年 1 月发布,Niji V7 于 2026 年 1 月发布,改进了动漫连贯性、提示词理解、文本渲染和 --sref 表现。

Midjourney 的技术优势

机制 → 效果 → 场景:Midjourney 长期将模型调优重点放在视觉审美与风格凝聚力上,而不是单一追求"更逼真"这一维度。其训练策略和损失函数设计更倾向于偏好那些在色彩和谐、构图平衡、光影协调上表现更好的输出。效果是,它在概念海报、品牌情绪图、插画和时尚视觉这类需要"气质统一"的场景里更容易出片。适用场景是,凡是需要"传递一种感觉"而不是"精确还原一个物体"的任务,Midjourney 的优势更明显。

参数体系的设计哲学--ar--stylize--chaos--sref--iw 等参数不是简单的数值滑块,而是对模型生成空间的结构化控制。--stylize 控制的是"模型对美学的介入程度"——值越低,模型越严格遵循你的提示词原文;值越高,模型越倾向于用自己的审美偏好"美化"结果。--chaos 控制的是"输出多样性"——低 chaos 每次输出更接近,高 chaos 差异更大。这套体系让团队能逐步把偶然性收束成可复用的方法论。对工作室来说,这比单纯多出几张好看的图更重要,因为可复用才是真正的生产力。

Google Cloud TPU 基础设施:自 V4 版本起,Midjourney 基于 Google Cloud TPU 进行模型训练和推理。这一选择相比自建 GPU 集群降低了基础设施管理成本,同时利用 Google 的全球网络加速图像生成服务的响应速度。

内容审核机制演进:早期 Midjourney 依赖关键词屏蔽系统(禁止某些人名、宗教词汇等),引发了不少关于审查的争议。2023 年 5 月,Midjourney 切换到 AI 驱动的审核系统,可以分析提示词的上下文语境来决定是否拦截,而不是简单地屏蔽单词。例如,用户现在可以生成包含"Xi Jinping"的肖像,但系统会阻止生成该人物被逮捕等争议性场景。这种机制在保留创作自由度和合规红线之间找到了工程化的平衡点。

边界——不适合什么:Midjourney 最不擅长的是强流程化、强素材资产治理、强本地化合规的企业场景,也不适合作为结构化图像编辑系统使用。它不适合制作精确的产品渲染图(要求尺寸和材质完全可控)、不适合医学/工程等需要精确结构表达的场景、不适合对数据主权有严格要求的组织。它的定位是"视觉前端发动机",不是全套设计协作平台。

Midjourney 的使用方式

Midjourney 提供了两种核心使用入口,分别对应不同的工作流偏好。

Web 端(alpha.midjourney.com):这是当前推荐的主要入口。支持可视化管理生成记录、创建 Moodboards、管理和复用风格参考、批量操作。V8.1 的所有功能(HD 模式Image Prompts、Prompt Shortener、Describe 工具)都可以在 Web 端直接使用。Web 界面还支持"Run as HD"一键切换,以及草稿模式(Draft Mode)与随机风格等功能。

Discord Bot:在官方 Discord 服务器中使用 /imagine 命令,或邀请 Midjourney Bot 到自己的服务器。适合社区协作、即时反馈和快速测试。Discord 端的核心优势在于社区生态——你可以在 #tutorial#show-and-tell 等频道实时看到其他人的 Prompt 参数和结果。

建议的工作流程

  1. 在 Web 端用简单提示词(英文最佳)进行第一轮方向探索
  2. 锁定方向后,通过 --sref 或 Moodboard 锚定风格基调
  3. --stylize--chaos 微调风格介入程度和多样性
  4. 在确认的方向上使用变体(Vary)进行精修
  5. 使用 HD 模式或"Run as HD"按钮生成最终高清版本
  6. 将最终使用的提示词和参数组合保存为团队可复用的模板

3 分钟快速上手:访问 alpha.midjourney.com → 输入一个简单英文提示词(如 "minimalist coffee shop interior, warm lighting")→ 观察 4 张输出 → 点击其中一张的 Vary 按钮生成变体 → 尝试添加 --ar 16:9 改变画幅 → 再添加 --sref 加上一张参考图。这个过程能最快判断你是否喜欢它的审美与控制体系。

中文用户使用边界:Midjourney 面向全球用户提供服务,但主要界面、文档和社区沟通仍以英文为主。中文用户的最佳实践是使用英文提示词,或中英混合提示词(英文为主,中文为辅描述风格)。支付可用性、访问体验和账号有境需按当地网络与账单条件评估。目前暂无官方独立的中国大陆本地化产品与本地化计费体系公告。

Midjourney 的产品定价

Midjourney 采用纯粹订阅制,不设按量计费或免费模式。核心分四档,年付通常提供约 20% 的折扣。

方案 月付 年付(月均) 并行上限参考 核心差异化能力
Basic $10/月 ~$8/月 约 3 个并发 有限快速模式时长,适合入门探索
Standard $30/月 ~$24/月 约 15 个并发 无限慢速模式 + 适量快速模式,高频个人创作者首选
Pro $60/月 ~$48/月 约 30 个并发 更多快速模式时长,隐身模式生成(Stealth Mode)
Mega $120/月 ~$96/月 约 60 个并发 最大快速模式时长,适合重度生产团队

计费说明:具体各方案的快速模式时长限制、并发数量、隐身模式可用性等详细规格,以官网订阅页面实时信息为准。年付方案相比月付通常更具性价比。所有订阅计划内生成图像的商业使用权范围,需按官方 Terms of Service 执行,不同套餐可能存在差异。

退款与条款:以官方账单页面和 Terms of Service 为准。建议采购前仔细阅读商业使用条款,尤其是涉及版权诉讼影响期间的使用限制。

Midjourney 的应用场景

广告与品牌创意:在提案阶段快速生成多版视觉方向,帮助客户在投入正式设计前确认风格基调。传统流程中,一个方向的视觉提案可能需要设计师 1-2 天产出概念稿;Midjourney 可以将"拿到可讨论的方向图"压缩到 10-30 分钟。核验重点:确认最终选用的风格是否能通过 --sref 和 Moodboard 固化,确保后续批量产出的一致性。

插画与概念设计:用于角色设计、场景氛围图、世界观探索的前期制作。角色参考(--cref)功能可以保持同一角色在多张图片中的外观一致性,这对漫画、绘本和游戏美术尤其重要。核验重点:测试 --cref 在不同场景、不同角度下的角色还原度。

电商与社媒内容:低成本批量生成风格统一的视觉素材。例如跨境电商的产品场景图、社媒节日营销海报、种草内容头图。核验重点:评估素材筛选效率——生成量越大,筛选和精修的人工成本越容易超过订阅费用本身。

影视分镜与提案:将创意文本快速转化为可视化的分镜图像或概念提案图。Midjourney 的强风格化能力在这里是优势——它提供的不是"精确的分镜",而是"氛围和情绪的可视化",帮助团队在正式制作前对齐视觉想象。核验重点:Midjourney 不适合需要精确镜头参数(焦距、光圈、机位高度)控制的场景。

降本增效量化推演(Rule D 强制)

  • 新媒体运营写周报配图:传统流程中,运营人员需从图库搜索PS 改图、或请设计师出图,单张图耗时约 30-60 分钟。Midjourney 可将"从文案到可用配图"的时间压缩至 5-10 分钟,提效约 5-10 倍。
  • 品牌设计师出概念方向稿:传统流程中,接到 Brief 到产出 3-5 个方向的概念图,需要 0.5-2 天。使用 Midjourney 可将"首轮方向产出"压缩至 15-45 分钟,提效约 8-15 倍。
  • 游戏美术前期概念探索:传统流程中,角色/场景概念探索需要艺术家手绘多版草图,每版 2-6 小时。Midjourney 可在 10-20 分钟内生成 20-40 个变体供筛选,提效约 10-20 倍。

(以上推演基于行业经验,非官方承诺。实际提效幅度取决于团队对参数体系的熟练度和筛选效率。)

降维打击场景:风格情绪图、概念海报、角色世界观探索、客户提案前的方向图、社媒批量视觉内容——这些是 Midjourney 最舒服的使用区间。

不适用场景:需要精确产品渲染(每颗螺丝钉位置可控)、医学/工程结构图、企业级素材资产管理、强合规本地私有化部署的场景,不适合将 Midjourney 作为核心生产系统。

Midjourney 的适用人群

个人创作者:插画师、平面设计师、内容创作者、独立出版人。适合需要高频视觉产出且对审美质量有要求的个体。前置条件是具备基本的英文提示词写作能力和参数调节意愿。

小型创意团队:广告公司、品牌工作室、游戏美术团队、短视频 MCN。Midjourney 的价值在于把团队的视觉探索效率拉高一个量级。需要投入的成本不是订阅费,而是团队沉淀 Prompt 库和风格模板的时间。

教育与研究领域:视觉传达专业的教学工具AI 与创造力研究的实验平台、创意工作坊的实践工具。适合用于探索 AI 辅助创作的教学和研究。

广告与营销从业者:社媒运营、电商设计师、品牌策划。Midjourney 在"快速产出大量好看但不一定精确的视觉内容"这个场景里基本没有对手。

劝退/不适用人群

  • 需要精确产品渲染图和工程结构图的工业设计师和产品工程师
  • 需要严格私有化部署或数据主权合规的组织(如金融机构、军工企业)
  • 需要将图像生成嵌入自动化业务流水线的开发团队(无公开 API)
  • 对 AI 版权风险零容忍的企业法务部门(需密切关注多起集体诉讼进展)
  • 没有英文基础且不愿意学习参数体系的内容创作者

Midjourney 的总结与展望

Midjourney 的长期价值在于"审美表现 + 参数控制 + 社区经验"的组合,而不仅是单次生图质量。它把 AI 视觉工具做成了一种接近创意习惯的工作方式——设计师不是在和一个"随机出图的黑盒"打交道,而是在用一套可控的参数语言和模型协作。这也是它在经历了 V5 到 V8 的多轮迭代后,仍然保持强品牌力和用户忠诚度的根本原因。

随着 V8 系列持续推进,值得关注的几个方向:V8 正式版的稳定性与功能完善度(尤其是编辑Inpainting、Outpainting 等后处理能力的升级);网页工作流是否会替代 Discord 成为主力入口;Midjourney 在视频生成和硬件方向(官方已公布硬件项目和 Medical 方向)的探索能否形成第二增长曲线。

不适配边界重申:如果团队最需要的是高质量创意发散与风格探索,Midjourney 是当前最成熟的选项之一。但如果组织更需要强治理、强 API、强企业集成,它更适合作为"前期创意引擎"而非唯一生产平台。对于已在使用 Midjourney 的团队,建议建立配套的提示词管理规范和出品质量标准,将隐性成本控制在可接受范围内。

采购/采用风险评估

  • 版权诉讼不确定性:迪士尼、有球影业、华纳兄弟探索等大型版权方已对 Midjourney 提起诉讼。如果法院裁定 Midjourney 侵犯版权,可能会影响其训练数据的合法性、模型的可用性以及用户生成内容的商业使用范围。企业采购前应要求法务部门评估这些诉讼的潜在影响。
  • 无私有化部署选项:Midjourney 当前仅提供 SaaS 订阅,无法本地部署。对数据主权有刚性要求的组织,不适合以 Midjourney 作为核心生产工具。
  • 无公开 API:无法像 DALL-E 或 Stable Diffusion 那样通过 API 集成到自有产品线。如果需要自动化图像生成流水线,需考虑其他具备 API 能力的替代方案。
  • 建议试点方式:先在一个小团队中(2-5 人)试用 Standard 方案 1-2 个月,验证其在真实工作流中的提效幅度和隐性成本,再决定是否扩展至全团队。

相关工具:MidjourneyStable Diffusion

竞品对比

对比维度 该工具 竞品 A 竞品 B
核心差异
价格
目标用户 --

版本信息

  • V8.1 Alpha :V8.1 Alpha 提供更稳定审美风格,HD 模式提速降本,并恢复图像提示与更强 Prompt 工具链。
  • V8 Alpha :V8 主干预览版本,强化模型底座并面向后续编辑、放大与视频链路升级。
  • Version 7 :V7 作为长期主力版本,强调高一致性风格与参数控制体验。
  • Version 6.1 :V6.1 进一步优化写实质量与提示词遵循能力。

用户评价

  • 加载评价中...