Midjourney(midjourney.com)是一个订阅制的 AI 图像与视频生成服务:输入一段文字提示(prompt),模型一次返回四张候选图,随后可以放大分辨率、生成变体、局部重绘、扩展画布,或把图像转成几秒钟的短视频。它解决的问题是把「脑海中的画面」快速变成可用的视觉素材,不需要绘画或建模技能。与同类产品的可核实差异在于:它完全闭源、只卖订阅、不设免费档,以风格化、偏「美学优先」的出图风格著称;运营方 Midjourney, Inc. 自称是自筹资金的独立研究实验室,官网首页目前的表述是「一个 60 人的社区资助研究实验室」。截至 2026-09-12,官方最新公开模型版本为 V8.2(2026 年 7 月发布)。

站点速览

  • 网址:https://www.midjourney.com/
  • 类型:AI 文生图 / 图生视频服务(闭源模型 + 订阅制)
  • 费用:四档订阅,Basic 10 美元/月、Standard 30 美元/月、Pro 60 美元/月、Mega 120 美元/月,年付约 8 折,见官方套餐对比(截至 2026-09-12)
  • 注册要求:浏览官网首页与帮助中心无需注册;生成图像必须登录账号并先订阅,官网与 Discord 均无免费试用(仅 niji·journey 手机 App 提供有限试用);须年满 13 岁
  • 界面语言:英语(未见官方多语言界面选项)
  • 上线时间:2022 年 3 月 Discord 服务器开放,2022 年 7 月 12 日进入公开测试

站点背景

Midjourney, Inc. 总部位于旧金山,由 David Holz 创立。Holz 此前是手势追踪硬件公司 Leap Motion 的联合创始人,离开 Leap Motion 后创办了 Midjourney(The Register 2022 年 8 月专访)。需要注意的是,公开报道对公司注册年份有 2021 与 2022 两种说法,可准确核实的是产品时间线:Midjourney 的 Discord 服务器于 2022 年 3 月 14 日开放,图像生成服务于 2022 年 7 月 12 日进入公开测试(Wikipedia 词条)。在上述专访中,Holz 称公司当时已经盈利,且没有接受外部投资——这一「自筹资金」定位至今仍写在官网的招聘与介绍文案中。

产品演进的关键节点:

  • 2022 年:服务以 Discord 机器人形态开放,用户在频道里用 /imagine 命令生成图像;同年模型快速迭代到 V4,并推出针对动漫风格的 Niji 模型(Wikipedia 版本表)。
  • 2023 年 9 月:推出 Vary (Region) 局部重绘,可对选中区域单独重新生成。
  • 2024 年 8 月:随 V6.1 发布推出网页版界面与网页编辑器,不再强制依赖 Discord(此前网页版曾要求用户先在 Discord 生成过一定数量的图像)。
  • 2025 年 4 月与 6 月:先后发布 V7 与首个视频模型 V1——图生视频,一次生成四段 5 秒短片,发布初期仅限网页端(TechCrunch 报道)。
  • 2026 年:V8 系列陆续发布,截至 2026-09-12 最新版本为 7 月 24 日上线的 V8.2,官方帮助中心称其重点是美学、画质与个性化。官网首页还列出软件、医疗、硬件等「未来项目」,多数标注 TBA。

Midjourney 官网首页:背景由大量用户提示词碎片组成,中央为品牌名与 Sign Up / Log In / Explore 入口

上图是官网首页。页面本身不展示功能细节,而是把访客引向登录、注册和 Explore 社区画廊;页脚自述「60 人的社区资助研究实验室」,并给出账单与媒体联络邮箱。

核心能力:从提示词到图像与短视频

按官方入门指南,基本流程是:订阅后在网页版 Create 页的 Imagine 输入框写下提示词,模型生成一组四张图,然后在此基础上继续加工。主要能力:

  • 文本生成图像:每次生成四张候选;可调整宽高比、风格化程度(Stylize)、模型版本等参数;另有面向动漫风格的 Niji 系列模型。
  • 修改与再创作:放大(Upscale)、生成变体(Variations)、扩展画面(Zoom Out / Pan)、局部重绘(Vary Region),以及用图像加文字指令修改画面的 Edit Model / 网页编辑器。
  • 参考控制:Image Prompts 用上传图像影响构图与配色,Style Reference 提取参考图的风格,Omni Reference 用于保持角色等主体的一致性;Personalization 与 Moodboards 用于定制个人风格。
  • 图生视频:把 Midjourney 生成或自行上传的图像转成短视频,套餐页面显示 Basic 档仅支持 SD 分辨率,Standard 及以上支持 SD 与 HD。
  • 双入口:同一账号既可在网页版操作,也可在 Discord 服务器或私聊中使用机器人命令;官方文档专门维护「Web vs Discord」的对照说明。
  • 社区画廊:Explore 页无需登录即可浏览公开热门作品(实测 2026-09-12 未登录可见 Top Day 榜单),按图片/视频分类,这也是官方所称「作品默认公开可见」的直接体现。

Midjourney 社区画廊 Explore 页:左侧为功能导航,右侧为公开热门作品瀑布流,无需登录即可浏览

上图是未登录状态下访问的 Explore 画廊:左侧导航列出 Create、Edit、Organize、Personalize、Moodboards 等网页版功能入口,右侧是按日排行(Top Day)的公开作品流,顶部可在 Images 与 Videos 间切换。

Midjourney 帮助中心的入门指南页:从订阅、生成第一张图到个性化设置的完整流程

官方帮助中心(docs.midjourney.com)是目前最完整的产品文档来源:除入门指南外,还逐条解释参数、GPU 计费、隐私模式与政策条款,本文的价格与规则均以这里为准。

订阅档位与计费方式

Midjourney 按「Fast GPU 时长」而非张数计费:每张图约消耗 1 分钟 GPU 时间,视频消耗的时长高得多。截至 2026-09-12 的官方套餐对比:

档位 月付 年付 Fast GPU 时长/月 Relax 模式 备注
Basic 10 美元 96 美元(8 美元/月) 3.3 小时(200 分钟) 无 视频仅 SD
Standard 30 美元 288 美元(24 美元/月) 15 小时 无限量图片 视频 SD & HD
Pro 60 美元 576 美元(48 美元/月) 30 小时 无限量图片 + SD 视频 含 Stealth 私密模式
Mega 120 美元 1,152 美元(96 美元/月) 60 小时 无限量图片 + SD 视频 含 Stealth,更多并发

官方套餐对比表:四档价格、Fast GPU 时长、Relax 模式与 Stealth 模式差异

几点补充(同一官方页面):额外 Fast GPU 时长按 4 美元/小时购买;Stealth 模式(作品不公开显示)仅 Pro 与 Mega 提供;通过在官网给图片打分可以赚取免费 GPU 时长;年付一次性付清、约当 8 折。取消订阅在当前计费周期结束后生效,当期不退款(服务条款 §8)。

版权与内容政策

作为 AI 生成内容平台,Midjourney 的规则分「你能拿作品做什么」和「平台与第三方在争什么」两层,都值得在使用前读一遍。

用户对生成物的权利(条款 §4 与商用说明):

  • 任何付费订阅用户(含 Basic)在法律允许的最大范围内拥有自己生成的图像与视频,可用于商业用途,取消订阅后依然有效。
  • 年营收超过 100 万美元的公司(及其员工)必须订阅 Pro 或 Mega 才能拥有并商用其生成物。
  • 放大(upscale)他人已生成的图像,所有权仍归原作者,使用需对方许可。
  • 反向义务同样明确:用户授予 Midjourney 对其提示词与生成物「永久、全球、可转授、免版税、不可撤销」的许可;默认情况下你的作品在社区中公开可见、可被他人 remix,只有 Pro/Mega 的 Stealth 模式可以不公开。

生成物的版权地位:Midjourney 官方明确不就版权问题提供法律意见。在美国,版权局 2023 年 2 月对《Zarya of the Dawn》的决定拒绝为 Midjourney 生成的单张图像提供版权登记,2025 年 1 月发布的《Copyright and Artificial Intelligence, Part 2: Copyrightability》报告重申仅凭提示词不构成人类作者身份——也就是说,「条款上归你所有」不等于「能在美国登记版权」,对需要排他性权利的商业用途(如品牌素材)这是实际限制。

平台自身的版权争议:2023 年 1 月,三位艺术家对 Midjourney、Stability AI 等提起集体诉讼(Andersen 案),指控模型训练使用了抓取自网络的海量图像;2025 年 6 月 11 日,迪士尼与 NBC 环球在加州中区联邦法院起诉 Midjourney,诉状称其是「无底洞式的抄袭」(Wikipedia 诉讼节);2025 年 9 月 4 日华纳兄弟探索另案起诉,11 月 4 日两案合并。截至 2026-09-12,案件仍在证据开示阶段、无实体裁决,Midjourney 以合理使用抗辩(fiund 案件追踪)。此外,社区准则禁止成人与血腥内容、禁止生成用于政治竞选的图像,平台设有 DMCA 删除通道。

适用场景

  • 概念探索与灵感稿:插画、概念设计、广告创意的早期方向探索,Holz 本人在采访中也把「给客户快速看方向」列为典型用法。
  • 内容生产的配图与素材:文章头图、社媒配图、演示文稿视觉,前提是接受上文提到的版权不确定性。
  • 动漫/风格化创作:Niji 模型与风格参考适合二次元及特定画风的批量尝试。
  • 短视频动效:把静态图转成几秒动效,用于社媒内容或创意预览。

局限

  • 无免费档、必须先付费:官网与 Discord 均无免费试用,最低门槛是 10 美元/月的 Basic(3.3 小时 Fast GPU),想零成本评估只能用手机 App 的有限试用。
  • 闭源且无公开 API:模型不开放权重,官方未提供公开 API 产品,自动化集成只能走第三方非官方渠道(条款明确禁止用自动化工具访问服务,有封号风险)。
  • 计费模型不直观:按 GPU 时长而非张数计费,视频与高清放大消耗显著更高,新手容易低估消耗速度。
  • 作品默认公开:非 Pro/Mega 用户的生成图公开可见且可被他人 remix,不适合未发布的商业项目。
  • 版权与诉讼风险:生成物在美国可能无法登记版权;针对平台的迪士尼/环球/华纳诉讼尚无结果,生成知名角色类内容的风险由使用者自担。
  • 内容边界:禁成人、血腥与政治竞选内容;条款含约束性仲裁与集体诉讼放弃(美国 AAA 仲裁)。
  • 仅英语界面:官网、文档与社区均为英语,无官方中文支持。

同类参考

  • DALL·E(OpenAI):集成在 ChatGPT 中的文生图能力,随对话使用,适合已在 ChatGPT 生态内的用户;出图风格与 Midjourney 取向不同。
  • Stable Diffusion(Stability AI):开放权重路线,可本地部署、自由微调,适合需要自控管线与私有部署的团队,与 Midjourney 的闭源订阅模式正好相对。
  • Adobe Firefly:Adobe 面向商用的生成式图像工具,主打训练数据来源合规,适合对版权确定性要求高的商业场景。

参考资料