MiniMax H3 全模态视频模型发布及定价策略
TECH

MiniMax H3 全模态视频模型发布及定价策略

30+
Signals

战略概览

  • 01.
    MiniMax 于2026年7月31日通过其平台API(模型ID为MiniMax-H3)和消费者端海螺AI应用正式发布通用全模态视频生成模型H3,可生成原生2K分辨率、4至15秒的视频片段,立体声音频与视频在同一推理过程中生成。
  • 02.
    H3 在2K分辨率下的定价约为每秒0.13至0.14美元,在768p分辨率下为每秒0.09至0.10美元,MiniMax表示这不到主流2K竞品每秒价格的三分之一。
  • 03.
    MiniMax 计划在‘未来几天内’根据MiniMax社区许可证开源H3的模型权重,允许免费非商业使用,年收入低于2000万美元的企业可免费用于商业用途(需署名)。
  • 04.
    截至发布当日,H3 在 Artificial Analysis 的盲测偏好视频编辑排行榜上以5,043个样本获得1,130的Elo分数位居榜首,同时在文本到视频类别中排名第二,在图像到视频类别中排名第三。

深入H3引擎室:语言作为通用接口

MiniMax 对 H3 的定位是,语言而非模态才是组织原则:语言作为可泛化的桥梁与解释器,将‘任务’统一为开放、可描述的形式 [1]。这正是将文本、图像、音频和视频视为单一共享上下文而非拼接多个专用模型的架构基础。MiniMax 将性能跃升归因于四个组件:上下文全模态表示层、重建的H3-VAE分词器(据称有效序列长度提升4倍)、H3-Omni Transformer架构(训练吞吐量提升近30%)以及用于恢复高分辨率细节的上下文内再生步骤 [1]。这些数据转化为具体的、可测试的限制:单次生成最多可接受九张参考图、三段参考视频和三段参考音频(共12个文件),提示词最长7,000字符,输出限制为24fps、原生1440p(2K)[2][3]。该模型在生成视频的同时也生成立体声音频,而非事后合成,适用于4至15秒的视频片段 [4]。对实际创作者而言更关键的是基于指令的编辑模式:可在保留画面构图、镜头运动和色彩分级不变的前提下,替换角色、物体、背景或屏幕上的文字/品牌 [2]。这与‘提示-重生成’的工作流有本质区别——更接近非破坏性编辑而非盲目的文本到视频生成,也可能是H3在Artificial Analysis盲测视频编辑排行榜上位居榜首的能力基础 [5]

披着功能发布外衣的价格战

剥离模型卡片语言后,H3 更像是一次定价策略而非纯粹的技术发布。MiniMax 对2K分辨率视频的定价约为每秒0.13至0.14美元,768p则约为每秒0.09至0.10美元,公司称这不到主流2K竞品每秒价格的三分之一,也低于竞争对手720p输出价格的一半 [1]。市场反应随之而来——MiniMax 在香港上市的股票在发布日盘中涨幅介于13%至17%之间 [6],花旗、高盛和美国银行随后均发布买入评级,其中花旗特别指出开源计划才是需求驱动因素而非模型质量本身:‘我们认为,H3即将推出的开源计划可能推动更广泛的采用’ [6]。这是一个值得注意的信号——分析师的评级上调押注的是分发经济(免费权重吸引年收入低于2000万美元的开发者生态,需署名),而非单一基准测试的胜利 [7]。该定价本身也处于AI视频生成领域的更广泛价格战之中,MiniMax 与字节跳动在同一天发布竞争模型,2K分辨率下的每秒成本已成为独立的竞争杠杆 [8]。花旗未明说的风险是:基于定价/开源叙事的股价上涨仍需转化为API收入,‘采用驱动’理论才能兑现,而这一结论还需数月才能显现。

中国视频生成竞赛进入同日对决

H3 并非在真空中发布——字节跳动在同一天即2026年7月31日发布了其竞品模型Seedance 2.5,媒体报道将这两家公司描述为‘正在缩小’与美国领先模型Sora和Veo之间的差距 [9]。其规格清晰地表明了定位:Seedance 2.5 支持单次生成最长30秒、原生4K分辨率,并最多支持50个全模态参考,远超H3的4至15秒、原生2K [9]。从纸面数据看,字节跳动在原始能力上胜出。但MiniMax并未在规格表上竞争——它竞争的是实测输出质量和价格,而对实际创作者而言,衡量标准是质量而非标题中的时长,H3目前在这一指标上领先:基于5,043个盲测样本获得1,130的Elo分数,使其在Artificial Analysis的视频编辑排行榜上位居第一,文本到视频排名第二,图像到视频排名第三 [5]。媒体报道直接将这场竞争描述为MiniMax在价格和开放性上‘挑战’字节跳动,而非在规模上竞争 [10],其他报道也强调了这一分化:一款优化用于可编辑、可控、原生音频片段的全模态模型,而非追求最长或最高分辨率的单次生成 [11]。结果是,2026年末市场对AI视频需求的两种不同押注——MiniMax押注价格加精准编辑,字节跳动押注原始生成上限。

发布会背后的诉讼阴影

H3 的发布正值联邦诉讼进行之中,而非诉讼结束后。2025年9月,迪士尼、漫威、卢卡斯影业、二十世纪福克斯、环球、梦工厂动画和华纳兄弟探索联合起诉MiniMax及其关联实体,指控海螺AI平台生成未经授权的达斯·维达、蜘蛛侠和小黄人等角色内容,并以‘口袋里的好莱坞工作室’为卖点进行营销 [12]。此前一个月,这些公司已发出停止侵权函 [12]。2026年5月——H3发布前约两个月——美国地方法院法官斯坦利·布鲁门菲尔德驳回了MiniMax的驳回动议,这意味着该公司在面临美国法院诉讼的同时,正推出其迄今为止最受关注的产品 [4][13]。所有发布报道、股票分析师报告或基准测试胜利均未直接提及该诉讼——胜利叙事(排行榜领先、价格压制、开源)与未解决的法律风险正平行运行,由不同媒体面向不同受众报道。这一点必须明确指出:一款能够逼真复现影视公司角色的生成式视频模型,正是该诉讼所针对的产品类别,而H3的扩展能力(多参考输入、V2V动作迁移、模型内角色替换)并未明显降低风险——反而扩展了诉讼已针对的同一底层平台。

开放权重,封闭问题:社区真正争论的是什么

MiniMax 官方消息‘未来几天内’发布权重,比开源社区内部流传的信息模糊得多。社交媒体讨论明显分化为两个不同受众群体接收到的截然不同信号。X平台上的宣传评论聚焦于成品:原生2K/15秒输出、统一的全模态控制、与字节跳动此前Seedance 2.0层级的价格对比,以及早期第三方平台集成——均符合协调一致的发布日宣传攻势,该渠道未出现任何批评声音。相比之下,Reddit的r/StableDiffusion社区则将‘开源’承诺视为需验证的声明而非应全盘接受的断言。ComfyUI的创建者亲自确认,开源权重版本将与付费API提供的模型相同,而非缩水版,并且可在配备12GB显存的消费级RTX 3060上运行(尽管速度较慢)——这一说法比MiniMax自身‘未来几天’的表述更具具体性和实质性。但同一社区也对营销话术提出质疑:多名用户指出,RTX 3060的运行速度实际上比同类现有本地模型在相同硬件上的表现更慢,关于‘消费级硬件’的说法是诚实定位还是对模型实际运行需求的低估,引发了实时辩论。一名Reddit测试者通过API对比现有开源模型,报告了有利的质量表现;但也有用户在同一讨论中指出输出存在轻微的合成感(‘塑料感’视觉纹理)。YouTube评测者立场介于两者之间:动手测试者确认广告中的全模态输入限制和消费级GPU设计意图如描述般运作,但一项创意测试——基于分镜表从角色参考图构建多镜头场景——在一致性上表现良好,却在高接触动作中出现物理错误,这提前预示了Reddit社区后续将更系统性探讨的‘表面光鲜’与‘实际执行’之间的差距。综合来看,两个社区之间的鸿沟本身就是故事:宣传层面承诺开放与可及性,而技术社区的实际基准测试——硬件特定、可复现、可溯源——才是‘消费级’真实评价仍在激烈争论的战场。

历史背景

影视公司在提起诉讼前向MiniMax发出停止侵权函,指控海螺AI服务涉嫌侵犯版权。
影视公司于美国加利福尼亚州中区联邦法院联合对MiniMax及关联实体提起版权侵权诉讼,指控海螺AI生成未经授权的达斯·维达、蜘蛛侠和小黄人等角色内容。
联邦法官驳回MiniMax驳回诉讼的动议,意味着案件在H3发布时仍处于活跃状态。
MiniMax发布H3,字节跳动同日发布竞品模型Seedance 2.5,两者均旨在缩小与Sora和Veo等美国视频模型的差距。

关键关系图

关键玩家
主题

MiniMax H3 全模态视频模型发布及定价策略

MI

MiniMax (Shanghai Xiyu Jizhi Technology Co. Ltd.)

Chinese AI startup that developed and released H3 and the Hailuo AI platform it runs on; also the defendant in an active Hollywood copyright lawsuit.

BY

ByteDance

Competitor that released rival video model Seedance 2.5 on the same day as H3's launch; H3 is explicitly positioned as undercutting ByteDance's Seedance line on price.

AR

Artificial Analysis

Independent benchmark platform whose blind-preference leaderboard ranked H3 #1 in Video Editing and top 3 in both Text-to-Video and Image-to-Video.

DI

Disney Enterprises, Marvel Characters, Lucasfilm, Twentieth Century Fox, Universal City Studios, DreamWorks Animation, Warner Bros. Discovery

Hollywood studios that jointly sued MiniMax for copyright infringement via the Hailuo AI service in September 2025; the suit survived a motion to dismiss in May 2026 and remains active as H3 launches.

FA

fal.ai

Official API partner bringing the open-weight MiniMax H3 model to third-party developers.

GO

Goldman Sachs, Bank of America, Citi

Investment banks that issued Buy ratings on MiniMax following the H3 launch, with Citi specifically flagging the open-sourcing plan as a potential adoption driver.

事实来源

14 条引用
  1. [1] MiniMax H3 official blog announcement
  2. [2] MiniMax H3 model page - OpenArt
  3. [3] MiniMax H3 Is Out: Here's What the New AI Video Model Can Do - Nerdbot
  4. [4] MiniMax H3 Opens AI Video to Developers as Copyright Lawsuit Clouds Every Clip - Tech Times
  5. [5] Video Editing Leaderboard - Artificial Analysis
  6. [6] China's MiniMax Launches H3 AI Model, Shares Jump on Multimodal Push - Investing.com
  7. [7] MiniMax H3 (Hailuo 3) Explained - OrcaRouter
  8. [8] AI Video Price War: $/Second Ad Economics at 2K - Digital Applied
  9. [9] MiniMax and ByteDance Ship Rival AI Video Models as China Closes the Gap on Sora and Veo - StartupFortune
  10. [10] Video AI: MiniMax Challenges ByteDance With Low Price, Open Weights in New H3 Model - SCMP
  11. [11] MiniMax Releases MiniMax H3: An Omni-Modal Video Model - MarkTechPost
  12. [12] Major Studios File Copyright Lawsuit Against Chinese AI Company - PPC Land
  13. [13] MiniMax Disney Copyright Lawsuit AI - CryptoBriefing
  14. [14] fal Launches MiniMax H3 as an Official API Partner - OpenPR

来源文章

Top 5

THE SIGNAL.

Analysts

认为H3权重的计划开源可能扩大采用范围,但警告竞争正在加剧,市场需要看到H3转化为收入的证据:‘我们认为,H3即将推出的开源计划可能推动更广泛的采用。’

Citi analysts
对H3的开源策略作为需求驱动因素持谨慎乐观态度

认为闭源模型相比大语言模型等领域,长期阻碍了视频生成的迭代速度和开放性,将H3计划开源权重视为弥补这一差距:‘闭源模型长期主导视频生成,迭代速度较慢,生态系统开放性不如大语言模型等领域。’

MiniMax (company statement)
将H3定位为挑战视频生成领域的闭源主导地位
The Crowd

MiniMax H3 is now live on Topview We're excited to partner with @Hailuo_AI @MiniMax_AI to bring MiniMax H3 to creators. Native 2K, 15s clips, and stronger multimodal control across text, image, audio, and video. Only 30% of Seedance 2.0's price. Ultra Annual users get 60...

@@TopviewAIhq255

Introducing MiniMax H3, our next-gen open-weight multimodal video model, built for general intelligence beyond single-task generation. H3 understands text, images, video, and audio together, interpreting motion, sound, emotion, and cinematography as one unified creative...

@@SarahAnnabels168

MiniMax H3 just dropped it keeps one subject consistent while transforming video scene around it native 2k, up to 15 sec, from $0.081/sec, beats sd2 in real commercial tests handles brand text and instructions well built for actual ads and ecommerce use, not just demos

@@israfill160

release date for MiniMax- H3 open weight is out

@u/HugeConsideration211174
Broadcast
MiniMax H3: Hands-On with the New Open-Weights AI Video Model

MiniMax H3: Hands-On with the New Open-Weights AI Video Model

MiniMax H3 Dropped: FREE Open Source 2K Video AI That BEATS Paid Tools?

MiniMax H3 Dropped: FREE Open Source 2K Video AI That BEATS Paid Tools?

FIRST LOOK: Minimax Hailuo H3 (SOTA AI Video Model)

FIRST LOOK: Minimax Hailuo H3 (SOTA AI Video Model)