MiniMaxH3 发布:模型从“生成”走向“商业级生产”

发布时间:2026-07-31 12:27

  7月31日,MiniMax发布新一代多模态生成模型 MiniMax H3,并宣布近期开源。作为 MiniMax 从“特化任务模型”迈向“通用多模态智能”的重要探索,H3不再以、、声音的生成、

  MiniMax H3支持文本、、音频和等多种输入形式,支持2K分辨率直出,可生成最长15秒的音画内容,在提升视听生成能力的同时,进一步降低高质量内容的创作和使用门槛。

  在模型效果方面,MiniMax H3具备商用级的多场景内容生成能力,在指令遵循、文字与品牌信息呈现、V2V Motion Transfer等方面表现出色,可实现精准、可控的多模态内容

  自成立以来,MiniMax坚持文本与多模态模型并行自研,已先后开源三代M系列文本模型。H3则是MiniMax推出的首款开源多模态生成模型。

  H3借鉴了文本模型发展过程中已经被验证的方法,包括复杂问题拆解、Reasoning、Scaling Context 和 Muon 优化器等,并将其应用到多模态理解、数据构建和模型训练中。围绕不同任务的理解和指令遵循,MiniMax 对数据体系进行了多轮迭代,提升模型面对开放输入和复杂指令时的泛化能力。

  MiniMax H3生成价格为0.8元/秒,仅为业内同类旗舰模型的三分之一。MiniMax通过高压缩 Tokenizer 降低生成所需的 Token 数量,实现了成本优化与效率的提升。针对长度、分辨率和多模态理解与生成负载差异较大的特点,MiniMax 在异构训练、负载均衡和 GPU 利用效率等方面进行系统优化,在追求模型效果的同时控制训练和推理成本。

  MiniMax H3将业内多模态模型的竞争进一步带向效果、成本、开放性与生态协同的综合维度,丰富了模型企业与国产 AI 芯片软硬件协同生态。与此同时,MiniMax 多模态路线进入了模型能力、训练效率、开源生态和行业应用协同推进的新阶段。

  “通过MiniMax H3,我们希望为更多企业和开发者、创

排行

精选