8月6日消息,未来图灵获悉,MiniMax正式开源新一代通用多模态生成模型MiniMax H3,在Artificial Analysis视频编辑评测榜和Arena图生视频排行榜中均位列全球第一。在开源社区Hugging Face上,H3热度已升至第一名,超过DeepSeek V4 Flash。Stable Diffusion创始人Emad Mostaque、a16z合伙人Justine Moore等业内人士公开发文点赞。

H3的核心突破在于打破任务和模态边界。传统视频生成将文生图、图生视频、视频编辑、音频生成等切割为独立模型,H3首次实现对文本、图像、视频、声音组成的多模态上下文的统一理解,并输出原生双声道音视频,最高支持15秒2K分辨率。MiniMax在技术博客中写道:“语言是泛化的桥梁,任务以一种开放描述的形式得到统一,这是H3广泛的指令理解能力的根源。”
成本是另一张牌。MiniMax称H3在2K分辨率下每秒价格不到主流模型的1/3,768P分辨率下不到1/2。价格优势来自架构效率的大幅优化——全新H3-VAE实现4倍序列长度压缩,训练和推理成本大幅降低。公司还透露,H3设计初期就考虑了多款国产芯片的兼容性,24小时内获超百家国内外合作伙伴首日适配及接入。
资本市场反应积极。截至8月5日收盘,MiniMax涨幅超10%。杰富瑞重申买入评级,目标价1118港元,称MiniMax H3 的推出进一步巩固 MiniMax 在 AI 视频生成领域的竞争地位,其成本优势将有助于拓展企业客户及加速商业化落地。花旗维持买入评级,认为H3具备商用级内容生成能力。MiniMax计划在未来几天内开放模型权重。