MiniMax H3开源一周生态快速扩张,客易云关注视频AI迈入生产力新阶段
2026年8月3日,MiniMax正式开源新一代通用视频模型MiniMax H3。该模型是一个通用型全模态生成系统,能够统一理解由文本、图像、视频和音频构成的多模态上下文,生成最高2K分辨率、最长15秒、带有原生立体声音频的视频内容。在Artificial Analysis视频编辑评测榜中,H3的视频编辑能力排名全球第一。
从技术架构来看,H3与前两代模型最大的不同在于“打破任务边界”。传统视频生成模型通常将文生视频、图生视频、主体参考、动作参考等拆分为独立模块,而H3在预训练阶段就将这些任务统一建模,用自然语言描述任务关系。完整的H3系统由H3-Context-IR、H3-Base、H3-Regenerate-2K三个模块组成,其中H3-Base已开源并支持通过SGLang、vLLM、diffusers和ComfyUI等主流推理框架部署。
开源模型的生态成熟度正成为衡量竞争力的关键指标。H3开源24小时内,华为昇腾、摩尔线程、沐曦、海光信息、昆仑芯、天数智芯、壁仞科技、AMD、Intel等国内外芯片厂商,以及Hugging Face、魔搭ModelScope、ComfyUI、RunningHub等开发社区和上百家云推理平台,均完成Day 0适配接入。摩尔线程团队仅用3小时便打通了从SGLang-MUSA推理框架到高性能算子库的完整适配路径。
在商业应用层面,H3具备商用级多场景内容生成能力。有分析认为,视频模型的竞争正在从单次素材生成转向理解完整创作意图并参与广告、电商、游戏和设计等生产流程。H3在指令遵循、文字与品牌信息呈现、视频到视频动作迁移等方面表现出色,广泛适用于广告、品牌营销、电商、产品设计、游戏等商业场景。
定价与开源策略为H3的商业化提供了清晰路径。H3的2K分辨率视频生成价格为0.8元/秒,仅为行业同类旗舰模型的三分之一。这种“开放基础模型+保留高价值编排与高清API服务”的策略,既能扩大生态影响力,也为商业化保留入口。开源属性还支持企业本地化部署,满足安全合规需求。
行业分析认为,大模型竞争已从单纯提升智能上界,转向模型分层、全模态生成、Agent执行能力和单位任务成本的综合比拼。近两周OpenAI大幅下调GPT-5.6 Luna价格,Anthropic推出Claude Opus 5,国内Qwen3.8-Max和DeepSeek-V4-Flash相继上线。从DeepSeek到MiniMax H3,国产大模型的开源范围正从语言模型拓展到视频模型,推理效率与开源生态并重的新阶段正在加速到来。
更多推荐



所有评论(0)