MiniMax 今天正式发布 H3,把它定位成「全模态生成模型」:文本、图像、视频、音频都能进,也都能改,最高 2K、最长 15 秒,原生双声道音频跟画面一起出。文生视频 0.5 元/秒,2K 档 0.8 元/秒。
几个能单独拎出来看的点。
Artificial Analysis 的视频编辑榜,H3 排到全球第一。文生视频和图生视频榜单前三,对标的是 Seedance 2.0 和 Gemini Omni Flash。
模型权重计划「未来几天内」开放,企业能拉回自己机房跑。对广告、影视这种不愿意把角色素材和客户品牌资产送到闭源 API 上的行业来说,这一条可能比画质排名更关键。
H3 舍弃了上一代 Hailuo-02 的架构,换成 H3-Omni Transformer,让「理解」和「生成」两部分各按自己的负载跑。2K 画质靠的是模型「重看一遍」自己的低清结果再生成一遍,没有外挂超分模块。
机器之心实测里反复拿「华强买瓜」做模态叠加测试:换人物、换背景、换语言、改台词、调画幅、续创作,口型和音色基本稳得住。这指向一件事:它想接管的范围从文生视频那一段,延伸到了素材生成到配音、特效、排版这条原本被 AE 和剪映切开的后期链路。
MiniMax CEO 闫俊杰之前在全员信里说过会拿 1% 股份支持开源。从 M 系列语言模型到视频旗舰 H3 都开源,这条路线在国产大模型里目前没有第二家这么做。
二级市场反应很直接,H3 发布当天 MiniMax 股价一度涨超 14%。
Mini Max H3发布MiniMax人工智能模型人工智能


