MiniMax用H3窃取大结果

2026-08-02|骡子马|8 个实体|7 条关系

知识图谱摘要

提及实体 (8)
关系 (7)
H3对比Seedance

文章将H3与Seedance 2.0进行详细对比,指出H3价格低但效果有差距

H3竞争Seedance 2.5

H3与Seedance 2.5存在直接市场竞争关系,且发布时间接近

MiniMax开发H3

MiniMax开发并发布了视频模型H3

H3集成LibTV

文中提到H3相当于给LibTV接腿,两者结合可抗击Seedance 2.5

H3相关孙笑川

H3对孙笑川的视频素材进行了方言转换和字幕包装测试

H3相关峰哥

H3生成了以峰哥为主角的测试视频,用于展示人脸生成效果的不足

H3相关昆汀

H3成功模仿了昆汀的导演风格生成茅台广告,展示了风格理解能力

MiniMax用H3窃取大结果

2026年8月2日 骡子马 葬AI


上周末MiniMax更新了H3,铺天盖地的测评啊,说什么找到Seedance 2.0的平替了。

此说法幽默的点有三:

第一,平确实是平了,价格只有Seedance 2.0的1/3。但便宜在如今的视频模型争雄中算啥优点啊,某些四线视频模型更便宜,你看他们上桌了吗?

还是那句话,如果创作者真就纯图便宜,就干脆All in旁白PPT漫剧了,视频模型厂也不用努力了,直接在家祈祷劣币驱逐良币了。

第二,实际用了一下,感觉MiniMax H3和Seedance 2.0还是有大概两成的差距。

比如我让他生成了一个「峰哥给买科技股的家人们道歉」的视频⬇️

可以明显看出,峰哥的脸如同抹了厚厚的粉底,质感达不到真人程度,只能和杜莎夫人蜡像馆掰手腕。

峰哥智慧的眼睛更是全程怒目圆睁,目光纹丝不动,犹如东方蒙娜丽莎,伪人感极强。

而且峰哥和背景的纳斯达克交易所就像在两个图层一样,没有丝毫融合的意思。

此类差距很难用「便宜」这个点来弥补:视频模型的能力遵循反向木桶原理,H3的能力上限是SOTA的80%,那无论生成几次也不会成为100%。

当然可能对有的人来说,80%也够了。那我没话讲。

第三是最幽默的,MiniMax H3刚发,Seedance 2.5嗷的一下就上线了。

be like:本来只是想默默炒作,结果现在还得跟祖宗对打,哥们根本没做好准备啊。

不过好歹是比Seedance 2.5发的早那么一点点,可以说是不幸中的万幸了。

无论如何,我还是紧急测了一下H3,生成了200多个视频之后得出的结论是:

MiniMax H3唯一真比其他视频模型强的地方,实则是跟「AI视频」这个概念最不沾边的地方,即与现实世界的关系。

简单来讲,如果别的AI模型是在做VR(虚拟现实),H3做的就是AR(增强现实)。

当用户像以前一样要求H3凭空生成一段AI视频,那它交付的成果就不尽如人意。

MiniMax自己估计也发现这个点了,所以直接转换重点:当用户要求H3调整本身就有的视频时,它反而能带来一些惊喜。

这波是曲线救模。

我举几个例子:

1.勇次郎的夏天出片版

首先是国产青春片之最《勇次郎的夏天》。我让H3把这个经典片段套进了博主@原来是陶阿狗君 的一段日剧跑特效视频里面⬇️

*左一是原视频,右一是成品

挺神的。从头到尾我都没打开剪映或其他后期软件,但生成的视频就跟我套了模板做的一样。这H3并非只是给参考视频换脸,感觉是真把原视频的编辑逻辑给理解明白了。

而且范小勤的形象、动作和声音都几乎没有变化。说明H3是懂克制的,不是一股脑从头扩散到尾,而是知道哪该保持原样、哪该推倒重建。很有主体性。

MiniMax H3的这个特性就很适合把自己做成后期软件。

对吧,以后虽然大家生成视频不用MiniMax,但生成完的视频都可以来MiniMax里走一遭,整点特效,加点包装,反正也便宜。

当别人家都在致力于把视频模型卷成AI Agent的时候,它直接把自己干成纯工具了。属于是给自己造出来一个生态位,不跟AI圈的哥们姐们同台竞技了。

只能说这MiniMax短期内确实窃取到大结果了,毕竟这赛道现在就它一个人啊。

2.《中国人能飞》MV

除了特效之外,我也想测一下H3对文字的表现能力。于是让它给最近爆火的《中国人能飞》做了个MV⬇️

不得不说这个效果确实不错。

当文字悬空时,字体协调,光泽动效也不low,而且也根据我的要求一直位于揽佬身后,没有挡住天才的面孔。

当文字贴在墙体上时,也不是生硬地平铺,而是符合空间结构和物理规则。

我都怀疑它们其实内置了一个剪映,然后公司里养了一个字幕组,遇到生成字的需求就暂停AI服务,直接让月薪3000的实习生手动加。

不无可能啊,这以前也有案例。有没有实习生后台投稿一下《置身稀内》,讲讲自己是不是真在当数字劳工😭

3.孙笑川名场面2.0

紧接着测试一下H3对声音的编辑能力,毕竟MiniMax也有自己的音频模型。

于是我把孙笑川早年召唤物管的名场面发给H3,要求它把孙笑川的语言都转换成四川方言,并搭配同含义的日语字幕,字幕样式使用日本综艺常见的花字包装。

同时,我也要求H3使用高频次的川剧变脸挡住孙笑川面部,并用哔声消音所有脏话,起到双重马赛克的效果。

成品如下⬇️

四川人咸鱼对此的评价是:

*感觉他现在素质还没有狗粉丝高

能把一段语音给自行翻译成四川话和日本话,还能把视频给精准和谐化,H3确实是对上传的素材和现实世界都有一定理解的。

现在看来,很多博主都说H3的优势是AI视频的后期,我觉得重点错了。因为AI视频想有特效直接重新生成就行,根本犯不上特意走一个后期环节。

MiniMax H3的优势其实是针对于实拍视频的AI视频后期,因为用它改完的视频还像拍的一样。这点挺难得的。

4.用旮旯game的方式打开《痴迷》

虽然是后期软件,但15秒的视频时长限制,蹭进纯影视工业略难。所以MiniMax比较适合短视频的整活、二创和包装。

我能想到的场景是当集美集帅们录了个vlog,再也不用干巴巴地尬发了,可以直接H3启动了。

我手头没有vlog素材,只能找了《痴迷》里比较像恋爱vlog的一段,把它包装成了旮旯game的形式⬇️

*上为原视频,下为成品

缺点是有的,比如H3直接省略了女主站起来的动作,让妮基屁股粘凳子上了。

再比如,可能因为涉及到两人对话,处理对话框比较费劲,所以这个案例我生成了很多 · 很多 · 很多次,最后H3给我的的成品也没有和电影台词分秒级吻合。

但出来的效果还是挺不错的,有心跳文学部那个味儿了。建议所有异性恋生活方式博主以后都这么发视频。

5.重拍《后室》

而且H3作为后期软件的编辑也不止是整点贴图粘在视频表面,他是有在把原视频当成一个空间来理解。

所以你可以要求它在具体位置增加元素;或是转换视角,比如把第一人称换成第三人称,把平视换成俯拍,更改运镜路线等。

我先尝试了一下在用H3在后室里增加奶龙和胖猫,毕竟这都是MiniMax发家的来时路,不能忘本啊⬇️

*上为原视频,下为成品

可以看出,角色和环境没有太大变动,奶龙和胖猫也都成功入住了后室。

而且奶龙和胖猫还都根据后室的光照情况拥有自己的影子,证明它们不是纯鬼是实体👍

完成得还可以。

然后我又试了下转换视角,要求H3把原片的三个镜头作如下处理:镜头一改为第一人称;镜头二改为希区柯克变焦;镜头三改为无人机镜头,从后向前起飞并向下俯拍;镜头四改为向后拉。

做完是这样的⬇️

*上为原视频,下为成品

问题很多啊,比如主角的所见和原视频不完全相符,比如黑影的位置不对,比如希区柯克变焦也不符合希区柯克本人的要求。

蒽,毕竟这个任务确实比较难了,之前也没用别的模型测过,可以理解。

不过视角是对的,运镜是对的,如果不是非得对照着原视频来看,这个片子也是合格的。

所以说家人们,还是多用H3整活吧,比如加个胖猫奶龙之类的,转换视角这种影视工业级的活,还是等他们再迭代了再说吧🥵

6.如果昆汀拍茅台广告

之前有提到MiniMax H3只有在有参考的情况下才能把视频生成明白。但这个参考其实不一定非得上传,你跟他纯说话也行,毕竟猜也能猜到MiniMax H3肯定也偷摸训了好多素材。

所以我试了几个特别短的prompt,比如:

“如果诺兰拍后室”

“如果昆汀拍茅台广告”

“如果伊藤润二拍春晚小品”

……

其中我觉得表现最好的是下面这个,如果昆汀拍茅台广告⬇️

主要我觉得现在一提到电影导演Skills就言必称韦斯·安德森,真挺没劲的。毕竟按照网友的理解,对称了就韦斯·安德森了,色彩饱和了就韦斯·安德森了,这风格也太好模仿了。

MiniMax H3可能为了防爆破,专门训了一下,所以做「一句话生电影」任务的时候,显得它对各个导演的内容逻辑和叙事习惯也有理解。

比如这个昆汀的茅台广告,在调色上到没有很突出的特点,也没有血没有脚,但不知为何一看就是昆汀的味儿。

建议茅台直接采用此视频,可以后台联系。

最后我想说的是,MiniMax H3把自己做成后期软件,虽然挺特别的,挺商业化的,但有一种主动下大桌上小桌的意思。

「各位第一梯队视频模型你们战吧,我反正已经跳出三界外不在五行中了,专心做后期软件中勿cue」的意思。

主动给自己找了个边角位,这样能力不及SOTA也无可指摘的意思。

是没啥错,但总感觉MiniMax这么活着也没啥意思。

我给MiniMax指条明路吧:

遥想Sora当年,做了个不懂物理的视频模型非说自己是世界模拟器。MiniMax H3现在能把实拍视频一顿爆改,干的也主要都是理解世界改造世界的活,不如直接宣传自己是世界模型得了。

反正现在说自己是世界模型的这么多,而且个个都有一米长的定语,H3直接打出「首个非刘氏生成 · 非物理相关 · 非具身行业 · 非自回归 · 非海外华人团队 · 之世界模型」的名号。那是非常带派。

更别说它还跟很多世界模型一样搞开源。说到开源,我又想到了LibTV,H3相当于给冕神把一条腿接上了,直接无缝衔接后训练视频模型,共同抗击Seedance2.5。

哎哟我去,又后期软件又开源的,这剧本咋这么熟悉呢?

家人们,这不纯纯走的Adobe纵容盗版路线吗。

对吧,我深度怀疑H3的算盘是:先开源让中国人都用起来,形成使用习惯了离不开了,然后再直接更新个大的来美美收割一波,到时候别人家流量也被它给劫走了。

原来这就是开源劫流的意思。

我只能说太邪恶了,请大家带着警惕与批判的心使用MiniMax H3吧。