MiniMax用H3窃取大结果

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
MiniMax用H3窃取大结果
7896点击    2026-08-05 15:14

MiniMax用H3窃取大结果


 「曲线救模


上周末MiniMax更新了H3,铺天盖地的测评啊,说什么找到Seedance 2.0的平替了。


此说法幽默的点有三:


第一,平确实是平了,价格只有Seedance 2.0的1/3。但便宜在如今的视频模型争雄中算啥优点啊,某些四线视频模型更便宜,你看他们上桌了吗?


还是那句话,如果创作者真就纯图便宜,就干脆All in旁白PPT漫剧了,视频模型厂也不用努力了,直接在家祈祷劣币驱逐良币了。


第二,实际用了一下,感觉MiniMax H3和Seedance 2.0还是有大概两成的差距。


比如我让他生成了一个「峰哥给买科技股的家人们道歉」的视频⬇️


MiniMax用H3窃取大结果


可以明显看出,峰哥的脸如同抹了厚厚的粉底,质感达不到真人程度,只能和杜莎夫人蜡像馆掰手腕。


峰哥智慧的眼睛更是全程怒目圆睁,目光纹丝不动,犹如东方蒙娜丽莎,伪人感极强。


而且峰哥和背景的纳斯达克交易所就像在两个图层一样,没有丝毫融合的意思。


此类差距很难用「便宜」这个点来弥补:视频模型的能力遵循反向木桶原理,H3的能力上限是SOTA的80%,那无论生成几次也不会成为100%。


当然可能对有的人来说,80%也够了。那我没话讲。


第三是最幽默的,MiniMax H3刚发,Seedance 2.5嗷的一下就上线了。


be like:本来只是想默默炒作,结果现在还得跟祖宗对打,哥们根本没做好准备啊。


不过好歹是比Seedance 2.5发的早那么一点点,可以说是不幸中的万幸了。


无论如何,我还是紧急测了一下H3,生成了200多个视频之后得出的结论是:


MiniMax H3唯一真比其他视频模型强的地方,实则是跟「AI视频」这个概念最不沾边的地方,即与现实世界的关系。


简单来讲,如果别的AI模型是在做VR(虚拟现实),H3做的就是AR(增强现实)。


当用户像以前一样要求H3凭空生成一段AI视频,那它交付的成果就不尽如人意。


MiniMax自己估计也发现这个点了,所以直接转换重点:当用户要求H3调整本身就有的视频时,它反而能带来一些惊喜。


这波是曲线救模


我举几个例子:


01

勇次郎的夏天出片版


首先是国产青春片之最《勇次郎的夏天》。我让H3把这个经典片段套进了博主@原来是陶阿狗君 的一段日剧跑特效视频里面⬇️


MiniMax用H3窃取大结果

左一是原视频,右一是成品


挺神的。从头到尾我都没打开剪映或其他后期软件,但生成的视频就跟我套了模板做的一样。这H3并非只是给参考视频换脸,感觉是真把原视频的编辑逻辑给理解明白了。


而且范小勤的形象、动作和声音都几乎没有变化。说明H3是懂克制的,不是一股脑从头扩散到尾,而是知道哪该保持原样、哪该推倒重建。很有主体性。


MiniMax H3的这个特性就很适合把自己做成后期软件。


对吧,以后虽然大家生成视频不用MiniMax,但生成完的视频都可以来MiniMax里走一遭,整点特效,加点包装,反正也便宜。


当别人家都在致力于把视频模型卷成AI Agent的时候,它直接把自己干成纯工具了。属于是给自己造出来一个生态位,不跟AI圈的哥们姐们同台竞技了。


只能说这MiniMax短期内确实窃取到大结果了,毕竟这赛道现在就它一个人啊。


02

《中国人能飞》MV


除了特效之外,我也想测一下H3对文字的表现能力。于是让它给最近爆火的《中国人能飞》做了个MV⬇️


MiniMax用H3窃取大结果


不得不说这个效果确实不错。


当文字悬空时,字体协调,光泽动效也不low,而且也根据我的要求一直位于揽佬身后,没有挡住天才的面孔。


当文字贴在墙体上时,也不是生硬地平铺,而是符合空间结构和物理规则。


我都怀疑它们其实内置了一个剪映,然后公司里养了一个字幕组,遇到生成字的需求就暂停AI服务,直接让月薪3000的实习生手动加。


不无可能啊,这以前也有案例。有没有实习生后台投稿一下《置身稀内》,讲讲自己是不是真在当数字劳工😭


03

孙笑川名场面2.0


紧接着测试一下H3对声音的编辑能力,毕竟MiniMax也有自己的音频模型。


于是我把孙笑川早年召唤物管的名场面发给H3,要求它把孙笑川的语言都转换成四川方言,并搭配同含义的日语字幕,字幕样式使用日本综艺常见的花字包装。


同时,我也要求H3使用高频次的川剧变脸挡住孙笑川面部,并用哔声消音所有脏话,起到双重马赛克的效果。


成品如下⬇️


MiniMax用H3窃取大结果


四川人咸鱼对此的评价是:


MiniMax用H3窃取大结果

感觉他现在素质还没有狗粉丝高


能把一段语音给自行翻译成四川话和日本话,还能把视频给精准和谐化,H3确实是对上传的素材和现实世界都有一定理解的。


现在看来,很多博主都说H3的优势是AI视频的后期,我觉得重点错了。因为AI视频想有特效直接重新生成就行,根本犯不上特意走一个后期环节。


MiniMax H3的优势其实是针对于实拍视频的AI视频后期,因为用它改完的视频还像拍的一样。这点挺难得的。


04

用旮旯game的方式打开《痴迷》


虽然是后期软件,但15秒的视频时长限制,蹭进纯影视工业略难。所以MiniMax比较适合短视频的整活、二创和包装。


我能想到的场景是当集美集帅们录了个vlog,再也不用干巴巴地尬发了,可以直接H3启动了。


我手头没有vlog素材,只能找了《痴迷》里比较像恋爱vlog的一段,把它包装成了旮旯game的形式⬇️


MiniMax用H3窃取大结果

上为原视频,下为成品


缺点是有的,比如H3直接省略了女主站起来的动作,让妮基屁股粘凳子上了。


再比如,可能因为涉及到两人对话,处理对话框比较费劲,所以这个案例我生成了很多 · 很多 · 很多次,最后H3给我的的成品也没有和电影台词分秒级吻合。


但出来的效果还是挺不错的,有心跳文学部那个味儿了。建议所有异性恋生活方式博主以后都这么发视频。


05

重拍《后室》


而且H3作为后期软件的编辑也不止是整点贴图粘在视频表面,他是有在把原视频当成一个空间来理解。


所以你可以要求它在具体位置增加元素;或是转换视角,比如把第一人称换成第三人称,把平视换成俯拍,更改运镜路线等。


我先尝试了一下在用H3在后室里增加奶龙和胖猫,毕竟这都是MiniMax发家的来时路,不能忘本啊⬇️


MiniMax用H3窃取大结果

上为原视频,下为成品


可以看出,角色和环境没有太大变动,奶龙和胖猫也都成功入住了后室。


而且奶龙和胖猫还都根据后室的光照情况拥有自己的影子,证明它们不是纯鬼是实体👍


完成得还可以。


然后我又试了下转换视角,要求H3把原片的三个镜头作如下处理:镜头一改为第一人称;镜头二改为希区柯克变焦;镜头三改为无人机镜头,从后向前起飞并向下俯拍;镜头四改为向后拉。


做完是这样的⬇️


MiniMax用H3窃取大结果

上为原视频,下为成品


问题很多啊,比如主角的所见和原视频不完全相符,比如黑影的位置不对,比如希区柯克变焦也不符合希区柯克本人的要求。


蒽,毕竟这个任务确实比较难了,之前也没用别的模型测过,可以理解。


不过视角是对的,运镜是对的,如果不是非得对照着原视频来看,这个片子也是合格的。


所以说家人们,还是多用H3整活吧,比如加个胖猫奶龙之类的,转换视角这种影视工业级的活,还是等他们再迭代了再说吧🥵


06

  如果昆汀拍茅台广告


之前有提到MiniMax H3只有在有参考的情况下才能把视频生成明白。但这个参考其实不一定非得上传,你跟他纯说话也行,毕竟猜也能猜到MiniMax H3肯定也偷摸训了好多素材。


所以我试了几个特别短的prompt,比如:


“如果诺兰拍后室”


“如果昆汀拍茅台广告”


“如果伊藤润二拍春晚小品”


……


其中我觉得表现最好的是下面这个,如果昆汀拍茅台广告⬇️


MiniMax用H3窃取大结果


主要我觉得现在一提到电影导演Skills就言必称韦斯·安德森,真挺没劲的。毕竟按照网友的理解,对称了就韦斯·安德森了,色彩饱和了就韦斯·安德森了,这风格也太好模仿了。


MiniMax H3可能为了防爆破,专门训了一下,所以做「一句话生电影」任务的时候,显得它对各个导演的内容逻辑和叙事习惯也有理解。


比如这个昆汀的茅台广告,在调色上倒没有很突出的特点,也没有血没有脚,但不知为何一看就是昆汀的味儿。


建议茅台直接采用此视频,可以后台联系。


最后我想说的是,MiniMax H3把自己做成后期软件,虽然挺特别的,挺商业化的,但有一种主动下大桌上小桌的意思。


「各位第一梯队视频模型你们战吧,我反正已经跳出三界外不在五行中了,专心做后期软件中勿cue」的意思。


主动给自己找了个边角位,这样能力不及SOTA也无可指摘的意思。


是没啥错,但总感觉MiniMax这么活着也没啥意思。


我给MiniMax指条明路吧:


遥想Sora当年,做了个不懂物理的视频模型非说自己是世界模拟器。MiniMax H3现在能把实拍视频一顿爆改,干的也主要都是理解世界改造世界的活,不如直接宣传自己是世界模型得了。


反正现在说自己是世界模型的这么多,而且个个都有一米长的定语,H3直接打出「首个非刘氏生成 · 非物理相关 · 非具身行业 · 非自回归 · 非海外华人团队 · 之世界模型」的名号。那是非常带派。


更别说它还跟很多世界模型一样搞开源。提到开源,我又想起了LibTV,听说冕神都发了一条朋友圈支持 H3,这也可以理解,毕竟H3相当于给冕神把一条腿接上了,直接无缝衔接后训练视频模型,共同抗击Seedance2.5。


哎哟我去,这H3又后期软件又开源的,这剧本咋这么熟悉呢?


家人们,这不纯纯走的Adobe纵容盗版路线吗。


对吧,我深度怀疑H3的算盘是:先开源让中国人都用起来,形成使用习惯了离不开了,然后再直接更新个大的来美美收割一波,到时候别人家流量也被它给劫走了。


原来这就是开源劫流的意思。


我只能说太邪恶了,请大家带着警惕与批判的心使用MiniMax H3吧。


(本文封面由ChatGPT 生成,纯人工写作)


文章来自于"葬AI",作者 "罗子马"。

关键词: AI新闻 , MiniMax , MiniMax H3 , AI视频
AI转型,免费服务,就找AITNT
AITNT资源拓展
根据文章内容,系统为您匹配了更有价值的资源信息。内容由AI生成,仅供参考
1
智能体

【开源免费】AutoGPT是一个允许用户创建和运行智能体的(AI Agents)项目。用户创建的智能体能够自动执行各种任务,从而让AI有步骤的去解决实际问题。

项目地址:https://github.com/Significant-Gravitas/AutoGPT


【开源免费】MetaGPT是一个“软件开发公司”的智能体项目,只需要输入一句话的老板需求,MetaGPT即可输出用户故事 / 竞品分析 / 需求 / 数据结构 / APIs / 文件等软件开发的相关内容。MetaGPT内置了各种AI角色,包括产品经理 / 架构师 / 项目经理 / 工程师,MetaGPT提供了一个精心调配的软件公司研发全过程的SOP。

项目地址:https://github.com/geekan/MetaGPT/blob/main/docs/README_CN.md

2
prompt

【开源免费】LangGPT 是一个通过结构化和模板化的方法,编写高质量的AI提示词的开源项目。它可以让任何非专业的用户轻松创建高水平的提示词,进而高质量的帮助用户通过AI解决问题。

项目地址:https://github.com/langgptai/LangGPT/blob/main/README_zh.md

在线使用:https://kimi.moonshot.cn/kimiplus/conpg00t7lagbbsfqkq0