民办大模型MiniMax努力专升本

2026-07-09|沐秋|29 个实体|27 条关系

知识图谱摘要

提及实体 (29)
关系 (27)
DeepSeek V4对比MiniMax M3

文章建议在复杂任务中用DeepSeek V4替代MiniMax M3

GLM对比MiniMax M3

在CEO-Bench评测和网站重构任务中进行对比测试

Kimi对比MiniMax

市场认为MiniMax和Kimi是一个级别,形成强行双骄效果

MiniMax对比TapNow

MiniMax Hub主打无限画布,TapNow含金量上升暗示对标或相似性

MiniMax对比VAST

文章建议MiniMax参考VAST做3D/世界模型

MiniMax对比陈冕

MiniMax的35折定价策略被形容为“质疑陈冕、理解陈冕、超越冕神”

可灵对比海螺AI

一年前海螺和可灵处于同一梯队,现在差距拉大

Hermes Agent竞争OpenRouter

文章认为Hermes Agent有机会取代OpenRouter的生态位

MiniMax竞争智谱AI

同属国内四小龙,进入四进二竞争阶段

MiniMax竞争阶跃星辰

同属国内四小龙,进入四进二竞争阶段

Seedance竞争海螺AI

MiniMax Hub中Seedance优先级高于自家海螺2.3

016批评MiniMax M3

016通过CEO-Bench测试揭示MiniMax M3商业经营逻辑缺陷

朱亦辉批评MiniMax

朱亦辉解释MiniMax M3核心科技是洗脑能力,强行对标Kimi

Kimi开发Kimi Work

Kimi推出了本地Agent产品Kimi Work

MiniMax开发MaxClaw

MiniMax上线了MaxClaw云端龙虾产品

MiniMax开发MaxHermes

MiniMax推出了整合Hermes的MaxHermes产品

MiniMax开发MiniMax Hub

MiniMax下场搞了自己的视频Agent MiniMax Hub

MiniMax开发MiniMax M3

MiniMax开发并发布了M3模型

MiniMax开发Music 2.6

MiniMax拥有音乐模型Music 2.6

MiniMax开发星野

星野/Talkie是MiniMax的C端情感陪伴产品

MiniMax开发海螺AI

海螺是MiniMax的视频模型产品

网易开发有道龙虾

网易有道更新了龙虾产品

美团开发觅游

美团推出了觅游龙虾社交产品

丁磊创立网易

文中提到“被丁磊裁掉的外包”,隐含丁磊为网易决策者/创始人

MiniMax Hub集成Seedance

MiniMax Hub首选接入Seedance模型,并提供35折优惠

Hermes Agent合作伙伴MiniMax

MiniMax早期绑定Hermes Agent进行炒作,Hermes官方账号提及使用MiniMax模型

葬爱咸鱼赞扬MiniMax M3

咸鱼评价MiniMax M3复刻LibTV前端视觉效果逼真

民办大模型MiniMax努力专升本

2026年7月9日 沐秋 葬AI


葬AI身边的朋友常常有个疑问:

为什么MiniMax M3做的不够好(问了一些在做模型测评的朋友,他们也是类似看法),但市场仍然觉得他们是第一梯队?

我朋友@朱亦辉的解释是,MiniMax M3的核心科技是洗脑能力,让外界觉得他们和Kimi是一个级别,达到一个强行双骄的效果。

CBA模型但让人觉得能去NBA打一打,你还能想到的模型是____?

我认为这是一个很好的角度,于是认真复盘了MiniMax过去半年都做过些什么。

首先,MiniMax是最快炒作龙虾的:

他们在大伙还没反应过来就上线了MaxClaw,先圈了一波人,蹭着OpenClaw使劲卖平时卖不出去的Token。我记得当时花39元整了个MaxClaw的云端龙虾,结果实测下来还不如Chatbot好用,典型为了上线狂冲一波。

我最近又登上去看看有啥新功能,一看把「角色陪伴」作为和办公创作/连接账号同等重要的功能放进去了。

这属于是悟道了,把「效率赛道一定要做情绪价值,因为解决实际问题大家都不行」这句话玩明白了。

因为我试了下,这玩意到现在也不支持浏览器控制功能。使用体验不知道要被本地Agent甩出几条街。

当时大伙都在吹什么「一只龙虾,撑起MiniMax3826亿市值」,炒作麻了。

现在闹剧结束了,模型能力比MaxClaw重要一万倍。再多说一句,到了这个时间点还在炒龙虾的纯是老登公司。

比如生数的Vidu Claw,哦不对,生数不是老登公司,是好公司;

美团整了个「觅游」让龙虾社交,属于是吃尾气都没吃不明白;

还有网易的有道龙虾,不知所云在更新个啥,不会指着龙虾去替代被丁磊裁掉的外包吧;

最过分的还是荣耀宣传的龙虾宇宙,竟然把龙虾同时整进了PC、平板和手机,疑似全栈式接入360安全管家,不知道这些虾能卸载不?

其次,MiniMax也是最快炒作Hermes的:

坦白说,我到今天都不知道这个Hermes Agent 凭啥跟Codex比,什么「自我进化、始终在线」,这不纯龙虾故事无痛再来一遍?感觉AI圈家人快跟币圈家人一样好骗了。

哦对Hermes这个团队是币圈背景,我一直在等他们发币呢,发币我真支持。

有没有真的在用Hermes Agent的朋友留言说下自己用这玩意干啥。

从炒作声量来看,Hermes是接过龙虾这一棒的。那MiniMax也没闲着,他们很早就绑定Hermes Agent炒作,让Hermes Agent 官方 X 账号提MiniMax M2.7 是他们使用最多的模型之一,后面紧跟着炒作Hermes的是限时两周免费套餐的MiMo-V2-Pro。

我看这Hermes Agent可以好好搞搞自己这个大外宣生态位了,假以时日是有机会取代OpenRouter的。

MiniMax甚至还整出了一个MaxHermes:

开Max Hermes还要额外买3000token,我支付到一半直接:

诶我去,这MiniMax的充值网站魔了。

在一顿操作后,我得到了一只看起来比龙虾聪明点的Max Hermes。那我就很想问了,MaxClaw是留着用来割韭菜的?

MiniMax中途还有一系列匿名模型打榜,OpenRouter 刷Token消耗量榜单的基础操作,这个就不提了。

我们再说MiniMax的海螺,上次更新要追溯到上市前,不知道是不是被Seedance2.0 和可灵新版本打得不敢发新版本了。

模型公司是集体性地错过了视频模型这个风口的。最开始模型公司聊视频模型是混着多模态一起讲的,吹的牛逼都是未来模型不仅要有文本能力,也要有多模态能力。

直到Seedance横空出世,衔接了短剧生态,还找到了类似LibTV这种超大KA,大伙才终于意识到视频模型是可以挣大钱的。

模型公司做视频模型确实是很难,看隔壁Sora2 怎么歇菜的就知道了,但MiniMax本来是有先发优势的。至少在一年多以前,海螺还是和可灵坐一桌的。今年以来我没听过任何一家视频Agent公司提到海螺的模型。

那MiniMax的视频模态最近在哪发财呢?

他们下场搞了自己的视频Agent——MiniMax Hub,依旧主打无限画布。TapNow的含金量还在上升啊。

这Nano Banana叫香蕉也挺封神的

MiniMax Hub也不藏着掖着,视频模型首选就是Seedance2.0、其次是Seedance2.0 Fast、最后是Seedance2.0 Mini,海螺2.3都得往后靠。

当然最封神的还是,MiniMax Hub上来直接宣发Seedance 35折。

质疑陈冕、理解陈冕,最后35折超越冕神!

What can i say,我一度都要怀疑MiniMax的Seedance API是从LibTV那进的货了。

经用过的朋友提醒,35折是基于MiniMax列表价的35折,而不是Seedance原价的35折,果然还是不如我冕哥大气

记得Minimax开始上市的时候,吹的还是自己是唯一C端有收入的公司,起的标题都是,「MiniMax上市大涨,市场更青睐靠用户挣钱的大模型公司。」

星野/Talkie当年花钱买量的故事还是,我的用户聊天越多,模型越懂用户,就能训出更好的模型。情感陪伴飞轮属于是。

我已经半年没听过MiniMax C端无敌的故事了,所以Talkie/星野在哪发财呢?

当前的版本已经回退到,上一版本的产品和上一版本的创业公司一样,全部被淘汰了,现在讲什么情感陪伴、C端产品都没用。

唯一有用的就是模型、以及训练模型的能力。

于是也有缅因猫这种做AI视频互动产品的团队,整个开源框架做后训练,拼命假装自己有训练模型的能力。

即使是做产品,也要做Kimi Work这种能发挥模型优势的本地Agent产品。

国内四小龙已经进入四进二阶段:实际已经走向To G的阶跃、To B卖得飞起的智谱、常被认为有技术品味的Kimi、以及不知道该怎么定义的MiniMax。

所以MiniMax现在该干嘛?很多战略家肯定说,那得聚焦呀,重新回来做模型。

这完全是废话,难道老板不知道要重视模型能力吗?还用你,模型这条路这么卷,真聚焦就能争(蒸)得过Kimi、智谱吗?

我认为,MiniMax需要的不是聚焦,而是分散。

比如大伙可能不知道MiniMax有一个音乐模型,叫Music 2.6。

这个是好事儿啊,虽然市场不大,但真的是宣传得少了。赶紧请Rapper代言起来,有能力可以去请凡凡用AI写歌,没能力就找PG One。

还有文本转语音的TTS模型,非常适配现在一堆拿数字人冒充世界模型的公司们。

已经这么分散了,不如再分散点,再整点什么3D大模型、世界模型(可以具体参考隔壁VAST)得了。

全模态全矩阵大模型公司必胜!

那Minimax M3到底啥水平呢?

我还看有人的评论是「如果日常用的比较多的是OpenClaw这种Agent,那用MiniMax M3作为主力模型,其实是没多大毛病的,但如果日常的任务,是难度比较大的编程或者复杂任务,咱还是推荐咱们的DeepSeek V4,或者GPT5.5、Claude 4.8之类的国外模型。」

这表述实在是雅。

而按照葬AI bench的评测,结果是MiniMax M3在逼近DeepSeek斩杀线斩杀线。也就在我们公开评测后,竟然有人留言让Minimax M3去蒸馏GLM5.2。真的是,怎么能这么挑拨国产双子星的关系呢?

不过这也只是跑分,我们来看看M3的几个实测,由我和朋友@016共同完成。

首先是@016整了个大活,让MiniMax M3和GLM5.2一起去跑了最近在外网很火的CEO-Bench。

这是个长程经营模拟评测(arXiv:2606.18543),大意是让模型扮演一家 AI SaaS 创业公司的 CEO,拿 $100 万启动资金经营 3647 天,终局现金就是它的最终得分。主要考验模型的商业经营水平。

MiniMax M3的行为逻辑是这样的,它第一天面对$100 万现金和一个质量只有 0.12 分的半成品后,直接走向市场调研抽卡机,连抽了20次,一天烧掉 $50 万,抽出 10 个新客群,其中包括好几个付费能力极强的企业金矿。

结果开业广告投出去,一周来了 245 个上门客,244 个看了一眼就走了,因为产品质量太差配不上它的定价——完全没有影射MinMax这家公司的意思。

还好这模型悬崖勒马,砍了大部分广告费, 在5-10 周开始学习当一个CEO ,等到研发项目完工质量终于过线,转化率冲到 20-25%,小额试投验证回报,确认有效后逐步加仓。

结果好景不长,竞争对手连环发布新品,MiniMax有心无力,没钱研发新品,只能不断降低价格,最后在第 227 天弹尽粮绝——再说一遍,这个故事完全没有影射MinMax这家公司的意思。

GLM-5.2则是开局来两个大研发项目,花了一半的资金,产品不错,可惜投流选错了客群,最后倒在第 307 天。

@016对这两模型如此表现的解释是,「有可能国内模型在数据训练比较垂直(也可能是因为蒸馏的缘故),在智力水平和海外模型还是有差距。」

完整版本可参考飞书文档,里面也有最前沿模型的表现效果:

https://my.feishu.cn/docx/SlDPdI7LLodTPDxIdt0cFyQknGe?from=from_copylink

第二个案例是让MiniMax M3独立完成葬AI的网站重构:把网站完整本地数据,103 篇文章正文、600 节点/1546 条边的知识图谱作为输入,要求模型重构一个包含首页、知识图谱页、文章列表和 103 篇详情页的完整静态网站。

得益于比较不错的多模态能力,MiniMax M3成功的案例中完成度高,而且也有审美。

但MiniMax M3暴露的最大问题是工程能力不行,10轮图谱生成中只成功了3轮,网站最后的结果往往是文章都加载不出来:

下一个任务是让M3去调研VAST这家公司,并复刻他们的网站,并尽可能实现网站上的功能。这是M3跑了几个小时的结果:

网站没啥亮点,但确实复刻出了一堆3D模型,有球、也有正方体。

最后,既然MiniMax M3一直吹自己的多模态理解,那我直接告诉他:帮我1:1完整复刻https://www.liblib.tv/这个网址,你要不停的Review是否一致了,不一致就继续修复。

输出的结果如下:

我真的震撼了朋友们,你们真的分得清哪个是正版哪个是盗版吗?

咸鱼说一眼看上去真,可惜问题是没有和新葡京一样多的贴片广告,这才是LibTV的精髓。太爱了他。

不过可惜这只复刻了网页前端,内核的各个功能都是没有的,于是我让它专注在复刻LibTV主要功能上再来了一次:

远远不如刚刚复刻网站那么精妙。看来这MiniMax M3就是个美术生。

让我们一起等待多模态之神降临来拯救MiniMax吧,祝MiniMax早日专升本。

(本文封面由ChatGPT生成,纯人工写作)