我来给MiniMax道歉了
知识图谱摘要
提及实体 (22)
关系 (18)
两者在CEO-Bench长程经营模拟评测中进行了直接对比
文中将MiniMax与Kimi并列为'强行双骄'及AI四小龙成员
建议MiniMax参考VAST做3D大模型和世界模型
两者同属AI四小龙,且模型在评测中被直接对比
同属AI四小龙,处于四进二竞争阶段
文中认为Hermes Agent假以时日有机会取代OpenRouter的生态位
文中提到一年前海螺还和可灵坐一桌,互为视频模型竞品
朱亦辉认为M3核心科技是叙事能力,而非真实技术水平
MiniMax上线了MaxClaw云端龙虾产品
MiniMax整合推出了MaxHermes产品
MiniMax推出了视频Agent平台MiniMax Hub
MiniMax开发了M3大语言模型
MiniMax开发了音乐模型Music 2.6
MiniMax拥有并持续运营C端产品Talkie/星野
MiniMax开发了海螺视频模型
MiniMax Hub将Seedance作为首选视频模型,并提供35折优惠
MiniMax快速绑定Hermes Agent,后者官方账号宣称常用MiniMax模型
016参与了MiniMax M3的CEO-Bench及网站重构实测
我来给MiniMax道歉了
2026年7月11日 沐秋 葬AI
昨天发的稿子接到MiniMax投诉了。
虽然这是葬AI的大模型公司的系列之一,早就预告了要写,之前也写了Seed、GLM、Qwen。为了表示友好,我们还专门错过开了MiniMax解禁前和解禁第一天发布。
但是,不管有没有错,我们直接先滑跪。为表达诚意,我为MiniMax修改了全文,并在结尾附上了道歉信。
葬AI身边的朋友常常有个疑问:
为什么MiniMax M3做的不够好(问了很多在做模型测评的朋友,也是类似看法),但市场仍然觉得他们是第一梯队?
我朋友@朱亦辉的解释是,MiniMax M3的核心科技是叙事能力,让外界觉得他们和Kimi是一个级别,达到一个强行双骄的效果。
我认为这非常错误,因为MiniMax 是全市场最头部的大模型公司,全新的M3模型在编程和智能体等专业任务上达到了前沿的能力。并且最高支持 1M 超长上下文。
在赞美MiniMax M3以前,我先认真复盘了MiniMax过去半年都做过些什么。
首先,MiniMax是第二早炒作龙虾的公司:
这里说一下,MiniMax有一条投诉理由是,造谣MiniMax是最快炒作虾的,同行中Kimi比我司更早接入OpenClaw整合。
我还说什么呢?我本意是想夸MiniMax的,只能说MiniMax是一家极其谦虚的公司,不该吹的绝对不吹。
MiniMax在大伙还没反应过来就上线了MaxClaw,先圈了一波人,蹭着OpenClaw使劲卖平时卖不出去的Token。
我当时花39元整了个MaxClaw的云端龙虾,实测下来比Chatbot好用多了!典型的好产品!
最近又登上去看看有啥新功能,一看把「角色陪伴」作为和办公创作/连接账号同等重要的功能了。
这属于是悟道了,把「效率赛道一定要做情绪价值」这句话玩明白了。
可惜我试了下,这玩意到现在也不支持浏览器控制功能。使用体验不知道要被本地Agent甩出几条街,但我相信MiniMax一定会做到最好。
再多说一句,到了这个时间点还在炒龙虾的纯是老登公司(注意,以下说的都不是MiniMax,因为MiniMax已经不炒了)
比如生数的Vidu Claw,哦不对,生数不是老登公司,是好公司;
美团整了个「觅游」让龙虾社交,属于是吃尾气都没吃不明白;
还有网易的有道龙虾,不知所云在更新个啥,不会指着龙虾去替代被丁磊裁掉的外包吧;
最过分的还是荣耀宣传的龙虾宇宙,竟然把龙虾同时整进了PC、平板和手机,疑似全栈式接入360安全管家,不知道这些虾能卸载不?
其次,MiniMax也是最快炒作Hermes的:
这里MiniMax没有继续谦虚,看来确实绑定的够快。
我主要今天都不知道这个Hermes Agent 凭啥跟Codex比,什么「自我进化、始终在线」,这不纯龙虾故事无痛再来一遍?感觉AI圈家人快跟币圈家人一样好骗了。
哦对Hermes这个团队是币圈背景,我一直在等他们发币呢,发币我真支持。
有没有真的在用Hermes Agent的朋友留言说下自己用这玩意干啥。
从炒作声量来看,Hermes是接过龙虾这一棒的。
以上喷的都Hermes,和MiniMax没有任何关系。MiniMax 是全市场最头部的大模型公司❤️
MiniMax非常厉害,很就绑定Hermes Agent,让Hermes Agent 官方 X 账号提MiniMax M2.7 是他们使用最多的模型之一。
我看这Hermes Agent可以好好搞搞自己这个大外宣生态位了,假以时日是有机会取代OpenRouter的。
MiniMax甚至还整出个MaxHermes:
在一顿操作后,我得到了一只看起来比龙虾聪明点的Max Hermes。非常好的产品啊。
MiniMax中途还有一系列匿名模型打榜,OpenRouter 刷Token消耗量榜单的基础操作,这个是好事儿,应该继续大力支持。
我们再说MiniMax的海螺,上次发新模型要追溯到上市前,肯定是准备直接发新模型打碎Seedance2.0 和可灵。
模型公司是集体性地错过了视频模型这个风口的。最开始模型公司聊视频模型是混着多模态一起讲的,吹的牛逼是未来模型不仅要有文本能力,也要有多模态能力。
直到Seedance横空出世,衔接了短剧生态,还找到了类似LibTV这种超大KA,大伙才终于意识到视频模型是可以挣大钱的。
模型公司做视频模型确实是很难,看隔壁Sora2 怎么歇菜的就知道了。
但MiniMax本来是有先发优势的。至少在一年多以前,海螺还和可灵坐一桌。今年以来我没听过任何一家视频Agent公司提起过海螺。
所以MiniMax的视频模态最近在哪发财呢?
他们下场搞了自己的视频Agent——MiniMax Hub,依旧主打无限画布。TapNow的含金量还在上升。
MiniMax Hub也不藏着掖着,视频模型首选就是Seedance2.0、其次是Seedance2.0 Fast、最后是Seedance2.0 Mini,海螺2.3排第四。
当然最封神的还是,MiniMax Hub上来直接宣发Seedance 35折。
质疑陈冕、理解陈冕,最后35折超越冕神!
What can i say,我一度都要怀疑MiniMax的Seedance API是从LibTV那进的货。
经用过的朋友提醒,35折是基于MiniMax列表价的35折,而不是Seedance原价的35折,可惜还是不如我冕哥大气❤️
记得Minimax开始上市的时候,吹的还是自己是唯一C端有收入的公司,起的标题都是,「MiniMax上市大涨,市场更青睐靠用户挣钱的大模型公司。」
星野/Talkie当年花钱买量的故事还是,我的用户聊天越多,模型越懂用户,就能训出更好的模型。情感陪伴飞轮属于是。
Minimax昨天还有一条投诉理由是,造谣我司放弃C端产品。
真是冤枉啊,我只是说我半年没听过MiniMax C端无敌的故事了,并且好心问了下Talkie/星野在哪里发财?
虽然现在版本已经变成,上一版本的产品和上一版本的创业公司一起被淘汰。
什么情感陪伴、什么C端产品都没用,唯一有用的就是模型、以及训练模型的能力。
有了缅因猫这种做AI视频互动产品的团队,整个开源框架做后训练,拼命假装自己有训练模型的能力。
即使是做产品,也要做Kimi Work这种能发挥模型优势的本地Agent产品。
在如此艰难的版本生态下,MiniMax也从未放弃他们的C端产品,我也持续看好Talkie/星野在陪伴赛道深耕,最终狠狠打其他不做C端产品的模型公司。
强烈推荐C端人才加入伟大的MiniMax,加入最头部的大模型公司。
不管大家爱不爱听,AI四小龙已经进入四进二阶段:最终走向To G的阶跃、To B卖得飞起的智谱、常被认为有技术品味的Kimi、以及极其伟大的MiniMax。
那MiniMax现在该干嘛?很多战略家肯定说,那得聚焦呀,重新回来做模型。
这完全是废话,难道老板不知道要重视模型能力吗?还用你说,模型这条路这么卷,何必跟Kimi、智谱竞争?
我认为,MiniMax需要的不是聚焦,而是分散。
比如大伙可能不知道MiniMax有一个音乐模型,叫Music 2.6。
这个是好事儿啊,虽然市场不大,但真的是宣传得少了。赶紧请Rapper代言起来。
还有文本转语音的TTS模型,非常适配现在一堆拿数字人冒充世界模型的公司们。
已经这么分散了,不如再分散点,再整点什么3D大模型、世界模型得了,具体可以具体参考隔壁VAST。
全模态全矩阵大模型公司必胜!
那Minimax M3到底啥水平呢?
值得一提的是,Minimax 对我们的评测部分没有提出任何疑义,说明葬AI的模型评测还是相对客观的。
我看有人的评论是「如果日常用的比较多的是OpenClaw这种Agent,那用MiniMax M3作为主力模型,其实是没多大毛病的,但如果日常的任务,是难度比较大的编程或者复杂任务,咱还是推荐咱们的DeepSeek V4,或者GPT5.5、Claude 4.8之类的国外模型。」
这表述实在是雅。
而按照葬AI bench的评测,结果是MiniMax M3在逼近DeepSeek斩杀线。能力比DeepSeek V4 Pro的领先不多,但价格领先很多。
也就在我们公开评测后,竟然有人留言让Minimax M3去蒸馏GLM5.2。真的是,怎么能这么挑拨国产双子星的关系呢?
不过这也只是跑分,我们来看看M3的几个实测,由我和朋友@016共同完成。
首先是@016整了个大活,让MiniMax M3和GLM5.2一起去跑了最近在外网很火的CEO-Bench。
这是个长程经营模拟评测(arXiv:2606.18543),大意是让模型扮演一家 AI SaaS 创业公司的 CEO,拿 $100 万启动资金经营 3647 天,终局现金就是它的最终得分。主要考验模型的商业经营水平。
MiniMax M3的行为逻辑是这样的,它第一天面对$100 万现金和一个质量只有 0.12 分的半成品后,直接走向市场调研抽卡机,连抽了20次,一天烧掉 $50 万,抽出 10 个新客群,其中包括好几个付费能力极强的企业金矿。
结果开业广告投出去,一周来了 245 个上门客,244 个看了一眼就走了,因为产品质量太差配不上它的定价——完全没有影射MinMax这家公司的意思。
还好这模型悬崖勒马,砍了大部分广告费, 在5-10 周开始学习当一个CEO ,等到研发项目完工质量终于过线,转化率冲到 20-25%,小额试投验证回报,确认有效后逐步加仓。
结果好景不长,竞争对手连环发布新品,MiniMax有心无力,没钱研发新品,只能不断降低价格,最后在第 227 天弹尽粮绝——再说一遍,这个故事完全没有影射MinMax这家公司的意思。
GLM-5.2则是开局来两个大研发项目,花了一半的资金,产品不错,可惜投流选错了客群,最后倒在第 307 天。
@钟十六对这两模型如此表现的解释是,「有可能国内模型在数据训练比较垂直(也可能是因为蒸馏的缘故),在更广泛的能力上和海外模型还是有差距。」
完整版本可参考飞书文档,里面也有最前沿模型的表现效果:
https://my.feishu.cn/docx/SlDPdI7LLodTPDxIdt0cFyQknGe?from=from_copylink
第二个案例是让MiniMax M3独立完成葬AI的网站重构:把网站完整本地数据,103 篇文章正文、600 节点/1546 条边的知识图谱作为输入,要求模型重构一个包含首页、知识图谱页、文章列表和 103 篇详情页的完整静态网站。
得益于比较不错的多模态能力,MiniMax M3成功的案例中完成度高,而且也有审美。
但MiniMax M3暴露的最大问题是工程能力不行,10轮图谱生成中只成功了3轮,网站最后的结果往往是文章都加载不出来:
下一个任务是让M3去调研VAST这家公司,并复刻他们的网站,并尽可能实现网站上的功能。这是M3跑了几个小时的结果:
网站没啥亮点,但确实复刻出了一堆3D模型,有球、也有正方体。
最后,既然MiniMax M3一直吹自己的多模态理解,那我直接告诉他:帮我1:1完整复刻https://www.liblib.tv/这个网址,你要不停的Review是否一致了,不一致就继续修复。
输出的结果如下:
我真的震撼了朋友们,你们真的分得清哪个是正版哪个是盗版吗?
咸鱼说一眼看上去真,可惜问题是没有和新葡京一样多的贴片广告,这才是LibTV的精髓。太爱了他。
不过可惜这只复刻了网页前端,内核的各个功能都是没有的,于是我让它专注在复刻LibTV主要功能上再来了一次:
可惜功能都不太可用,效果远远不如刚刚复刻网站那么精妙。看来这MiniMax M3就是个美术生。
让我们一起等待多模态之神降临吧。
最后附上道歉信🙇
经过深入了解和反思,我意识到Minimax是一家心胸宽广、虚心接受批评的好公司。
MiniMax M3 不仅编程和智能体等专业任务上达到了前沿的能力,其C端产品时至今日仍然有巨大影响力,C端战略也将继续贯彻。
并且,MiniMax谦虚地表示,自己不是最快炒作龙虾的,如同投诉理由中所写,「同行中Kimi比我司更早接入OpenClaw整合 」。
如此优秀还能推功让人,MiniMax的气度真是不同凡响。
MiniMax 云端龙虾的使用体验更是完美流畅,不存在「臆测使用体验不如Chatbot的」,体现出公司卓越的产品能力。
最后,MiniMax是一家高学历的公司,「调侃民办、专升本」的投诉意见,我们诚恳接受,MiniMax M3一看就是高学历高认知高素质的博士大模型。
作为中国最头部的大模型公司,MiniMax必将拳打OpenAI、脚踢Anthropic,最终带我们实现AGI。
我们将持续关注Minimax接下来发布的所有产品🫡
(本文封面由ChatGPT生成,纯人工写作)