MiniMax半年报:ARR破8亿美元,推理成本成技术主线
MiniMax用稀疏化架构同时压低推理成本并提升智能,业绩证明这条路可行,值得关注。
MiniMax半年报显示,8月ARR达8亿美元,B端收入同比增703%,Token消耗量7月为1月的20倍。公司提出用稀疏化架构降低推理成本,扩大后训练规模,计划将M3.1推理成本降至初版三分之一。
正文摘录
 新智元报道  昨天,大模型圈热闹了一整天。 下午,智谱上线并开源 GLM-5.3-Flash,定价是 Opus 4.8 的四十分之一。 晚上,阿里接上 Qwen3.8-Flash-Next,同样发布即开源。价格砸到每百万 Token 输入 1 元、输出 3 元,是 DeepSeek-V4-Flash 的三分之一。 你品品这个画面。 以前,大模型这行里隐隐是两条路。一条更贵但更强的旗舰路线,一条更便宜但没那么顶的性价比路线。 但就在昨天,一个把旗舰级的分数塞进了 Flash 档,一个把千亿模型的激活量压到 60 亿再开源出去。 反过来也是一样。原本靠低价起家的那批玩家,这两年一直在拼命够智能的天花板。 一年前谁都不像谁,现在正在互相活成对方的样子。 说到底,是因为所有人都开始想同一个问题。 更高的智能和更高的性价比,到底能不能同时存在? 也是在昨天,闫俊杰在 MiniMax 的半年报业绩会上,给了个不一样的答案—— Minimize the Inference Cost, Maximize the Intelligence. 最小化推理成本,最大化智能水平。  Agent 大军来袭, Token 消耗暴涨 2000% 26 日下午,MiniMax 把半年报挂上港交所。