中国大模型调用量持续占据全球首位,上海大模型巨头 MiniMax 也发布了最新大模型产品。
9 月 28 日,澎湃新闻记者获悉,MiniMax 上线文本模型 M3.1-Flash-Preview 并开启公测。
据 MiniMax 介绍,该模型支持原生多模态及百万上下文窗口,为日常开发提供稳定、真实的生产力,能够可靠完成 Bug 修复、完整功能开发等任务。该模型可参与问题定位、代码实现和测试验证,针对边界情况补充处理逻辑、完善回归测试,并验证改动对现有功能的影响,形成从问题定位到成果交付的可靠开发闭环。
值得注意的是,M3.1-Flash-Preview 上线后,有开发者将其与近期走红的匿名模型 Space Bunny(太空兔,也称“玉兔”)联系起来。
Space Bunny 是谁?
据全球模型聚合平台 OpenRouter 最新数据排名显示,9 月 21 日至 9 月 27 日全球 AI 大模型总调用量为 146 万亿 Token,环比增长 13.18%。
上榜的 AI 大模型中,中国 AI 大模型周调用量达 62.22 万亿 Token,环比下滑 7.77%;同期美国 AI 大模型周调用量为 14.2 万亿 Token,环比下滑 0.07%。
这也是中国大模型周调用量连续二十二周超过美国,位居全球首位。
上周,全球调用量排名前五中,有三款中国 AI 大模型。其中,DeepSeek V4.1 Flash 连续两周位居第一,周调用量达 19.6 万亿 Token,环比增长 24%;智谱 GLM 5.3 Flash 连续两周位居第二,周调用量达 16.3 万亿 Token,环比增长 16%;腾讯 Hy4 preview 排名第四,周调用量达 9.64 万亿 Token,环比下滑 23%。
匿名的“玉兔”大模型也在中秋期间冲上榜单,位居第三,周调用量达 13.9 万亿 Token。
围绕 Space Bunny 的真实身份,分词器测试成为社区讨论和猜测的一条线索。相关测试发现,其 Token 计数特征与 MiniMax 模型一致。有 Redidit 开发者进一步猜测 Space Bunny 可能是 MiniMax M3.1 Flash 的预览版本,不过,上述说法尚未得到 MiniMax 官方确认。
此前 MiniMax 正式开源新一代通用多模态生成模型 MiniMax H3,在 Artificial Analysis 视频编辑评测榜、Arena 图生视频排行榜中均位列全球第一,并获得 Stable Diffusion 创始人 Emad Mostaque、硅谷投资机构 a16z 合伙人 Justine Moore 等业内知名人士点赞。在开源社区 Hugging Face 上,MiniMax H3 热度一度上升至第一名,超过 DeepSeek V4 Flash。
此前在财报后的电话会议中,MiniMax CEO 闫俊杰曾表示,过去两个多月文本模型单位算力吞吐提升 3 倍,M3.1 目标是把推理成本降到 M3 刚上线时的约三分之一;成本下降后,一部分让利给客户、扩大 Token 规模,一部分保留以改善毛利。
闫俊杰称,目前多模态和语音的毛利率相对更高,文本模型收入占比快速提升而推理成本快速下降,预计文本业务会成为整体毛利率改善的重要驱动力,下半年毛利率继续改善,明年仍有提升空间。他同时判断,随着模型能力和可靠性提升,商业模式可能从按 Token 计费,逐步转向按任务结果和专业价值计费。
