小米MiMo-V2.5周调用量10.5万亿Token登顶全球第一,收费大模型凭什么逆势增长?

小米MiMo-V2.5周调用量10.5万亿Token登顶全球第一,收费大模型凭什么逆势增长?

2026年7月27日,小米集团董事长特别助理徐洁云在微博公布了一组震撼行业的数据:小米自研大模型MiMo-V2.5在OpenRouter平台上周调用量达到10.5万亿Token,环比增长12%,登顶全球大模型调用量周榜和月榜双第一。

更令人瞩目的是,这一成绩是在模型已全面收费的前提下实现的。这也意味着全球调用量排名前五全部被中国AI大模型包揽。

从全球第四到全球第一:MiMo的逆袭之路

回顾MiMo的进化轨迹,堪称教科书级的增长曲线:

  • 2025年12月:V2 Flash版本发布,以超高性价比迅速打开市场

  • 2026年3月:V2 Pro版本上线,综合智能指数跻身全球开源第一

  • 2026年4月:V2.5发布,同期开始收费,仍位列全球第四

  • 2026年5月:宣布API永久降价,最高降幅达99%,Token套餐用量提升5-8倍

  • 2026年6月:刷新全球最快推理速度,万亿参数模型生成速度首破1000 tokens/s

  • 2026年7月:周调用量10.5万亿Token登顶全球第一
  • 从4月收费后的全球第四到7月的全球第一,MiMo用不到三个月完成了逆袭。这背后并非简单的价格战逻辑,而是极致性价比+硬核产品力+精准商业化策略的三重驱动。

    性能到底有多强?

    根据Artificial Analysis榜单,MiMo-V2.5-Pro的综合智能指数位列全球开源大模型并列第一,总榜前五,超越了Claude Opus 4.6等闭源模型。Agent指数位居全球开源第一,代码能力尤为突出。

    一个极具说服力的案例:北大研究生需要数周才能完成的编译器项目,MiMo-V2.5-Pro仅用4.3小时一次跑通并拿到满分。在Text Arena权威盲测中,MiMo-V2-Pro也跻身全球前五。目前MiMo-V2-Pro在编程领域的市场占有率已超过30%。

    MiMo-V2.5系列采用MoE(混合专家)架构:

  • Pro版:总参数约1万亿,激活约30B,支持百万级上下文

  • Flash版:总参数309B,激活15B,推理速度约为DeepSeek V3.2的3倍
  • 定价策略:比Claude Opus便宜80%

    MiMo-V2.5的定价堪称行业最具竞争力:

  • 输入:1美元/百万Token

  • 输出:3美元/百万Token
  • 相比之下,Claude Opus 4.6输出价格为15美元/百万Token,MiMo仅为前者的五分之一。MiMo-V2.5 Flash版成本甚至仅为Gemini 2.5 Pro的二十分之一

    小米还推出了Token Plan订阅套餐:

  • 月费39元、99元、329元、659元四档

  • 支持夜间闲时(凌晨至8点)8折消耗

  • 256K与1M上下文同价

  • 订阅用户可获得新模型优先内测体验权
  • 花旗研报指出,小米激进的定价策略将推动Token使用量激增,同时有助于训练并提升大语言模型性能。开发者社区普遍认为MiMo是"当前国模套餐里最全面最实惠"的选择。

    中国大模型集体领跑

    此次登顶的意义不止于小米一家。OpenRouter数据显示,全球调用量排名前五全部为中国AI大模型。中国大模型周调用量已达到美国的14.1倍,且连续十三周超过美国,稳居全球首位。

    这一里程碑标志着中国大模型从"跟跑"到"领跑"的质变。小米MiMo已成为小米"人车家全生态"的智能底座,将装入手机、汽车、智能家居等全系产品。小米2026年AI研发投入预计超160亿元,未来3年超600亿元。

    开源与商业化并存

    小米已宣布MiMo-V2.5系列将于近期开源。这种"开源+API服务"的双轨策略,既能吸引社区贡献提升模型能力,又通过商业化服务实现盈利,形成良性循环。

    MiMo的成功给行业带来三点启示:

  • 性能为王——免费不是护城河,真正能打的模型用户愿意付费

  • 定价要灵活——"降价+套餐+闲时折扣"的组合拳,将开发者成本压到极致

  • 开源与商业化可以共存——社区贡献和API盈利相互促进
  • 对于普通消费者而言,小米大模型的进步也意味着手机、汽车、智能家居中的AI助手将更加强大。"人车家全生态"的AI体验值得期待。

    数据截至2026年7月27日,部分价格以小米官方实时发布为准。

    💬 评论区 (0)

    暂无评论,快来抢沙发吧!