小米MiMo-V2.5登顶全球AI大模型调用量榜首,周调用量超10.5万亿Token
事件背景
近日,全球AI大模型调用量排行榜更新,小米自研的MiMo-V2.5模型以周调用量超过10.5万亿Token的成绩登顶榜首,超越OpenAI、Google、Meta等国际巨头的主流模型。这一数据来自多家第三方API监测平台,标志着中国AI大模型在规模化落地层面迈出了关键一步。
数据解读与可信度
10.5万亿Token的周调用量,意味着日均约1.5万亿Token的处理量。若以单次对话平均消耗2000 Token计算,相当于每天支持超过7.5亿次交互请求。这一规模远超此前业界对“头部模型”的认知——例如GPT-4等公开API的调用量通常被估计在千万到亿次级别。MiMo-V2.5的高调用量主要源于小米将其深度整合至手机、智能家居、车载系统等终端设备,形成“端侧+云端”协同的推理网络,用户每次语音唤醒、文本生成、图像理解等操作均计入统计。
技术优势与生态驱动
MiMo-V2.5之所以能实现如此高的调用频率,关键得益于三点:**轻量化架构**、**硬件协同优化**以及**场景化部署**。该模型采用MoE(混合专家)架构,在保持百亿参数级别的同时,通过稀疏激活将单次推理成本降至传统千亿模型的1/10。配合小米自研的澎湃OS及NPU芯片,在手机端即可完成大部分轻量推理,仅将复杂任务上云。此外,小米拥有超过5亿台活跃智能设备,覆盖语音助手、智能家居控制、AI写作、实时翻译等高频场景,天然形成了庞大的调用基础。
行业影响与意义
此次登顶不仅是对小米AI战略的肯定,更揭示了AI大模型竞争的新格局:**“调用量”正在取代“参数规模”成为衡量模型实用价值的关键指标**。过去业界比拼动辄千亿、万亿参数,但MiMo-V2.5以“足够好、足够快、足够便宜”的策略,证明了模型在真实场景中的渗透力比单纯的理论性能更重要。对于其他厂商而言,这意味着需要从“秀肌肉”转向“建生态”,将模型能力真正嵌入用户日常使用的每一个触点。
展望
随着端侧AI芯片的进一步发展和模型压缩技术的成熟,MiMo-V2.5的调用量有望继续攀升。小米已宣布将开放部分模型能力给第三方开发者,并计划推出MiMo-V3.0版本,进一步降低推理成本。可以预见,AI大模型将进入“亿级日活”时代,而调用量榜单的竞争,本质上是对用户触达能力和场景覆盖能力的终极考验。