小米开源 MiMo-V2.6,AA智能指数46分登顶最强开源模型

小米开源 MiMo-V2.6,AA智能指数46分登顶最强开源模型

近日,小米 AI Lab 正式开源了其最新的大语言模型 MiMo-V2.6(小米多模态模型第二代第六版)。根据权威评测机构发布的 **AA智能指数(AI Assessment Index)**,该模型以 **46分** 的成绩超越此前保持纪录的 Llama-3-70B 和 Qwen2.5-72B,一举登顶 **最强开源模型** 的宝座。这一成绩不仅标志着小米在基础大模型领域的突破性进展,也为全球开源社区注入了一剂强心针。

技术亮点:稀疏 MoE + 多模态融合

MiMo-V2.6 采用了 **混合专家架构**,在保持 67B 总参数量的同时,每次推理仅激活约 16B 参数,实现了性能与效率的平衡。模型在预训练阶段引入了大规模图文对数据,并针对中文场景进行了深度优化,使其在 **知识推理、代码生成、长文本理解** 等核心任务上表现突出。AA 智能指数综合了 MMLU、C-Eval、GSM8K 等 12 个主流基准测试的加权得分,MiMo-V2.6 在数学推理(GSM8K 准确率 92.4%)和中文理解(C-Eval 89.6分)方面尤其亮眼。

评测对比:超越闭源并非遥不可及

此前,开源模型与闭源模型(如 GPT-4o、Claude-3.5 Sonnet)在 AA 指数上的差距通常在 10-15 分。MiMo-V2.6 的 46 分已逼近 GPT-4o 的 48.2 分,而 **完全开源** 的策略——包括模型权重、训练代码及部分数据配方——使得学术界和中小开发者能够直接复现、微调甚至部署。相较之下,Meta 的 Llama-3 虽然开源,但在多语言能力上略逊一筹;阿里 Qwen2.5 则侧重但缺乏多模态深度。MiMo-V2.6 凭借“轻量激活+全面多模态”的独特定位,填补了市场空白。

行业影响与展望

小米此次开源 MiMo-V2.6,既是技术实力的展示,也是生态战略的落地。通过较低的门槛提供接近闭源的智能水平,有望加速 AI 在 **智能手机 IoT 终端、自动驾驶辅助、智能客服** 等场景的渗透。同时,46 分的 AA 指数也提醒业界:开源模型的“智能天花板”正在快速抬升,未来半年内,开源与闭源的差距可能进一步缩小。对于后续版本(如 MiMo-V3),行业期望其在 **实时流式推理和端侧部署** 上带来更多创新。

> 注:AA智能指数由开放原子基金会联合多家高校发布,满分100分,主要考察语言理解、知识问答、数学推理、代码生成及多模态理解五大维度。

相关文章