3月19日,小米正式发布三款自研大模型:Xiaomi MiMo-V2-Pro、Xiaomi MiMo-V2-Omni 和 Xiaomi MiMo-V2-TTS。其中,MiMo-V2-Pro 与 MiMo-V2-Omni 已开放 API 服务。

据小米官方介绍,这三款模型分别覆盖了智能体(Agent)的核心能力:

  • MiMo-V2-Pro 是旗舰级文本基座模型,专为高强度 Agent 场景打造,强调推理、任务规划和工具调用能力;
  • MiMo-V2-Omni 是全模态 Agent 基座,原生融合文本、视觉和音频感知,打通从理解到执行的完整链路;
  • MiMo-V2-TTS 是语音合成大模型,目标是赋予 Agent 有温度、有情感的声音表达,补全人机交互的最后一环。

其中,MiMo-V2-Pro 参数总量突破 1 万亿(1T),激活参数为 420 亿(42B),采用改进版混合注意力机制(Hybrid Attention),在保持高效推理的同时显著提升模型容量。其上下文窗口扩展至 100 万 Token,可支持超长任务链和复杂工作流。

MiMo-V2-Omni 则实现了图像、音频、视频等多模态信号的对齐;MiMo-V2-TTS 搭载细粒度情感控制引擎,让 AI 的语音输出更接近人类表达。

在定价方面,小米主打高性价比:

  • MiMo-V2-Pro:256K 上下文内,输入每百万 tokens 1 美元,输出 3 美元;1M 上下文内,输入 2 美元,输出 6 美元;
  • MiMo-V2-Omni:支持 256K 上下文,输入每百万 tokens 0.4 美元,输出 2 美元。

为加速开发者生态建设,小米还联合 OpenClaw、OpenCode、KiloCode、Blackbox 和 Cline 五大主流 Agent 框架团队,提供为期一周的免费 API 接入支持。

当天一早,小米创始人雷军在社交平台宣布:“今年我们在 AI 领域的研发和资本投入将超过 160 亿元。”他还透露,MiMo-V2-Pro 在全球大模型综合智能排行榜 Artificial Analysis 上位列第八,按品牌排名则排第五。“模型刚完成,后续还会快速迭代。”

值得注意的是,此前在 OpenRouter 平台引发热议的神秘模型 “Hunter Alpha”,正是 MiMo-V2-Pro 的内部测试版。该模型上线七天内累计调用量突破 1 万亿 Token,一度被误认为是 DeepSeek V4 的早期版本。

“Hunter Alpha”背后的负责人,是 95 后小米 MiMo 大模型团队负责人罗福莉,业内称她为“AI 才女”。她早年在阿里达摩院主导开发多语言预训练模型 VECO,并推动 AliceMind 开源;2022 年加入幻方量化(DeepSeek 母公司),参与 DeepSeek-V2 等模型研发。

去年 12 月,罗福莉首次在小米“人车家全生态”大会上公开亮相。同月 17 日,小米集团总裁卢伟冰宣布开源 MiMo-V2-Flash,并表示小米已在 AI 领域启动“压强式投入”,未来将聚焦“AI 与物理世界的深度结合”。

此次三款大模型的发布,标志着小米全面押注 Agent 时代的决心——不仅自研底座,更以开放 API 和低价策略加速落地,试图在 AI 新一轮竞争中抢占先机。