系统极客一直在努力
专注操作系统及软件使用技能

Xiaomi MiMo-V2-Pro 发布:AI 智能体时代的旗舰基座

Xiaomi MiMo

小米专为 AI 智能体时代打造的旗舰级基座模型——Xiaomi MiMo-V2-Pro 正式发布。

Xiaomi MiMo-V2-Pro 专为现实世界中高强度的 Agent 工作场景而打造。它拥有超过 1T 的总参数量(42B 激活参数),采用创新的混合注意力架构,并支持 1M 超长上下文长度。在强大的模型基座上,小米在更为广泛的 Agent 场景中持续 Scaling 算力,进一步拓展了智能的动作空间,实现了从 Coding 到 Claw 的重要泛化。

在全球权威大模型综合智能排行榜 Artificial Analysis 上,MiMo-V2-Pro 目前位列全球第 8,国内第 2。

MiMo-V2-Pro 的 Artificial Analysis 排名
Artificial Analysis 排名

面对 OpenClaw、Claude Code 等前沿的 AI 智能体框架,MiMo-V2-Pro 展现出了令人惊艳的端到端任务统筹能力。

  • 它能在零人工干预的条件下,独立完成复杂工作流的编排、长程逻辑规划以及精准的工具调用,并稳定交付最终成果。
  • 从实际测试来看,其综合使用体感已全面超越 Claude Sonnet 4.6,直逼顶级模型 Opus 4.6。但 API 调用成本仅为后者的 1/5,彻底击穿了前沿 AI 技术的应用门槛。

底层基座能力的全面跃升

借助参数规模与算力的双重 Scaling,MiMo-V2-Pro 构筑了一个更庞大、更全能的智慧大脑。

  • 万亿参数,极致效能:模型总参数量飙升至 1T(激活参数 42B),规模是上一代 MiMo-V2-Flash 的 3 倍之多。架构层面,它继承了前代首创的混合注意力(Hybrid Attention)机制,并将混合比例从 5:1 激增至 7:1。这使得模型在参数暴涨的同时,依然保持了极高的数据吞吐效率,并完美支撑 1M 的超长上下文。此外,轻量级的多 Token 预测(MTP)层则为它带来了更极致的文本生成速度。
  • 从「陪聊」到「做事」:通过在后训练(Post-training)阶段针对海量 AI 智能体任务进行 Scaling,彻底重塑了模型的能力边界。它不再局限于「回答问题」或「生成漂亮演示」,而是真正具备了「完成复杂任务」的执行力。小米的愿景,是让其深度扎根于生产力场景,化身驱动系统运转的「中枢大脑」,在真实世界中持续输出业务价值。
  • 超越跑分的实战体验:在各大核心能力的基准测试中,MiMo-V2-Pro 均交出了亮眼答卷。无论是在代码智能体(Coding Agent)、通用 AI 智能体,还是各类工具调用(Tool Use)场景下,它都稳稳跻身全球第一梯队,与 Claude 4.5 SonnetGPT 5.2 以及 Gemini 3.0 Pro 并驾齐驱。值得一提的是,小米在训练优化阶段始终坚持「实战体感优先」,绝不为跑分而妥协,确保模型在真实落地场景中大放异彩。
MiMo-V2-Pro 基准测试
MiMo-V2-Pro 基准测试

天生为 AI 智能体定制的旗舰枢纽

MiMo-V2-Pro 的每一个技术细节,都在为 AI 智能体场景疯狂调优。

OpenClaw 的原生中枢

近期,OpenClaw 作为通用 AI 智能体框架在开源社区名声大噪。作为驱动这类框架的核心引擎,底层大模型的能力天花板直接决定了整个系统的业务表现。为此,MiMo-V2-Pro 专门针对复杂多变的 AI 智能体脚手架(Agent Scaffold)进行了深度的监督微调(SFT)与强化学习(RL),从而淬炼出极为强悍的工具调用与多步推理能力。

在 OpenClaw 的官方权威评测榜单 PinchBench 和 ClawEval 上,MiMo-V2-Pro 的成绩傲视全球。与此同时,得益于 1M 超长上下文窗口的加持,它能够游刃有余地支撑起现实世界中各种高负荷、高复杂度的 Claw 业务流。下图中展示的 Hunter Alpha,正是 MiMo-V2-Pro 在早期测试阶段的匿名版本。

MiMo-V2-Pro ClawEval 榜单排名
ClawEval 榜单排名

代码编写能力的深度进化

MiMo-V2-Pro 的野心远不止于极具观赏性的 Vibe Coding,它更擅长直接深入到严苛、复杂的工程代码构建中。

  • 在小米内部资深工程师的严苛测试中,MiMo-V2-Pro 的工作体感已经无限逼近 Claude Opus 4.6。它展现出了令人惊叹的高阶代码智慧:不仅具备极其出色的系统架构设计与长线任务规划能力,其产出的代码风格也更为优雅,甚至在排查 Bug 时能给出更为直接、高效的解决路径。
  • 在 Hunter Alpha 匿名公测期间,调用量名列前茅的应用几乎清一色是硬核的开发专用工具。这一客观数据,强有力地印证了 MiMo-V2-Pro 在真实研发一线具备极高的可用性与绝对的可靠性。
MiMo-V2-Pro 的工具调用量
的工具调用量

MiMo-V2-Pro API 全面开放

现在,MiMo-V2-Pro 的模型 API 服务已正式上线,原生支持 1M 超长上下文,并采用灵活的梯度计价策略:

  • 256K 以内:输入 $1/百万 Tokens,输出 $3/百万 Tokens。
  • 256K ~ 1M:输入 $2/百万 Tokens,输出 $6/百万 Tokens。

立即访问 https://platform.xiaomimimo.com,将顶级 AI 算力接入你的业务流中。

赞(0)
分享到

评论 抢沙发