跳到主要内容

MiMo-V2.6-Pro

概述

MiMo-V2.6-Pro 是小米 MiMo 于 2026 年 9 月 22 日发布的 V2.6 系列旗舰开放权重原生多模态推理模型。其 API 模型 ID 为 mimo-v2.6-pro,采用稀疏 Mixture-of-Experts 架构和 1M Token 上下文窗口,面向复杂软件工程、长周期 Agent 工作流,以及涉及多种工具和模态的研究任务。

核心特性

  • 大规模稀疏架构:总参数量为 1.02 万亿,激活参数量为 420 亿;公开的 MiMo-V2.6-Pro-RL 检查点采用 MIT 许可证。
  • 原生多模态推理:结合文本、图像、视频和音频理解,适合需要跨不同证据形式进行推理的任务。
  • 长周期 Agent 训练:混合强化学习覆盖编程、通用 Agent、视觉任务和网络安全,并使用多种 Agent 框架。
  • 扩展工作上下文:1M Token 窗口可容纳大型代码库、长篇文档和累积的工具结果。
  • 工具辅助创作:通过外部工具和视觉反馈,支持代码驱动的界面、演示文稿和 3D 工作流。

适用场景

  • 仓库级软件工程:在代码及工具历史上持续推理,完成多文件实现、调试、测试和修改。
  • 复杂工作流自动化:跨应用执行多步骤任务,检查中间结果并调整后续操作。
  • 多模态研究辅助:综合长文档、视觉或音频证据,并在需要时结合外部搜索和计算。
  • 视觉开发与内容生产:通过生成代码、创作工具和渲染结果检查来构建界面、演示文稿和交互场景。

能力与限制

能力维度说明
推理能力深度思考默认开启,可在 Chat Completions 中通过 thinking.type 关闭。
编程能力小米发布的模型卡评测显示,其 DeepSWE v1.1 得分为 71.9。
Agent 评测小米报告其 Toolathlon-Verified 和 OSWorld-Verified 得分分别为 76.9 和 82.0;这些是模型提供方公布的评测结果,不代表生产环境保证。
多模态能力支持文本、图像、视频和音频输入,输出文本。
上下文窗口1M Token。
最大输出131,072 Token,由推理内容与最终回答共享。
工具调用支持函数调用、流式输出、提示词缓存及小米单独计费的网页搜索服务。
结构化输出支持 JSON object 模式;字段、类型和嵌套结构仍由提示词定义,并需在应用端校验。

已知限制

  • 原生输出为文本;视频、音乐或 3D 创作演示依赖外部工具和生成代码。
  • 思考模式固定使用 temperature=1.0top_p=0.95。多轮工具对话必须保留历史 reasoning_content,缺失时可能导致 HTTP 400 错误。
  • Chat Completions 仅支持 tool_choice=auto,其他值会被忽略并按自动选择处理。

标准价格

以下 Token 价格均以美元计价,单位为每 100 万 Token;网页搜索按次计费。

模型输入
(USD / 1M Tokens)
缓存写入
(USD / 1M Tokens)
缓存读取
(USD / 1M Tokens)
输出
(USD / 1M Tokens)
网页搜索
(USD / 次)
MiMo-V2.6-Pro$0.435$0.435$0.0036$0.87-

Credits 结算: B.AI 按照 1 USD = 1,000,000 Credits 换算,并从账户余额中扣除 Credits。

价格说明

文档价格为 B.AI 平台模型标准参考价,仅供基础计费说明使用。B.AI 可能会通过充值赠送及账户权益等方式,为用户提供更低的实际使用成本。具体价格、赠送积分及账户权益请以平台页面展示及最终账单为准。