MiMo-V2.6-Pro
概述
MiMo-V2.6-Pro 是小米 MiMo 于 2026 年 9 月 22 日发布的 V2.6 系列旗舰开放权重原生多模态推理模型。其 API 模型 ID 为 mimo-v2.6-pro,采用稀疏 Mixture-of-Experts 架构和 1M Token 上下文窗口,面向复杂软件工程、长周期 Agent 工作流,以及涉及多种工具和模态的研究任务。
核心特性
- 大规模稀疏架构:总参数量为 1.02 万亿,激活参数量为 420 亿;公开的 MiMo-V2.6-Pro-RL 检查点采用 MIT 许可证。
- 原生多模态推理:结合文本、图像、视频和音频理解,适合需要跨不同证据形式进行推理的任务。
- 长周期 Agent 训练:混合强化学习覆盖编程、通用 Agent、视觉任务和网络安全,并使用多种 Agent 框架。
- 扩展工作上下文:1M Token 窗口可容纳大型代码库、长篇文档和累积的工具结果。
- 工具辅助创作:通过外部工具和视觉反馈,支持代码驱动的界面、演示文稿和 3D 工作流。
适用场景
- 仓库级软件工程:在代码及工具历史上持续推理,完成多文件实现、调试、测试和修改。
- 复杂工作流自动化:跨应用执行多步骤任务,检查中间结果并调整后续操作。
- 多模态研究辅助:综合长文档、视觉或音频证据,并在需要时结合外部搜索和计算。
- 视觉开发与内容生产:通过生成代码、创作工具和渲染结果检查来构建界面、演示文稿和交互场景。
能力与限制
| 能力维度 | 说明 |
|---|---|
| 推理能力 | 深度思考默认开启,可在 Chat Completions 中通过 thinking.type 关闭。 |
| 编程能力 | 小米发布的模型卡评测显示,其 DeepSWE v1.1 得分为 71.9。 |
| Agent 评测 | 小米报告其 Toolathlon-Verified 和 OSWorld-Verified 得分分别为 76.9 和 82.0;这些是模型提供方公布的评测结果,不代表生产环境保证。 |
| 多模态能力 | 支持文本、图像、视频和音频输入,输出文本。 |
| 上下文窗口 | 1M Token。 |
| 最大输出 | 131,072 Token,由推理内容与最终回答共享。 |
| 工具调用 | 支持函数调用、流式输出、提示词缓存及小米单独计费的网页搜索服务。 |
| 结构化输出 | 支持 JSON object 模式;字段、类型和嵌套结构仍由提示词定义,并需在应用端校验。 |
已知限制
- 原生输出为文本;视频、音乐或 3D 创作演示依赖外部工具和生成代码。
- 思考模式固定使用
temperature=1.0和top_p=0.95。多轮工具对话必须保留历史reasoning_content,缺失时可能导致 HTTP 400 错误。 - Chat Completions 仅支持
tool_choice=auto,其他值会被忽略并按自动选择处理。
标准价格
以下 Token 价格均以美元计价,单位为每 100 万 Token;网页搜索按次计费。
| 模型 | 输入 (USD / 1M Tokens) | 缓存写入 (USD / 1M Tokens) | 缓存读取 (USD / 1M Tokens) | 输出 (USD / 1M Tokens) | 网页搜索 (USD / 次) |
|---|---|---|---|---|---|
| MiMo-V2.6-Pro | $0.435 | $0.435 | $0.0036 | $0.87 | - |
Credits 结算: B.AI 按照 1 USD = 1,000,000 Credits 换算,并从账户余额中扣除 Credits。
价格说明
文档价格为 B.AI 平台模型标准参考价,仅供基础计费说明使用。B.AI 可能会通过充值赠送及账户权益等方式,为用户提供更低的实际使用成本。具体价格、赠送积分及账户权益请以平台页面展示及最终账单为准。