Hy3
概述
Hy3 是腾讯混元于 2026 年 7 月 6 日发布的文本基础模型,API 模型 ID 为 hy3。该模型采用 Mixture-of-Experts(MoE)架构,总参数量为 2950 亿、激活参数量为 210 亿,面向编程、长上下文知识工作、推理以及工具驱动的 Agent 工作流。
核心特性
- 混合推理: 支持直接响应和深度推理。官方提供
no_think、think_low和think_high三种模式,开发者可在响应速度与推理深度之间进行选择。 - 稀疏 MoE 架构: 总参数量为 2950 亿,激活参数量为 210 亿;架构包含 192 个专家,每个 token 激活其中 8 个,并包含 38 亿 MTP 层参数。
- 长上下文生成: 支持 256K token 上下文窗口、192K token 最大输入和 128K token 最大输出。
- 面向 Agent 的 API 支持: 支持结构化输出、函数调用、上下文缓存,以及面向工具工作流的推理内容保留。
适用场景
- 软件工程 Agent: 仓库级实现、调试、前端开发、CI/CD 工作,以及多步骤工具调用。
- 办公与知识工作: 长文档分析、报告和演示文稿准备、知识库问答以及结构化文件生成。
- 金融与数据工作流: 结合推理、外部工具和迭代验证的财务建模、数据分析及其他工作流。
- 长周期 Agent 任务: 需要规划、重复工具调用、多轮约束保持,以及从工具调用错误中恢复的工作流。
- 自托管模型定制: 基于开放权重进行私有部署、微调、量化或强化学习后训练。
能力与限制
| 能力维度 | 说明 |
|---|---|
| 推理能力 | 支持 no_think、think_low 和 think_high 三种直接响应与深度推理模式。 |
| 创意写作 | 支持通用文本生成和长内容工作流。 |
| 编程能力 | 面向编程 Agent 和软件研发工作流设计。腾讯报告其在前端开发、数据与存储、CI/CD 任务上表现突出。 |
| 多模态能力 | 仅支持文本输入和文本输出。 |
| 上下文窗口 | 256K token。 |
| 最大输入 | 192K token。 |
| 最大输出 | 128K token。 |
| 工具调用 | 支持函数调用、结构化输出、自动工具选择,以及跨工具调用的推理内容保留。 |
已知限制
- Hy3 为纯文本模型;如需原生理解图像、音频或视频,应使用单独的多模态模型。
- 在多轮工具调用中启用推理内容保留时,客户端需要将助手消息中的
reasoning_content与工具调用及工具结果一并返回。丢失该状态会中断官方定义的后续工作流。
价格
| 模型名称 | 输入(Credits/Token) | 缓存写入(Credits/Token) | 缓存读取(Credits/Token) | 输出(Credits/Token) | 网页搜索(Credits/次) |
|---|---|---|---|---|---|
| Hy3 | 0.132 | 0.132 | 0.033 | 0.528 | - |
价格说明
文档价格为 B.AI 平台模型标准参考价,仅供基础计费说明使用。B.AI 可能会通过充值赠送及账户权益等方式,为用户提供更低的实际使用成本。具体价格、赠送积分及账户权益请以平台页面展示及最终账单为准。