跳到主要内容

Hy3

概述

Hy3 是腾讯混元于 2026 年 7 月 6 日发布的文本基础模型,API 模型 ID 为 hy3。该模型采用 Mixture-of-Experts(MoE)架构,总参数量为 2950 亿、激活参数量为 210 亿,面向编程、长上下文知识工作、推理以及工具驱动的 Agent 工作流。

核心特性

  • 混合推理: 支持直接响应和深度推理。官方提供 no_thinkthink_lowthink_high 三种模式,开发者可在响应速度与推理深度之间进行选择。
  • 稀疏 MoE 架构: 总参数量为 2950 亿,激活参数量为 210 亿;架构包含 192 个专家,每个 token 激活其中 8 个,并包含 38 亿 MTP 层参数。
  • 长上下文生成: 支持 256K token 上下文窗口、192K token 最大输入和 128K token 最大输出。
  • 面向 Agent 的 API 支持: 支持结构化输出、函数调用、上下文缓存,以及面向工具工作流的推理内容保留。

适用场景

  • 软件工程 Agent: 仓库级实现、调试、前端开发、CI/CD 工作,以及多步骤工具调用。
  • 办公与知识工作: 长文档分析、报告和演示文稿准备、知识库问答以及结构化文件生成。
  • 金融与数据工作流: 结合推理、外部工具和迭代验证的财务建模、数据分析及其他工作流。
  • 长周期 Agent 任务: 需要规划、重复工具调用、多轮约束保持,以及从工具调用错误中恢复的工作流。
  • 自托管模型定制: 基于开放权重进行私有部署、微调、量化或强化学习后训练。

能力与限制

能力维度说明
推理能力支持 no_thinkthink_lowthink_high 三种直接响应与深度推理模式。
创意写作支持通用文本生成和长内容工作流。
编程能力面向编程 Agent 和软件研发工作流设计。腾讯报告其在前端开发、数据与存储、CI/CD 任务上表现突出。
多模态能力仅支持文本输入和文本输出。
上下文窗口256K token。
最大输入192K token。
最大输出128K token。
工具调用支持函数调用、结构化输出、自动工具选择,以及跨工具调用的推理内容保留。

已知限制

  • Hy3 为纯文本模型;如需原生理解图像、音频或视频,应使用单独的多模态模型。
  • 在多轮工具调用中启用推理内容保留时,客户端需要将助手消息中的 reasoning_content 与工具调用及工具结果一并返回。丢失该状态会中断官方定义的后续工作流。

价格

模型名称输入(Credits/Token)缓存写入(Credits/Token)缓存读取(Credits/Token)输出(Credits/Token)网页搜索(Credits/次)
Hy30.1320.1320.0330.528-
价格说明

文档价格为 B.AI 平台模型标准参考价,仅供基础计费说明使用。B.AI 可能会通过充值赠送及账户权益等方式,为用户提供更低的实际使用成本。具体价格、赠送积分及账户权益请以平台页面展示及最终账单为准。