跳到主要内容

Hy4 Preview

概述

Hy4 Preview 是腾讯混元团队于 2026 年 8 月 28 日发布的开源权重混合专家(MoE)语言模型,也是 Hy4 系列的早期版本。模型主干总参数量为 7700 亿,每个 Token 激活 490 亿参数,并支持 1M Token 上下文窗口。在 B.AI 上使用时,模型 ID 为 hy4-preview

核心特性

  • 770B 稀疏 MoE 架构: 模型包含 78 层主干网络;每个 MoE 层包含 256 个路由专家和 1 个共享专家,每个 Token 激活 8 个路由专家及共享专家。独立的原生 MTP 层另含 100 亿总参数和 7 亿激活参数,用于推测解码。
  • 长上下文 API 限制: 支持 1M Token 上下文窗口,最大输入 960K Tokens,最大输出 64K Tokens。
  • 保留深度推理: 默认启用思考。API 会返回 reasoning_content;在多轮工具调用中,应随完整的 Assistant 消息一并回传。
  • Agent API 支持: 支持结构化输出、函数调用、缓存输入,以及 OpenAI Chat Completions、OpenAI Responses 和 Anthropic Messages 接口。
  • 面向生产力任务的验证: 在腾讯内部盲测中,163 位专家对 203 项工程任务的输出进行评分。Hy4 Preview 平均得分为 2.99/4.00,GLM-5.3 为 2.92,Kimi K3 为 2.94。

适用场景

  • 软件工程 Agent: 适用于大型代码仓库中的长期规划、实现、调试、验证、前端开发和多步骤工具调用。
  • 办公与数据工作流: 适用于跨文档分析、财务建模、数据分析,以及文档、电子表格和演示文稿的生成。
  • 游戏开发: 适用于可玩原型生成、游戏引擎工作流和多轮迭代优化。
  • 科学研究: 适用于 AI 研究、分子动力学、凝聚态物理和数学等领域的工具辅助分析与问题求解。
  • 私有化或定制部署: 适用于具备相应计算资源,并需要本地推理、量化或特定任务微调的开源权重部署场景。

能力与限制

能力说明
推理支持保留思考内容的深度推理。文档提供 lowhigh 两档推理强度;在 hy4-preview 工具工作流中默认为 high
创意写作支持通用文本生成和中文内容创作。
多模态文本输入、文本输出。
响应速度腾讯未公布有保证的生成速率。官方发布资料显示,借助模型与推理系统协同优化,吞吐量相对腾讯内部基线提升 31.8%。
上下文窗口1M Tokens。
最大输入960,000 Tokens。
最大输出64,000 Tokens。
工具调用支持函数调用、结构化输出、自动工具选择、缓存输入,以及在工具调用之间保留推理内容。
多语言腾讯文档明确支持中文和英文使用。

已知限制

  • 腾讯将该版本定位为 Hy4 的早期版本,而非最终版 Hy4 模型。
  • 官方模型卡指出,Hy4 Preview 在处理复杂任务时可能进行超过必要程度的推理,并可能出现过度验证。
  • 多轮工具集成应保留并回传完整的 Assistant 消息,包括 reasoning_content;省略该字段可能影响后续调用的连续性。
  • Hy4 Preview 不支持原生图像、音频或视频理解。
  • 腾讯尚未公布该模型的具体知识截止时间、有保证的 API 吞吐量或完整语言支持列表。

定价

模型输入(Credits/Token)缓存写入(Credits/Token)缓存读取(Credits/Token)输出(Credits/Token)网页搜索(Credits/次)
Hy4 Preview0.8340.8340.0422.501-
价格说明

文档价格为 B.AI 平台模型标准参考价,仅供基础计费说明使用。B.AI 可能会通过充值赠送及账户权益等方式,为用户提供更低的实际使用成本。具体价格、赠送积分及账户权益请以平台页面展示及最终账单为准。