GPT-5.6 Sol
概述
GPT-5.6 Sol 是 OpenAI GPT-5.6 系列的旗舰层级模型,已于 2026 年 7 月 9 日正式可用。在 API 中,模型 ID 为 gpt-5.6-sol,gpt-5.6 alias 会路由到该层级。它面向复杂专业工作、推理、代码、安全、科学研究和工具密集型工作流。
核心特性
- GPT-5.6 旗舰层级:面向复杂专业工作、推理、代码、安全、科学研究和工具密集型工作流。
- 扩展推理控制:支持
none、low、medium、high、xhigh和max推理强度;GPT-5.6 还支持通过reasoning.mode: "pro"启用 Pro 模式。 - Agent 工具能力:支持 Responses API 工作流、函数调用、网页搜索、文件搜索、Computer Use、Programmatic Tool Calling、持久化推理和多 Agent beta 能力。
- 大工作上下文:支持 1.05M token 上下文窗口和最高 128K 输出 token,知识截止时间为 2026 年 2 月 16 日。
适用场景
- 复杂软件工程:代码库级调试、命令行工作流、多文件实现、验证和代码审查。
- 长周期知识工作:需要持续上下文和工具协同的浏览器、文档、表格、演示文稿和 Computer Use 任务。
- 防御性安全与研究支持:在人工监督下,用于授权漏洞审查、补丁开发、威胁建模、生物工作流分析和科学研究辅助。
能力与限制
| 能力维度 | 说明 |
|---|---|
| 推理能力 | 支持 none、low、medium、high、xhigh 和 max;API Pro 模式通过 reasoning.mode: "pro" 启用,而不是独立的 Pro 模型 ID。 |
| 编程能力 | 官方示例指标包括 SWE-Bench Pro 64.6%、DeepSWE v1.1 72.7%、Terminal-Bench 2.1 88.8% 和 Terminal-Bench 2.1 Ultra 91.9%。 |
| 创作能力 | 支持通用文本生成。 |
| 多模态能力 | 支持文本和图像输入、文本输出;当图像 detail 为 original 或 auto 时,GPT-5.6 会保留原始图像尺寸。 |
| 响应速度 | 公共 API 延迟取决于推理强度、工具使用和处理层级;OpenAI 也宣布 Sol 可为部分客户通过 Cerebras 提供最高 750 tokens/s 的访问能力。 |
| 上下文窗口 | 1.05M tokens。 |
| 最大输出 | 128K tokens。 |
| 工具调用 | 函数调用、网页搜索、文件搜索、Computer Use、Programmatic Tool Calling、持久化推理和多 Agent beta。 |
| 多语言能力 | OpenAI API 模型文档列出当前模型支持多语言能力。 |
已知限制
- 更高推理强度、Pro 模式、多 Agent 运行和长上下文使用会增加延迟和成本。
- 网络安全和生物相关防护可能会拒绝、阻止或暂停敏感请求,包括部分合法的双用途工作。
- OpenAI 表示 GPT-5.6 在网络安全或生物评估中未达到 Critical 阈值,因此不应被视为高风险工作的自主操作者。
- GPT-5.6 模型的 Prompt Cache 写入会计费,因此建议通过
cache_write_tokens和cached_tokens监控缓存断点。
积分消耗
| 上下文档位 | 输入 (Credits/Token) | Cache Write (Credits/Token) | Cache Read (Credits/Token) | 输出 (Credits/Token) | 网页搜索(Credits/次) | 计费说明 |
|---|---|---|---|---|---|---|
| 短上下文 | 5.00 | 6.25 | 0.50 | 30.00 | 10,000 | GPT-5.6 Sol 标准价格 |
| 长上下文(输入 token >272K) | 10.00 | 12.50 | 1.00 | 45.00 | 10,000 | 长上下文价格档位 |
价格说明
文档价格为 B.AI 平台模型标准参考价,仅供基础计费说明使用。B.AI 可能会通过充值赠送及账户权益等方式,为用户提供更低的实际使用成本。具体价格、赠送积分及账户权益请以平台页面展示及最终账单为准。
- GPT-5.6 模型的缓存写入按未缓存输入价格的 1.25x 计费;缓存读取按输入价格的 0.1x 折扣计费。