GPT-5.6 Terra
概述
GPT-5.6 Terra 是 OpenAI GPT-5.6 系列的平衡层级模型,已于 2026 年 7 月 9 日正式可用。在 API 中,模型 ID 为 gpt-5.6-terra,OpenAI 将其定位为在能力与成本之间取得平衡的工作负载选择。
核心特性
- 平衡型 GPT-5.6 层级:定位介于 Sol 和 Luna 之间,适合需要强推理能力、但希望成本低于 Sol 的生产工作流。
- 扩展推理控制:支持
none、low、medium、high、xhigh和max推理强度;GPT-5.6 还支持通过reasoning.mode: "pro"启用 Pro 模式。 - Agent 工具能力:支持 Responses API 工作流、函数调用、网页搜索、文件搜索、Computer Use、Programmatic Tool Calling、持久化推理和多 Agent beta 能力。
- 大工作上下文:支持 1.05M token 上下文窗口和最高 128K 输出 token,知识截止时间为 2026 年 2 月 16 日。
适用场景
- 生产知识工作:写作、分析、文档处理、结构化研究和多步骤业务工作流。
- 软件工程辅助:调试、测试规划、代码审查、代码库导航和实现支持,同时兼顾成本控制。
- 规模化专业自动化:需要较强质量、但并非每次请求都必须使用 Sol 的工具密集型工作流。
能力与限制
| 能力维度 | 说明 |
|---|---|
| 推理能力 | 支持 none、low、medium、high、xhigh 和 max;API Pro 模式通过 reasoning.mode: "pro" 启用,而不是独立的 Pro 模型 ID。 |
| 编程能力 | 官方示例指标包括 SWE-Bench Pro 63.4%、DeepSWE v1.1 69.6% 和 Terminal-Bench 2.1 87.4%。 |
| 创作能力 | 支持通用文本生成。 |
| 多模态能力 | 支持文本和图像输入、文本输出;当图像 detail 为 original 或 auto 时,GPT-5.6 会保留原始图像尺寸。 |
| 响应速度 | 公共 API 延迟取决于推理强度、工具使用和处理层级;Terra 定位为兼顾智能水平与成本的平衡层级。 |
| 上下文窗口 | 1.05M tokens。 |
| 最大输出 | 128K tokens。 |
| 工具调用 | 函数调用、网页搜索、文件搜索、Computer Use、Programmatic Tool Calling、持久化推理和多 Agent beta。 |
| 多语言能力 | OpenAI API 模型文档列出当前模型支持多语言能力。 |
已知限制
- Terra 的能力定位低于 Sol,最困难且质量优先的工作流可能需要 Sol、Pro 模式或更高推理强度。
- 更高推理强度、Pro 模式、多 Agent 运行和长上下文使用会增加延迟和成本。
- 网络安全和生物相关防护可能会拒绝、阻止或暂停敏感请求,包括部分合法的双用途工作。
- GPT-5.6 模型的 Prompt Cache 写入会计费,因此建议通过
cache_write_tokens和cached_tokens监控缓存断点。
积分消耗
| 上下文档位 | 输入 (Credits/Token) | Cache Write (Credits/Token) | Cache Read (Credits/Token) | 输出 (Credits/Token) | 网页搜索(Credits/次) | 计费说明 |
|---|---|---|---|---|---|---|
| 短上下文 | 2.50 | 3.125 | 0.25 | 15.00 | 10,000 | GPT-5.6 Terra 标准价格 |
| 长上下文(输入 token >272K) | 5.00 | 6.25 | 0.50 | 22.50 | 10,000 | 长上下文价格档位 |
价格说明
文档价格为 B.AI 平台模型标准参考价,仅供基础计费说明使用。B.AI 可能会通过充值赠送及账户权益等方式,为用户提供更低的实际使用成本。具体价格、赠送积分及账户权益请以平台页面展示及最终账单为准。
- GPT-5.6 模型的缓存写入按未缓存输入价格的 1.25x 计费;缓存读取按输入价格的 0.1x 折扣计费。