GPT-6.1 Sol
概述
GPT-6.1 Sol 是 OpenAI 于 2026 年 9 月 29 日发布的 GPT-6 系列推理模型,面向复杂软件工程、计算机操作和专业工作。在 B.AI 上使用的模型 ID 为 gpt-6.1-sol。OpenAI 将其定位为 GPT-6 Astra 的低成本替代选择,在相关工作负载中提供相近能力,并结合可配置推理与 1.05M Token 上下文窗口。
核心特性
- 复杂软件工程:OpenAI 的 DeepSWE v1.1 评测显示,该模型以更低的推理强度和成本超过 GPT-6 Sol 的最佳成绩 6.4 个百分点。
- 专业工作流自动化:在测试多步骤业务工作流的 AutomationBench 1.0.6 上,该模型使用
medium推理强度时比 GPT-6 Sol 提高 4.8 个百分点。 - 视觉计算机操作:在 OSWorld 2.0 离线 v2026.08.08 数据集上,该模型使用最高推理强度时的部分奖励比 GPT-6 Sol 高 7 个百分点。
- 可调节推理:五档推理强度可平衡推理深度、延迟和 Token 消耗,不支持关闭推理。
- 可复用工作上下文:支持隐式和显式提示词缓存,可复用重复指令、参考资料及对话历史;缓存读取价格为对应未缓存输入价格的 5%。
- 并行 Agent 工作:Responses API Multi-agent Beta 功能可将独立子任务分派给多个 Agent 并汇总结果,适用于代码库探索和多视角审查等任务。
适用场景
- 软件维护与交付:需要反复检查、执行和修改的多文件实现、调试与代码审查。
- 专业交付物:结合适当的文档和执行工具,将源文档与数据整理为报告、演示文稿或网站。
- 浏览器与桌面工作流:通过计算机操作工具理解截图、浏览界面并连续执行多项操作。
- 长文档分析:比较大量参考资料或技术规范,在后续请求中保留大量源上下文并复用稳定内容。
能力与限制
| 能力维度 | 说明 |
|---|---|
| 推理能力 | 支持 low、medium(默认)、high、xhigh 和 max;不支持 none 和 minimal。 |
| 多模态能力 | 支持文本和图像输入,输出文本。 |
| 上下文窗口 | 1,050,000 Token,由输入和生成 Token 共享。 |
| 最大输出 | 128,000 Token,生成 Token 预算包含推理内容和可见输出。 |
| 工具调用 | Responses API 支持函数、网页与文件搜索、计算机操作、托管 Shell、代码解释器、Apply Patch、MCP、Skills、工具搜索和图像生成。 |
| 结构化输出 | 支持 Structured Outputs 和流式输出。 |
| Agent 协作 | Multi-agent 委派处于 Beta 阶段;GPT-6 工作流还支持异步工具调用,以及通过 Responses API WebSocket 连接进行回合中引导。 |
| 知识截止日期 | 2026 年 4 月 30 日。 |
已知限制
- 工具调用需要使用 Responses API;Chat Completions 仅支持不带工具的请求。
- 推理设置下不支持
temperature、top_p和对数概率控制,也不支持微调。 - 推理会占用上下文和输出容量,并可能增加延迟与成本。输出容量不足时,可能在生成可见答案前产生不完整响应。
- Multi-agent Beta 不支持
/responses/compact、reasoning.summary或max_tool_calls,每个 Agent 会单独使用自动压缩。 - 实际性能取决于具体工作负载;对于难度最高的科学研究任务,OpenAI 仍建议使用 Astra。
标准价格
以下 Token 价格均以美元计价,单位为每 100 万 Token;联网搜索按次计费。
| 上下文档位 | 输入 (USD / 1M Tokens) | 缓存写入 (USD / 1M Tokens) | 缓存读取 (USD / 1M Tokens) | 输出 (USD / 1M Tokens) | 联网搜索 (USD / 次) |
|---|---|---|---|---|---|
| 输入不超过 272K Token | $2.00 | $2.50 | $0.10 | $10.00 | $0.01 |
| 输入超过 272K Token | $4.00 | $5.00 | $0.20 | $15.00 | $0.01 |
Credits 结算: B.AI 按照 1 USD = 1,000,000 Credits 换算,并从账户余额中扣除 Credits。
- 输入超过 272K Token 时,整次请求均采用长上下文价格;输出计费包含推理 Token。
- 缓存写入按输入价格的 1.25 倍计费,并替代相应 Token 的普通输入费用,不会在输入费用之外额外收取;缓存读取按输入价格的 0.05 倍计费。最低可缓存前缀为 1,024 个可见输入 Token。缓存有效期为 30 分钟,命中后刷新且不再收取写入费用。
- 联网搜索按每次
10,000 Credits($0.01)计费,不受上下文档位影响。
价格说明
文档价格为 B.AI 平台模型标准参考价,仅供基础计费说明使用。B.AI 可能会通过充值赠送及账户权益等方式,为用户提供更低的实际使用成本。具体价格、赠送积分及账户权益请以平台页面展示及最终账单为准。