跳到主要内容

GPT-6.1 Sol

概述​

GPT-6.1 Sol 是 OpenAI 于 2026 年 9 月 29 日发布的 GPT-6 系列推理模型,面向复杂软件工程、计算机操作和专业工作。在 B.AI 上使用的模型 ID 为 gpt-6.1-sol。OpenAI 将其定位为 GPT-6 Astra 的低成本替代选择,在相关工作负载中提供相近能力,并结合可配置推理与 1.05M Token 上下文窗口。

核心特性​

  • 复杂软件工程:OpenAI 的 DeepSWE v1.1 评测显示,该模型以更低的推理强度和成本超过 GPT-6 Sol 的最佳成绩 6.4 个百分点。
  • 专业工作流自动化:在测试多步骤业务工作流的 AutomationBench 1.0.6 上,该模型使用 medium 推理强度时比 GPT-6 Sol 提高 4.8 个百分点。
  • 视觉计算机操作:在 OSWorld 2.0 离线 v2026.08.08 数据集上,该模型使用最高推理强度时的部分奖励比 GPT-6 Sol 高 7 个百分点。
  • 可调节推理:五档推理强度可平衡推理深度、延迟和 Token 消耗,不支持关闭推理。
  • 可复用工作上下文:支持隐式和显式提示词缓存,可复用重复指令、参考资料及对话历史;缓存读取价格为对应未缓存输入价格的 5%。
  • 并行 Agent 工作:Responses API Multi-agent Beta 功能可将独立子任务分派给多个 Agent 并汇总结果,适用于代码库探索和多视角审查等任务。

适用场景​

  • 软件维护与交付:需要反复检查、执行和修改的多文件实现、调试与代码审查。
  • 专业交付物:结合适当的文档和执行工具,将源文档与数据整理为报告、演示文稿或网站。
  • 浏览器与桌面工作流:通过计算机操作工具理解截图、浏览界面并连续执行多项操作。
  • 长文档分析:比较大量参考资料或技术规范,在后续请求中保留大量源上下文并复用稳定内容。

能力与限制​

能力维度说明
推理能力支持 low、medium(默认)、high、xhigh 和 max;不支持 none 和 minimal。
多模态能力支持文本和图像输入,输出文本。
上下文窗口1,050,000 Token,由输入和生成 Token 共享。
最大输出128,000 Token,生成 Token 预算包含推理内容和可见输出。
工具调用Responses API 支持函数、网页与文件搜索、计算机操作、托管 Shell、代码解释器、Apply Patch、MCP、Skills、工具搜索和图像生成。
结构化输出支持 Structured Outputs 和流式输出。
Agent 协作Multi-agent 委派处于 Beta 阶段;GPT-6 工作流还支持异步工具调用,以及通过 Responses API WebSocket 连接进行回合中引导。
知识截止日期2026 年 4 月 30 日。

已知限制​

  • 工具调用需要使用 Responses API;Chat Completions 仅支持不带工具的请求。
  • 推理设置下不支持 temperature、top_p 和对数概率控制,也不支持微调。
  • 推理会占用上下文和输出容量,并可能增加延迟与成本。输出容量不足时,可能在生成可见答案前产生不完整响应。
  • Multi-agent Beta 不支持 /responses/compact、reasoning.summary 或 max_tool_calls,每个 Agent 会单独使用自动压缩。
  • 实际性能取决于具体工作负载;对于难度最高的科学研究任务,OpenAI 仍建议使用 Astra。

标准价格​

以下 Token 价格均以美元计价,单位为每 100 万 Token;联网搜索按次计费。

上下文档位输入
(USD / 1M Tokens)
缓存写入
(USD / 1M Tokens)
缓存读取
(USD / 1M Tokens)
输出
(USD / 1M Tokens)
联网搜索
(USD / 次)
输入不超过 272K Token$2.00$2.50$0.10$10.00$0.01
输入超过 272K Token$4.00$5.00$0.20$15.00$0.01

Credits 结算: B.AI 按照 1 USD = 1,000,000 Credits 换算,并从账户余额中扣除 Credits。

  • 输入超过 272K Token 时,整次请求均采用长上下文价格;输出计费包含推理 Token。
  • 缓存写入按输入价格的 1.25 倍计费,并替代相应 Token 的普通输入费用,不会在输入费用之外额外收取;缓存读取按输入价格的 0.05 倍计费。最低可缓存前缀为 1,024 个可见输入 Token。缓存有效期为 30 分钟,命中后刷新且不再收取写入费用。
  • 联网搜索按每次 10,000 Credits($0.01)计费,不受上下文档位影响。
价格说明

文档价格为 B.AI 平台模型标准参考价,仅供基础计费说明使用。B.AI 可能会通过充值赠送及账户权益等方式,为用户提供更低的实际使用成本。具体价格、赠送积分及账户权益请以平台页面展示及最终账单为准。