GPT-6 Luna
概述
GPT-6 Luna 是 OpenAI 于 2026 年 9 月 22 日发布的 GPT-6 模型,面向聚焦型、高频工作负载。模型 ID 为 gpt-6-luna,结合较低的 Token 价格、可调节推理、图像理解和 1,050,000 Token 上下文窗口。
核心特性
- 低成本高频任务:标准短上下文价格适合评估大规模处理任务。
- 编程能力:OpenAI 报告其在
max推理强度下的 DeepSWE v1.1 得分为 66.6%。 - 工作流效率:面向重复的工具辅助应用工作流,兼顾单次运行成本。
- 可调节推理:支持包括
none在内的六种推理强度,以适应不同复杂度的任务。
适用场景
- 分类与提取:重复标签、路由和结构化信息提取。
- 摘要与改写:批量处理客服记录、内部文档和内容草稿。
- 边界明确的编程辅助:问题分流、测试草拟、小型修复和初步审查。
- 工具辅助日常工作:步骤清晰的重复研究及应用操作流程。
能力与限制
| 能力维度 | 说明 |
|---|---|
| 推理能力 | 支持 none、low、medium(默认)、high、xhigh 和 max。 |
| 多模态能力 | 支持文本和图像输入,输出文本。 |
| 上下文窗口 | 1,050,000 Token。 |
| 最大输出 | 128,000 Token,包含推理所占用的生成 Token 预算。 |
| 工具调用 | Responses API 支持函数、网页与文件搜索、计算机操作、代码解释器、托管 Shell、Apply Patch、MCP、Skills、工具搜索和图像生成。 |
| 结构化输出 | 支持 Structured Outputs 和流式输出。 |
| 知识截止日期 | 2026 年 5 月 18 日。 |
已知限制
- 带推理的工具调用需要使用 Responses API;Chat Completions 仅在
reasoning_effort: "none"时支持函数调用。 - 启用推理时不支持
temperature、top_p和对数概率控制,也不支持微调。 - 输入超过 272K Token 时,整次请求按长上下文价格计费。
标准价格
以下 Token 价格均以美元计价,单位为每 100 万 Token;网页搜索按次计费。
| 上下文档位 | 输入 (USD / 1M Tokens) | 缓存写入 (USD / 1M Tokens) | 缓存读取 (USD / 1M Tokens) | 输出 (USD / 1M Tokens) | 网页搜索 (USD / 次) |
|---|---|---|---|---|---|
| 输入不超过 272K Token | $0.10 | $0.125 | $0.01 | $0.50 | $0.01 |
| 输入超过 272K Token | $0.20 | $0.25 | $0.02 | $0.75 | $0.01 |
Credits 结算: B.AI 按照 1 USD = 1,000,000 Credits 换算,并从账户余额中扣除 Credits。
- 输入超过 272K Token 时,整次请求均采用长上下文价格。
- 缓存写入按输入价格的 1.25 倍计费,缓存读取按输入价格的 0.1 倍计费;缓存有效期为 30 分钟,命中后刷新。
- 联网搜索按每次
10,000 Credits($0.01)计费,不受上下文档位影响。
价格说明
文档价格为 B.AI 平台模型标准参考价,仅供基础计费说明使用。B.AI 可能会通过充值赠送及账户权益等方式,为用户提供更低的实际使用成本。具体价格、赠送积分及账户权益请以平台页面展示及最终账单为准。