Gemini 3.6 Flash
概述
Gemini 3.6 Flash 是 Gemini 3 系列模型,适用于智能体编程、多模态知识工作、空间推理和多步骤工作流。在 B.AI 中使用模型 ID:gemini-3.6-flash。
核心特性
- 智能体工作流: 适合重复推理、工具调用和多步骤任务执行。
- 多模态输入: 支持文本、图片、视频、音频和 PDF 输入,输出为文本。
- 可配置思考: 支持思考等级配置,用于平衡质量、延迟和 token 消耗。
- 长上下文: 最多支持 1,048,576 个输入 token,适用于大型文档集、代码库和长任务历史。
- 工具集成: 在 API 配置启用时,支持函数调用、结构化输出、代码执行、联网检索、URL 上下文和文件搜索工作流。
推荐场景
- 智能体软件工程,包括代码生成、调试、迁移和仓库级修改。
- 多模态知识工作,例如文档分析、图表解读和报告撰写。
- 面向大型代码库、文档集和任务历史的长上下文分析。
- 结合推理、结构化输出和重复执行步骤的工具调用工作流。
能力与限制
| 能力 | 说明 |
|---|---|
| 推理 | 支持可配置的思考等级,适配不同质量、延迟和成本要求。 |
| 编程 | 适用于迭代式编程、调试和多步骤工程工作流。 |
| 多模态 | 支持文本、图片、视频、音频和 PDF 输入,输出为文本。 |
| 上下文窗口 | 最多支持 1,048,576 个输入 token。 |
| 最大输出 | 最多支持 65,536 个输出 token。 |
| 工具调用 | 在可用时支持函数调用、结构化输出、代码执行、联网检索、URL 上下文和文件搜索工作流。 |
| 多语言 | 适用于多语言开发和知识工作任务。 |
已知限制
- 模型可能生成不准确内容;需要最新信息时,请使用联网检索或其他可靠外部数据源。
- 实际延迟和工具可用性会受思考等级、提示词长度、媒体输入和 API 配置影响。
- 输出仅支持文本,不包含原生图片或音频生成能力。
Credits 用量
| 模型 | 输入(Credits/Token) | 缓存写入(Credits/Token) | 缓存读取(Credits/Token) | 输出(Credits/Token) | 网页搜索(Credits/次) | 计费说明 |
|---|---|---|---|---|---|---|
| Gemini 3.6 Flash | 1.50 | 1.50 | 0.15 | 7.50 | 14,000 | - |
价格说明
文档价格为 B.AI 平台模型标准参考价,仅供基础计费说明使用。B.AI 可能会通过充值赠送及账户权益等方式,为用户提供更低的实际使用成本。具体价格、赠送积分及账户权益请以平台页面展示及最终账单为准。