跳到主要内容

DeepSeek-V4-Flash

B.AI 模型路由说明

B.AI 将逐步把使用 DeepSeek-V4-Flash 和 DeepSeek-V4-Flash-Vision-Exp 模型名称发起的请求路由至 DeepSeek-V4.1-Flash。路由生效后,相关请求将统一按照 DeepSeek-V4.1-Flash 的适用价格计费。

概述​

DeepSeek-V4-Flash 是 DeepSeek 于 2026 年 4 月 24 日与 V4-Pro 同步发布的高效率开源大语言模型,采用 MIT License。该模型总参数量为 284B,但每次前向仅激活 13B 参数,以约为 V4-Pro 三分之一的标准输入和输出价格提供接近旗舰模型的性能,是当前极具性价比的模型之一。

DeepSeek-V4-Flash

DeepSeek-V4-Flash 5 折活动于 2026 年 9 月 3 日 17:00(UTC+8)正式生效。

自生效时间起,符合条件的 DeepSeek-V4-Flash API 使用按对应空闲时段或高峰时段标准价的 50% 结算。活动价格随 DeepSeek 空闲时段与高峰时段同步变化,各时段均保持 5 折。

下方价格表继续展示标准参考价,实际结算价格及最终账单以平台页面展示为准。

核心特性​

  • 超高效率架构:总参数量 284B,每次前向仅激活 13B 参数,模型下载体积约 160GB,相比前沿模型对硬件要求更低,同时保持出色性能。
  • 100 万 Token 上下文窗口:与 V4-Pro 一样支持 100 万上下文和 384K 最大输出,基于相同的 CSA/HCA 混合注意力机制,具备高效的长上下文推理能力。
  • 接近 Pro 的性能与更低成本:在 SWE-bench Verified 上达到 79.0%,仅比 V4-Pro 的 80.6% 低 1.6 个百分点,标准参考输入/输出价格为 0.44 / 1.32 Credits。
  • Flash-Max 推理模式:在提供更大的思考预算(384K+ 上下文)时,V4-Flash-Max 可在复杂任务上逼近 V4-Pro 的推理能力。

适用场景​

  • 高并发 API 场景:标准参考输入价格为每 token 0.44 Credits,适合文本量大、对单次调用成本敏感的应用。
  • 自托管部署:160GB 模型体积和 13B 激活参数使其更适合本地部署或单节点 GPU 场景,不像更大的前沿模型那样依赖重型基础设施。
  • Agent 工具调用链路:强工具调用和编程能力,加上更低延迟,使其非常适合多步 Agent 工作流。

能力与限制​

能力维度说明
推理能力具备接近 Claude Sonnet 4.6 水平的智能表现(Artificial Analysis Index 得分 47)
编程能力SWE-bench Verified 79.0%;编程类基准平均 64.4
多模态能力当前仅支持文本,不支持图像、音频或视频
响应速度13B 激活参数配合高效注意力机制,适合高吞吐场景
上下文窗口1,000,000 tokens
最大输出384,000 tokens
工具调用支持函数调用,具备较强 Agent 任务执行能力
多语言能力广泛支持多语言,其中英文表现最强

已知限制​

  • 当前仅支持文本,不具备多模态能力。
  • 由于参数规模更小,在纯知识型任务和最复杂的 Agent 工作流上仍弱于 V4-Pro 与顶级闭源模型。
  • 若要接近 Pro 级推理效果,可能需要启用 Flash-Max 模式并提供更大思考预算,这会带来更高延迟和成本。

标准价格​

以下 Token 价格均以美元计价,单位为每 100 万 Token;网页搜索按次计费。

计费时段输入
(USD / 1M Tokens)
缓存写入
(USD / 1M Tokens)
缓存读取
(USD / 1M Tokens)
输出
(USD / 1M Tokens)
网页搜索
(USD / 次)
计费说明
空闲时段$0.15$0.15$0.003$0.60-缓存写入:输入价的 1x;缓存读取:输入价的 0.02x
高峰时段$0.30$0.30$0.006$1.20-缓存写入:输入价的 1x;缓存读取:输入价的 0.02x

Credits 结算: B.AI 按照 1 USD = 1,000,000 Credits 换算,并从账户余额中扣除 Credits。

价格说明

上述标准参考价自 2026 年 9 月 10 日 12:00(北京时间,UTC+8)起生效。本表展示 DeepSeek-V4-Flash 的分时标准参考价。空闲时段价格为高峰时段价格的一半。北京时间(UTC+8)周一至周五(不含中国法定节假日)09:00-12:00、14:00-18:00 为高峰时段;其余时段,包括周末及中国法定节假日全天,均为空闲时段。B.AI Chat 中的 DeepSeek-V4-Flash 按空闲时段价格计费。自 2026 年 9 月 3 日 17:00(UTC+8)起,符合条件的 API 使用按调用发生时对应空闲时段或高峰时段标准价的 50% 结算。实际结算价格及最终账单以平台页面展示为准。B.AI 可能会通过充值赠送及账户权益等方式,为用户提供更低的实际使用成本。