DeepSeekDSH
独立社区指南与 DeepSeek 无隶属关系。官方源码快照

DeepSeek V4.1 Flash:模型规格、价格与 V4 Pro 服务状态

查看图片与工具支持、百万上下文、峰谷价格和公开性能证据,核对 V4 Pro 继续服务的最新说明。

独立编辑与核验:DeepSeekDSH源码核验:0.1.5-rc.2 · 2026-09-11
本页内容

DeepSeek V4.1 Flash 通过 deepseek-flash 提供服务,支持文本、图片和工具调用。V4 Pro 仍是独立 API 模型;截至 2026 年 9 月 12 日,官方已确认它在 9 月 14 日后继续服务、计费不变。

部署数据面板

DeepSeek V4.1 Flash 规格与费用

查看 API 模型、峰谷价格和评测出处。服务状态于 2026-09-12 核对。

Sep 11, 2026

V4.1 Flash 的 API 接入

V4.1 Flash 使用 deepseek-flash。9 月 12 日官方说明确认 V4 Pro 在 9 月 14 日后继续服务,计费不变。

API 模型名deepseek-flash旧 V4 Flash 别名暂时路由到这里
上下文1MTokens
最大输出384KTokens
V4 Pro 服务继续提供9 月 14 日后计费不变

当前 API 模型与别名

DeepSeek 当前价格页已经把 DeepSeek-V4.1-Flash 列为 Flash 主模型,对外推荐的模型名是 deepseek-flash。旧的 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 仍能请求,但实际会由 V4.1 Flash 提供服务,并按 Flash 价格计费。

旧 Flash 别名仍被接受,但实际提供服务的模型已经改变。依赖固定输出格式或工具调用习惯的应用,应保存模型返回信息并重新执行回归测试。

本节来源:DeepSeek API — Models & Pricing · Reuters — DeepSeek launches V4.1 Flash

DeepSeek V4.1 Flash 当前 API 规格和价格

V4.1 Flash 继续保留 100 万 Token 上下文,最大输出达到 384K,并同时支持思考/非思考模式。它已经支持图片输入、Tool Calls、JSON Output、Responses API 和 Anthropic API 兼容接口。

项目DeepSeek V4.1 Flash
API 模型名deepseek-flash
上下文窗口1M Tokens
最大输出384K Tokens
图片输入支持
高峰输入(缓存未命中)$0.30 / 1M Tokens
高峰输出$1.20 / 1M Tokens
低峰输入(缓存未命中)$0.15 / 1M Tokens
低峰输出$0.60 / 1M Tokens

价格核对于 2026-09-12。高峰为工作日北京时间 09:00–12:00、14:00–18:00,其余时段低峰。

本节来源:DeepSeek API — Models & Pricing

规格信息与性能证据

当前 API 文档可核对模型名称、输入类型、上下文与价格。它不是一张与其他厂商同条件运行的评测表,不能仅凭这些规格判断 V4.1 Flash 在每类编程任务中的成功率。

发布报道可以确认上线时间与产品背景;缺少原始出处和测试设置的跑分截图,不能支持精确排名。引用评测时需要同时保留模型版本、任务集、Harness 和推理设置。

评测引用条件

同一个 Benchmark,只要版本、Harness、推理强度、工具权限或采样参数不同,结果就可能差很多。新模型刚上线时,最容易出现“数字是真的,但比较方式不成立”的问题。

本节来源:DeepSeek API — Models & Pricing · Reuters — DeepSeek launches V4.1 Flash · DeepSeek API — Change Log

V4 Pro 在 9 月 14 日后继续服务

截至 2026 年 9 月 12 日,DeepSeek 官方价格页已明确说明:V4 Pro 在 9 月 14 日后继续提供 API 服务,计费方式保持不变,后续变更另行通知。旧的自动切换计划已不应作为当前接入依据。

已有 V4 Pro 应用不需要仅因旧计划而紧急更换模型。若希望采用 V4.1 Flash 的图片输入或较低单价,可以主动试用,并检查输出格式、工具行为和业务回归结果。

本节来源:DeepSeek API — Models & Pricing · DeepSeek — V4 Pro GA release

代码 Agent 的用量与工具接入

代码 Agent 会多次读取文件、接收命令输出并重新调用模型。V4.1 Flash 的低单价有利于控制累计费用;百万上下文提供容量,但实际仍应优先读取相关文件,减少重复输入。

但模型能力和 Harness 能力不能混在一起看。DeepSeek 过去公布 Code Agent 结果时,经常使用 DeepSeek Harness Minimal Mode,并把 reasoning effort 开到 max。你自己测试 V4.1 Flash 时,最好固定 Preset、推理档位和测试任务,只替换模型,这样才知道提升来自模型还是来自 Agent 框架。

本节来源:DeepSeek API — Models & Pricing · DeepSeek API — Change Log

主动切换模型前的回归检查

新接入 V4.1 Flash 使用 deepseek-flash;旧 Flash 别名仍可请求,但对应的旧模型已经退役。若主动从 V4 Pro 切换,先保存代码修改、工具调用、长上下文和结构化输出任务,再对比结果、耗时与费用。

模型切换可能改变回复长度、输出格式和工具调用顺序。为格式校验与关键业务场景设置回归检查,确认结果后再扩大流量。

  • 固定 DSH Preset 和 reasoning effort,再比较模型。
  • 同时记录成功率、延迟、Token、工具失败次数和人工接管次数。
  • 长上下文任务单独测试,不要用短问答代替。
  • 做成本预算前重新查看 DeepSeek 实时价格页。

本节来源:DeepSeek API — Models & Pricing

继续看模型性能