DeepSeek V4.1 Flash:模型规格、价格与 V4 Pro 服务状态
查看图片与工具支持、百万上下文、峰谷价格和公开性能证据,核对 V4 Pro 继续服务的最新说明。
本页内容
DeepSeek V4.1 Flash 通过 deepseek-flash 提供服务,支持文本、图片和工具调用。V4 Pro 仍是独立 API 模型;截至 2026 年 9 月 12 日,官方已确认它在 9 月 14 日后继续服务、计费不变。
当前 API 模型与别名
DeepSeek 当前价格页已经把 DeepSeek-V4.1-Flash 列为 Flash 主模型,对外推荐的模型名是 deepseek-flash。旧的 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 仍能请求,但实际会由 V4.1 Flash 提供服务,并按 Flash 价格计费。
旧 Flash 别名仍被接受,但实际提供服务的模型已经改变。依赖固定输出格式或工具调用习惯的应用,应保存模型返回信息并重新执行回归测试。
本节来源:DeepSeek API — Models & Pricing · Reuters — DeepSeek launches V4.1 Flash
DeepSeek V4.1 Flash 当前 API 规格和价格
V4.1 Flash 继续保留 100 万 Token 上下文,最大输出达到 384K,并同时支持思考/非思考模式。它已经支持图片输入、Tool Calls、JSON Output、Responses API 和 Anthropic API 兼容接口。
| 项目 | DeepSeek V4.1 Flash |
|---|---|
| API 模型名 | deepseek-flash |
| 上下文窗口 | 1M Tokens |
| 最大输出 | 384K Tokens |
| 图片输入 | 支持 |
| 高峰输入(缓存未命中) | $0.30 / 1M Tokens |
| 高峰输出 | $1.20 / 1M Tokens |
| 低峰输入(缓存未命中) | $0.15 / 1M Tokens |
| 低峰输出 | $0.60 / 1M Tokens |
价格核对于 2026-09-12。高峰为工作日北京时间 09:00–12:00、14:00–18:00,其余时段低峰。
规格信息与性能证据
当前 API 文档可核对模型名称、输入类型、上下文与价格。它不是一张与其他厂商同条件运行的评测表,不能仅凭这些规格判断 V4.1 Flash 在每类编程任务中的成功率。
发布报道可以确认上线时间与产品背景;缺少原始出处和测试设置的跑分截图,不能支持精确排名。引用评测时需要同时保留模型版本、任务集、Harness 和推理设置。
同一个 Benchmark,只要版本、Harness、推理强度、工具权限或采样参数不同,结果就可能差很多。新模型刚上线时,最容易出现“数字是真的,但比较方式不成立”的问题。
本节来源:DeepSeek API — Models & Pricing · Reuters — DeepSeek launches V4.1 Flash · DeepSeek API — Change Log
V4 Pro 在 9 月 14 日后继续服务
截至 2026 年 9 月 12 日,DeepSeek 官方价格页已明确说明:V4 Pro 在 9 月 14 日后继续提供 API 服务,计费方式保持不变,后续变更另行通知。旧的自动切换计划已不应作为当前接入依据。
已有 V4 Pro 应用不需要仅因旧计划而紧急更换模型。若希望采用 V4.1 Flash 的图片输入或较低单价,可以主动试用,并检查输出格式、工具行为和业务回归结果。
本节来源:DeepSeek API — Models & Pricing · DeepSeek — V4 Pro GA release
代码 Agent 的用量与工具接入
代码 Agent 会多次读取文件、接收命令输出并重新调用模型。V4.1 Flash 的低单价有利于控制累计费用;百万上下文提供容量,但实际仍应优先读取相关文件,减少重复输入。
但模型能力和 Harness 能力不能混在一起看。DeepSeek 过去公布 Code Agent 结果时,经常使用 DeepSeek Harness Minimal Mode,并把 reasoning effort 开到 max。你自己测试 V4.1 Flash 时,最好固定 Preset、推理档位和测试任务,只替换模型,这样才知道提升来自模型还是来自 Agent 框架。
本节来源:DeepSeek API — Models & Pricing · DeepSeek API — Change Log
主动切换模型前的回归检查
新接入 V4.1 Flash 使用 deepseek-flash;旧 Flash 别名仍可请求,但对应的旧模型已经退役。若主动从 V4 Pro 切换,先保存代码修改、工具调用、长上下文和结构化输出任务,再对比结果、耗时与费用。
模型切换可能改变回复长度、输出格式和工具调用顺序。为格式校验与关键业务场景设置回归检查,确认结果后再扩大流量。
- 固定 DSH Preset 和 reasoning effort,再比较模型。
- 同时记录成功率、延迟、Token、工具失败次数和人工接管次数。
- 长上下文任务单独测试,不要用短问答代替。
- 做成本预算前重新查看 DeepSeek 实时价格页。
DeepSeek API — Models & Pricing · Reuters — DeepSeek launches V4.1 Flash · DeepSeek API — Change Log · DeepSeek — V4 Pro GA release