DeepSeekDSH
独立社区指南与 DeepSeek 无隶属关系。官方源码快照

2026 Coding AI API 成本对比:Token 单价、示例账单与重试费用

比较四个模型的 API 价格,并计算 1000 万输入、200 万输出的账单,说明缓存、长输入与人工验收如何影响总成本。

独立编辑与核验:DeepSeekDSH源码核验:0.1.5-rc.2 · 2026-09-11
本页内容

这四个模型中,DeepSeek V4.1 Flash 的未缓存 Token 单价最低,Gemini 3.8 Flash 次之,GPT-6 Astra 与 Claude Fable 5.1 的标准单价相同。编程 Agent 一次任务通常有多轮调用,预算需要累计所有输入输出,而不是只计算最初的需求和最终回答。

四个模型的公开单价

模型与计费档位输入 / 百万 Tokens输出 / 百万 Tokens
DeepSeek V4.1 Flash 高峰 / 低峰$0.30 / $0.15$1.20 / $0.60
Gemini 3.8 Flash 首发 / 常规$0.75 / $1.50$3.75 / $7.50
GPT-6 Astra 标准$10$50
Claude Fable 5.1 标准$10$50

美元价格,核对日期 2026-09-12。输入列为未缓存价格;不含缓存写入、工具服务、地区或特殊处理档位。

本节来源:DeepSeek API Models & Pricing · Google DeepMind Gemini 3.8 Flash model card · OpenAI API GPT-6 Astra model · Anthropic Claude Fable 5.1

1000 万输入、200 万输出的示例账单

假设一批调用累计产生 1000 万未缓存输入和 200 万输出,计算方式为 10 × 输入单价 + 2 × 输出单价。Astra 的每次请求均假设不超过 272K 输入;这不是将 1000 万 Tokens 放进一次请求。

模型与档位计算Token 费用
DeepSeek 高峰10 × 0.30 + 2 × 1.20$5.40
DeepSeek 低峰10 × 0.15 + 2 × 0.60$2.70
Gemini 首发10 × 0.75 + 2 × 3.75$15.00
Gemini 常规10 × 1.50 + 2 × 7.50$30.00
Astra / Fable 标准10 × 10 + 2 × 50$200.00

固定用量的计算示例,不是任务实测。不同模型完成相同任务,轮数和输出长度可能不同。

交互式成本计算器

四模型 Coding API 账单测算

调整 Token 用量和重试次数,查看 DeepSeek、Gemini、Astra、Fable 的原始单价如何叠加。

美元 · 2026-09-12 快照
DeepSeek 价格时段
Gemini 价格阶段
DeepSeek V4.1 Flash低峰价格$2.70
$0.15/M 输入 · $0.6/M 输出 · $0.003/M 缓存读取
Gemini 3.8 Flash2026 首发优惠价$15.00
$0.75/M 输入 · $3.75/M 输出 · $0.075/M 缓存读取
GPT-6 Astra标准 API 价格$200.00
$10/M 输入 · $50/M 输出 · $1/M 缓存读取
Claude Fable 5.1标准 API 价格$200.00
$10/M 输入 · $50/M 输出 · $0.25/M 缓存读取
估算公式(输入 MTok × 输入单价 + 输出 MTok × 输出单价)× 尝试次数

本基线把全部输入视为未命中缓存。缓存命中、工具调用费、供应商的长上下文规则、Batch/Flex 折扣和人工 Review 时间,都可能明显改变最终的成功任务成本。

会改变账单的计费条件

DeepSeek 高峰为工作日北京时间 09:00–12:00、14:00–18:00,其余时段为低峰。可以延期的批处理能利用低峰价,但交付时间优先的任务不适合单纯为折扣等待。

Astra 单次输入超过 272K 时,整次请求的输入与缓存费率提高到 2 倍,输出提高到 1.5 倍。因此百万上下文可用,并不代表所有输入长度都按表中基础费率计费。

缓存读取也要单列:DeepSeek 高峰 / 低峰为每百万 $0.006 / $0.003,Astra 标准 $1,Fable $0.25。只有确实命中缓存的用量才使用读取价,首次输入和缓存写入不能省略。Gemini 首发价则不应当作永久预算。

本节来源:DeepSeek API Models & Pricing · OpenAI API GPT-6 Astra model · Anthropic Claude Fable 5.1 · Google DeepMind Gemini 3.8 Flash model card

每个已验收任务的成本

Cost per Accepted Task 可以按以下方式计算:所有尝试的模型费用,加工具费用与人工检查、修复成本,再除以已验收任务数。未完成任务花掉的费用也进入分子;全部失败时,这个指标没有可用的除数,应直接报告花费和零验收。

人工时间先折算为金额,再与 API 费用相加。模型费用若已包含所有重试,就不要再重复加一项“重试费”。

  • 日志记录 model_cost、tool_cost、attempts、wall_time、review_minutes、accepted。
  • 按任务类型分别统计,避免大量简单任务掩盖少量复杂任务的高成本。
计算示例,非实测

假设 100 个任务全部尝试共花模型费 $40、工具费 $10,人工检查 2 小时按 $30/小时折算,最终 80 个通过验收,则平均费用为 ($40 + $10 + $60) ÷ 80 = $1.375/个。

先减少重复工作,再调整模型

如果账单主要来自重复读取,应先缩小文件范围、复用可缓存上下文、减少无关工具输出。如果主要来自失败重试,应检查需求、环境和任务拆分,而不是直接增加尝试次数。

批量文本与代码任务可先评估 DeepSeek;原生音视频输入可先评估 Gemini。对未解决的问题,再比较 Astra、Fable 或人工接手的费用和效果。双模型流程会增加交接与维护成本,任务少时未必值得。

继续阅读