官方价格 + 你的假设
大模型 API 成本计算器与模型路由
估算每月大模型 API 成本,并把缓存、重试、失败、回退流量与被接受工作流明确保留为假设。
价格来源核验于 2026-07-27
估算月成本构成
所选模型路线的价格构成;回退流量已计入各 Token 成本部分。
DeepSeek V4 Pro$0.435/M 输入 · $0.003625/M 缓存 · $0.87/M 输出
官方来源 敏感性分析
每 1,000 个被接受工作流的估算美元成本。点击单元格即可应用对应的接受率和缓存输入比例。
接受率 ↓ / 缓存 →
0%20%40%50%60%70%80%95%
90%
85%
80%
75%
当前场景:缓存输入 50%,接受率 85%。这些是用户假设,不是 TokenAir 实测数据。
候选模型比较
工作负载与接受率假设保持一致,只改变官方模型价格。
| 场景 | 模型 | 输入 / 百万 | 输出 / 百万 | 估算月成本 | 被接受的工作流 | 每个被接受结果的成本 | 证据 |
|---|---|---|---|---|---|---|---|
| 当前路线 | DeepSeek V4 ProDeepSeek | US$0.44 | US$0.87 | US$129.64 | 85,000 | US$0.00153 | 官方文档 |
| 候选方案 1 | DeepSeek V4 FlashDeepSeek | US$0.14 | US$0.28 | US$91.77 | 85,000 | US$0.00108 | 官方文档 |
| 候选方案 2 | Gemini 3.5 Flash-LiteGoogle Gemini | US$0.30 | US$2.50 | US$152.14 | 85,000 | US$0.00179 | 官方文档 |
| 候选方案 3 | Codestral 25.08Mistral AI | US$0.30 | US$0.90 | US$120.60 | 85,000 | US$0.00142 | 官方文档 |
如何理解结果计算器使用官方公开价格进行真实运算;只有把所有默认值替换为你的实测工作负载数据后,它才可以作为生产预测。
查看计算方法 先从自己的日志中测量被接受工作流、重试和可缓存输入,再把导出的场景与实际账单比较。