官方价格 + 你的假设

大模型 API 成本计算器与模型路由

估算每月大模型 API 成本,并把缓存、重试、失败、回退流量与被接受工作流明确保留为假设。

价格来源核验于 2026-07-27
估算月成本US$129.64100,000 次请求
每个被接受工作流的成本US$0.0015385,000 个被接受结果(假设)
缓存节省US$65.48相对于相同工作负载但缓存命中率为 0%
路由方案比较-47.1%相对于 GPT-5.6 Luna

估算月成本构成

所选模型路线的价格构成;回退流量已计入各 Token 成本部分。

DeepSeek V4 Pro$0.435/M 输入 · $0.003625/M 缓存 · $0.87/M 输出
官方来源

敏感性分析

每 1,000 个被接受工作流的估算美元成本。点击单元格即可应用对应的接受率和缓存输入比例。

接受率 ↓ / 缓存 →
0%20%40%50%60%70%80%
95%
90%
85%
80%
75%
当前场景:缓存输入 50%,接受率 85%。这些是用户假设,不是 TokenAir 实测数据。

候选模型比较

工作负载与接受率假设保持一致,只改变官方模型价格。

场景模型输入 / 百万输出 / 百万估算月成本被接受的工作流每个被接受结果的成本证据
当前路线
DeepSeek V4 ProDeepSeek
US$0.44US$0.87US$129.6485,000US$0.00153官方文档
候选方案 1
DeepSeek V4 FlashDeepSeek
US$0.14US$0.28US$91.7785,000US$0.00108官方文档
候选方案 2
Gemini 3.5 Flash-LiteGoogle Gemini
US$0.30US$2.50US$152.1485,000US$0.00179官方文档
候选方案 3
Codestral 25.08Mistral AI
US$0.30US$0.90US$120.6085,000US$0.00142官方文档
如何理解结果计算器使用官方公开价格进行真实运算;只有把所有默认值替换为你的实测工作负载数据后,它才可以作为生产预测。

先从自己的日志中测量被接受工作流、重试和可缓存输入,再把导出的场景与实际账单比较。

查看计算方法