Token 成本计算器
免费、即时、无需注册。设置每次请求的输入/输出/缓存 token 与每月请求量,即可算出 22 个 Claude、GPT、Gemini 模型的单次与每月 API 成本,并与各家官方价并排对比。价格实时取自目录。
Your workload
Rate: $1.20 in / $6.00 out · cache hit $0.1200 · cache write $1.20 — all per 1M tokens, read live from the Kunavo catalog.
Estimated cost
You save vs Anthropic list
$450/ month · ~60%
Estimate only. Reasoning models bill hidden reasoning tokens at the output rate, so a reasoning workload costs more than the output box suggests. Cache writes are billed separately at $1.20 per 1M and are not in this figure — they are a one-off per cache entry, not per request. Failed requests are never billed.
每个模型家族的定价指南
缓存命中按输入价的十分之一计
缓存输入与推理 token
Haiku / Sonnet / Opus 单价
Flash / Pro 单价与免费额度
GPT-5.4 / 5.5 / Mini 单价
一个 API 调用所有模型
按张计价
全部模型,对比官方价
LLM token 成本怎么算?
LLM API 按每百万 token 计价,输入与输出分别定价,所以单次请求成本 =(输入 token ÷ 1,000,000 × 输入单价)+(输出 token ÷ 1,000,000 × 输出单价)。输出单价通常是输入的数倍,因此「短提示 + 长回答」可能比「长提示 + 短回答」更贵。每月成本是单次成本乘以请求量,缓存命中的那部分输入还要按更低的缓存单价单独计算。
这个计算器会帮我数 token 吗?
不会——它只对你给出的 token 数量计价,不做分词。请填写每次请求的输入、输出与缓存 token 数,它返回单次与每月成本。真实 token 数应当从 API 响应里已经返回的 usage 字段读取,而不是用字符数估算:字符数与 token 的比例随语言和分词器变化很大。
这个 token 成本计算器免费吗?
免费。计算器完全在浏览器里运行,不需要注册,也不需要 API key。价格实时读取自 Kunavo 的模型目录,并且每个模型都并排显示各自厂商的官方牌价,因此对比结果可以到厂商定价页去核对。
哪个模型对我的场景最便宜?
取决于输入与输出的比例,这也正是要实际对比而不是凭印象的原因。长上下文、短回答的场景由输入单价主导;长文本生成的场景由输出单价主导,而各档之间输出价的差距最大。把你自己的 token 数填进去看每月那一列——摘要任务里最便宜的模型,往往不是对话任务里最便宜的那个。
为什么实际账单比计算器算的高?
单次估算漏掉三件事。推理型模型的思考 token 按输出价计费,但不会出现在返回内容里;缓存写入按每个缓存条目单独计费,不在单次请求的数字里;失败重试也计费——消耗了 token 的请求即使最终失败也照算。Agent 类工具的差距最大,因为用户看到的一个任务背后是多轮计费请求。