全部工具工具

Token 成本计算器

免费、即时、无需注册。设置每次请求的输入/输出/缓存 token 与每月请求量,即可算出 22 个 Claude、GPT、Gemini 模型的单次与每月 API 成本,并与各家官方价并排对比。价格实时取自目录。

Your workload

Quick presets

Rate: $1.20 in / $6.00 out · cache hit $0.1200 · cache write $1.20 — all per 1M tokens, read live from the Kunavo catalog.

Estimated cost

Per request$0.00300
Per month (Kunavo)$300
Per month at Anthropic list$750

You save vs Anthropic list

$450/ month · ~60%

Estimate only. Reasoning models bill hidden reasoning tokens at the output rate, so a reasoning workload costs more than the output box suggests. Cache writes are billed separately at $1.20 per 1M and are not in this figure — they are a one-off per cache entry, not per request. Failed requests are never billed.

延伸阅读

每个模型家族的定价指南

FAQ

LLM token 成本怎么算?

LLM API 按每百万 token 计价,输入与输出分别定价,所以单次请求成本 =(输入 token ÷ 1,000,000 × 输入单价)+(输出 token ÷ 1,000,000 × 输出单价)。输出单价通常是输入的数倍,因此「短提示 + 长回答」可能比「长提示 + 短回答」更贵。每月成本是单次成本乘以请求量,缓存命中的那部分输入还要按更低的缓存单价单独计算。

这个计算器会帮我数 token 吗?

不会——它只对你给出的 token 数量计价,不做分词。请填写每次请求的输入、输出与缓存 token 数,它返回单次与每月成本。真实 token 数应当从 API 响应里已经返回的 usage 字段读取,而不是用字符数估算:字符数与 token 的比例随语言和分词器变化很大。

这个 token 成本计算器免费吗?

免费。计算器完全在浏览器里运行,不需要注册,也不需要 API key。价格实时读取自 Kunavo 的模型目录,并且每个模型都并排显示各自厂商的官方牌价,因此对比结果可以到厂商定价页去核对。

哪个模型对我的场景最便宜?

取决于输入与输出的比例,这也正是要实际对比而不是凭印象的原因。长上下文、短回答的场景由输入单价主导;长文本生成的场景由输出单价主导,而各档之间输出价的差距最大。把你自己的 token 数填进去看每月那一列——摘要任务里最便宜的模型,往往不是对话任务里最便宜的那个。

为什么实际账单比计算器算的高?

单次估算漏掉三件事。推理型模型的思考 token 按输出价计费,但不会出现在返回内容里;缓存写入按每个缓存条目单独计费,不在单次请求的数字里;失败重试也计费——消耗了 token 的请求即使最终失败也照算。Agent 类工具的差距最大,因为用户看到的一个任务背后是多轮计费请求。