工具介绍
LLM API 是按 token 计费的,不是按请求次数——而且输入 token(你的 prompt、系统消息、聊天历史)和输出 token(模型生成的内容)价格不同,输出通常比输入贵 4-8 倍。这种价格结构导致"这次调用到底要多少钱"很难靠感觉估算,尤其是要横向对比不同厂商、不同价目表的模型时。
本计算器把你的输入 token 数和输出 token 数分别乘以所选模型对应的每百万 token 单价,再相加——跟厂商计费系统用的是同一套算法。填入每月请求量后还会给出预估月成本,方便你在正式接入某个模型前先做预算。
为什么使用它?
- 覆盖 OpenAI、Anthropic、Google、DeepSeek、Qwen、Moonshot、Zhipu、xAI 八家共19款模型——含入门、中端、旗舰档位,也包含主流中国大模型 API 和 Grok。
- 对比表会按你填入的 token 数,把所有模型的成本从低到高排好序,不用自己一个个手算。
- 输入/输出成本分开显示——因为所有厂商的输出单价都比输入贵好几倍。
- 可选填每月请求量,直接得到预算级别的月成本预估,不只是单次请求。
- 价格直接核对自厂商官方文档,并标注核实日期——不是抓取或估算的数字。
- 100% 本地运行——不需要 API key,不需要账号,数据不会离开你的浏览器。
使用方法
- 从下拉菜单选择模型,按厂商分组(OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI)。
- 输入输入 token 数(prompt + 系统消息 + 上下文)和预期的输出 token 数。
- 查看单次请求成本,分为输入成本和输出成本。
- 可选填每月请求数,查看预估月成本。
- 往下滚动查看对比表,所有模型按相同 token 数下的成本从低到高排列。
示例
输入
GPT-5.6 Terra,输入 1000 token,输出 500 token输出
输入成本 $0.0025 + 输出成本 $0.0075 = 单次 $0.01按每月1万次请求算,大约每月 $100——单次看着不多,规模一上来累加得很快,所以选模型前先算清楚这笔账很重要。
理解输入成本与输出成本的区别
列表里每个模型的输入和输出都是分开计价的,而且各家的差距都很大且规律一致——输出单价通常是输入单价的5-6倍。也就是说,一段啰嗦冗长的模型回复,即便总 token 数看起来跟"长 prompt+短回答"差不多,实际成本也会明显更高。
实际意义:如果你在优化 API 支出,同样是省一个 token,精简输出(比如在系统提示里加一句"用一段话回答")省下来的钱通常比精简输入更多。
按使用场景估算月成本参考
以下是示意性例子,不是报价——请用上面的计算器代入你自己的 token 数和模型选择,得到精确数字。
| 使用场景 | 典型 token/请求 | 示例模型 | 月成本参考(1万次请求) |
|---|---|---|---|
| 简短聊天机器人回复 | 输入300/输出150 | GPT-5.4 Nano | 约 $2-3/月 |
| 数据打标/分类 | 输入500/输出50 | DeepSeek V4 Flash | 约 $1/月 |
| 文档摘要 | 输入3000/输出400 | Claude Sonnet 5 | 约 $100/月 |
| 代码生成助手 | 输入1500/输出1000 | Gemini 3.5 Flash | 约 $110-115/月 |
| 长文写作 | 输入1000/输出2500 | GPT-5.6 Sol | 约 $800/月 |
常见问题
为什么所有模型的输出单价都比输入贵这么多?
生成 token(输出)需要对每个新 token 都完整跑一遍前向计算,而且是逐个串行进行的;而处理输入 token(prompt)可以一次性并行批量处理。这种计算成本的不对称,是所有主流厂商把输出单价定在输入单价的4-8倍左右的根本原因。
我怎么知道自己的 prompt 会用掉多少 token?
可以用 CodeKitHub 的 AI Token 计数器——把实际的 prompt 或系统消息粘贴进去,用真实分词器精确计算 token 数,而不是靠字符数粗略估算。输出 token 数更难提前预测,比较靠谱的做法是先跑几次真实 API 调用,看实际输出用了多少 token,作为估算依据。
这些价格能保证是最新的吗?
不能——AI 厂商的 API 价格调整相当频繁,有时候通知也不多。本工具里的价格是在计算器附近标注的日期,直接对照各厂商官方定价页面核实过的。做预算或采购决策前,请自己去查最新页面:OpenAI 定价(developers.openai.com/api/docs/pricing)、Anthropic/Claude 定价(platform.claude.com/docs/en/about-claude/pricing)、Google Gemini 定价(ai.google.dev/gemini-api/docs/pricing)。
为什么没有我常用的那个模型?
本工具只覆盖 OpenAI、Anthropic、Google、DeepSeek、Qwen、Moonshot、Zhipu、xAI 八家各自入门/中端/旗舰档位的代表性型号(共19款),而不是每家的全部型号,这样列表好扫、价格数据也更容易维护准确。如果你要的模型不在列表里,去厂商页面查它每百万 token 的单价,照本工具的公式(输入成本+输出成本)自己算一遍就行。
Gemini 3.1 Pro Preview 的价格算上超长 prompt 的加价了吗?
没有——显示的是 Google 官方 ≤20万 token 档位的价格。Gemini 对超过这个阈值的 prompt 会涨价,但为了保持工具简单,本计算器没有实现那个附加档位。如果你的 prompt 经常超过20万 token,请去 Google 定价页面查具体的长上下文费率。
DeepSeek、通义千问、Kimi、GLM 的价格是美元吗?
是的——本工具里包括中国厂商在内的所有价格,都是各家官方国际版 API 的美元计价,这样才能跟其他模型放在同一基准上比较。如果你用的是国内人民币计费的控制台,价格可能不同(通常更低),请以你实际使用的控制台价格为准。