CodeKitHub
简体中文
AI 工具

LLM API 定价计算器

选择一个模型,输入输入 token 数和输出 token 数,即可看到单次请求的精确成本——如果你大致知道每月请求量,还能看到预估的月成本。下方的对比表会把全部19款模型按相同 token 数下的成本排好序,一眼就能看出 GPT、Claude、Gemini、DeepSeek、通义千问、Kimi、GLM、Grok 里谁最便宜。覆盖 OpenAI、Anthropic、Google、DeepSeek、Qwen(阿里)、Moonshot(Kimi)、Zhipu(GLM)、xAI(Grok)八家厂商的当前主力模型,价格均直接核对自各厂商官方定价页面。全程浏览器本地运行。

价格核实日期:2026年7月25日

AI 厂商的 API 价格经常调整,本工具的数字仅供参考,做预算或采购决策前请以厂商官方定价页面为准。

工具介绍

LLM API 是按 token 计费的,不是按请求次数——而且输入 token(你的 prompt、系统消息、聊天历史)和输出 token(模型生成的内容)价格不同,输出通常比输入贵 4-8 倍。这种价格结构导致"这次调用到底要多少钱"很难靠感觉估算,尤其是要横向对比不同厂商、不同价目表的模型时。

本计算器把你的输入 token 数和输出 token 数分别乘以所选模型对应的每百万 token 单价,再相加——跟厂商计费系统用的是同一套算法。填入每月请求量后还会给出预估月成本,方便你在正式接入某个模型前先做预算。

为什么使用它?

  • 覆盖 OpenAI、Anthropic、Google、DeepSeek、Qwen、Moonshot、Zhipu、xAI 八家共19款模型——含入门、中端、旗舰档位,也包含主流中国大模型 API 和 Grok。
  • 对比表会按你填入的 token 数,把所有模型的成本从低到高排好序,不用自己一个个手算。
  • 输入/输出成本分开显示——因为所有厂商的输出单价都比输入贵好几倍。
  • 可选填每月请求量,直接得到预算级别的月成本预估,不只是单次请求。
  • 价格直接核对自厂商官方文档,并标注核实日期——不是抓取或估算的数字。
  • 100% 本地运行——不需要 API key,不需要账号,数据不会离开你的浏览器。

使用方法

  1. 从下拉菜单选择模型,按厂商分组(OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI)。
  2. 输入输入 token 数(prompt + 系统消息 + 上下文)和预期的输出 token 数。
  3. 查看单次请求成本,分为输入成本和输出成本。
  4. 可选填每月请求数,查看预估月成本。
  5. 往下滚动查看对比表,所有模型按相同 token 数下的成本从低到高排列。

示例

输入

GPT-5.6 Terra,输入 1000 token,输出 500 token

输出

输入成本 $0.0025 + 输出成本 $0.0075 = 单次 $0.01

按每月1万次请求算,大约每月 $100——单次看着不多,规模一上来累加得很快,所以选模型前先算清楚这笔账很重要。

理解输入成本与输出成本的区别

列表里每个模型的输入和输出都是分开计价的,而且各家的差距都很大且规律一致——输出单价通常是输入单价的5-6倍。也就是说,一段啰嗦冗长的模型回复,即便总 token 数看起来跟"长 prompt+短回答"差不多,实际成本也会明显更高。

实际意义:如果你在优化 API 支出,同样是省一个 token,精简输出(比如在系统提示里加一句"用一段话回答")省下来的钱通常比精简输入更多。

按使用场景估算月成本参考

以下是示意性例子,不是报价——请用上面的计算器代入你自己的 token 数和模型选择,得到精确数字。

使用场景典型 token/请求示例模型月成本参考(1万次请求)
简短聊天机器人回复输入300/输出150GPT-5.4 Nano约 $2-3/月
数据打标/分类输入500/输出50DeepSeek V4 Flash约 $1/月
文档摘要输入3000/输出400Claude Sonnet 5约 $100/月
代码生成助手输入1500/输出1000Gemini 3.5 Flash约 $110-115/月
长文写作输入1000/输出2500GPT-5.6 Sol约 $800/月

常见问题

为什么所有模型的输出单价都比输入贵这么多?

生成 token(输出)需要对每个新 token 都完整跑一遍前向计算,而且是逐个串行进行的;而处理输入 token(prompt)可以一次性并行批量处理。这种计算成本的不对称,是所有主流厂商把输出单价定在输入单价的4-8倍左右的根本原因。

我怎么知道自己的 prompt 会用掉多少 token?

可以用 CodeKitHub 的 AI Token 计数器——把实际的 prompt 或系统消息粘贴进去,用真实分词器精确计算 token 数,而不是靠字符数粗略估算。输出 token 数更难提前预测,比较靠谱的做法是先跑几次真实 API 调用,看实际输出用了多少 token,作为估算依据。

这些价格能保证是最新的吗?

不能——AI 厂商的 API 价格调整相当频繁,有时候通知也不多。本工具里的价格是在计算器附近标注的日期,直接对照各厂商官方定价页面核实过的。做预算或采购决策前,请自己去查最新页面:OpenAI 定价(developers.openai.com/api/docs/pricing)、Anthropic/Claude 定价(platform.claude.com/docs/en/about-claude/pricing)、Google Gemini 定价(ai.google.dev/gemini-api/docs/pricing)。

为什么没有我常用的那个模型?

本工具只覆盖 OpenAI、Anthropic、Google、DeepSeek、Qwen、Moonshot、Zhipu、xAI 八家各自入门/中端/旗舰档位的代表性型号(共19款),而不是每家的全部型号,这样列表好扫、价格数据也更容易维护准确。如果你要的模型不在列表里,去厂商页面查它每百万 token 的单价,照本工具的公式(输入成本+输出成本)自己算一遍就行。

Gemini 3.1 Pro Preview 的价格算上超长 prompt 的加价了吗?

没有——显示的是 Google 官方 ≤20万 token 档位的价格。Gemini 对超过这个阈值的 prompt 会涨价,但为了保持工具简单,本计算器没有实现那个附加档位。如果你的 prompt 经常超过20万 token,请去 Google 定价页面查具体的长上下文费率。

DeepSeek、通义千问、Kimi、GLM 的价格是美元吗?

是的——本工具里包括中国厂商在内的所有价格,都是各家官方国际版 API 的美元计价,这样才能跟其他模型放在同一基准上比较。如果你用的是国内人民币计费的控制台,价格可能不同(通常更低),请以你实际使用的控制台价格为准。

相关工具