このツールとは?
LLM の API はリクエスト単位ではなくトークン単位で課金されます。しかも入力トークン(プロンプト、システムメッセージ、会話履歴)と出力トークン(モデルが生成する内容)では価格が異なり、通常は出力の方が4〜8倍高く設定されています。この分かれた料金体系のせいで「結局いくらかかるのか」を目算するのは難しく、特に異なる料金表を持つベンダー間でモデルを比較する場合は余計に厄介です。
この計算ツールは入力・出力それぞれのトークン数を、選んだモデルの100万トークンあたりの単価に掛け合わせて合計します——これはベンダーの課金システムが行っている計算と同じです。月間リクエスト数を入力すれば月間の合計コストも予測でき、本番環境でモデルを採用する前の予算検討に役立ちます。
なぜこれを使うのか?
- OpenAI・Anthropic・Google・DeepSeek・Qwen・Moonshot・Zhipu・xAI の19モデルに対応——各社のエントリー・ミドル・フラッグシップ級に加え、主要な中国製モデルAPIとGrokもカバー。
- 比較表は入力したトークン数でのコストが安い順にすべてのモデルを並べるので、1つずつ手計算する必要はありません。
- 入力・出力コストを分けて表示——どのベンダーでも出力トークンは入力より数倍高いため。
- 月間リクエスト数を任意入力すれば、単発の見積もりだけでなく予算レベルの月間コスト予測も可能。
- 価格はベンダーの公式ドキュメントで直接確認し、確認日を明示——スクレイピングや推測ではありません。
- 100%ローカル処理——API キー不要、アカウント不要、データはブラウザの外に出ません。
使い方
- ドロップダウンからモデルを選択(OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI のベンダー別にグループ化)。
- 入力トークン数(プロンプト+システムメッセージ+コンテキスト)と想定される出力トークン数を入力。
- 1リクエストあたりのコストを、入力コストと出力コストに分けて確認。
- 任意で月間リクエスト数を入力すると、月間の見積もりコストが表示されます。
- 下にスクロールすると比較表が表示され、同じトークン数での全モデルのコストが安い順に並びます。
例
入力
GPT-5.6 Terra、入力1,000トークン、出力500トークン出力
入力コスト $0.0025 + 出力コスト $0.0075 = 1リクエストあたり $0.01月10,000リクエストなら約$100/月——1リクエストあたりは小さくても、規模が増えると急速に積み上がるため、モデル選定前にきちんと計算しておくことが大切です。
入力コストと出力コストの違いを理解する
このリストのすべてのモデルは入力トークンと出力トークンを別々に価格設定しており、その差はベンダー間で一貫して大きく——出力は1トークンあたり入力の5〜6倍のコストがかかるのが一般的です。つまり、合計トークン数が似ているように見えても、長々とした冗長な回答は、長いプロンプト+短い回答に比べて不釣り合いに高くつくということです。
実務上の意味:APIコストを最適化するなら、同じ1トークンを削るとしても、入力を削るより出力を短くする方が(システムプロンプトに「1段落で回答」などの短い指示を加えるなど)通常はより多く節約できます。
利用パターン別のおおよその月間コスト
以下はあくまで例示であり、見積もりではありません——正確な数値を知りたい場合は、上の計算ツールに実際のトークン数と選んだモデルを入力してください。
| 利用パターン | 1リクエストあたりの目安トークン数 | モデル例 | 月間コスト目安(1万リクエスト) |
|---|---|---|---|
| 短いチャットボットの返答 | 入力300/出力150 | GPT-5.4 Nano | 約 $2〜3/月 |
| データのラベル付け・分類 | 入力500/出力50 | DeepSeek V4 Flash | 約 $1/月 |
| 文書の要約 | 入力3,000/出力400 | Claude Sonnet 5 | 約 $100/月 |
| コード生成アシスタント | 入力1,500/出力1,000 | Gemini 3.5 Flash | 約 $110〜115/月 |
| 長文コンテンツの執筆 | 入力1,000/出力2,500 | GPT-5.6 Sol | 約 $800/月 |
よくある質問
なぜどのモデルも出力の方が入力よりずっと高いのですか?
トークンを生成する(出力)には、新しいトークン1つごとにモデル全体を通過する処理が必要で、しかも逐次的に実行されます。一方、入力トークン(プロンプト)の処理は1回のバッチでまとめて並列処理できます。この計算コストの非対称性が、主要ベンダーが軒並み出力を入力の4〜8倍程度に設定している理由です。
自分のプロンプトが何トークン使うか、どうすれば分かりますか?
CodeKitHub の AI Token 計数器を使ってください——実際のプロンプトやシステムメッセージを貼り付けると、文字数に基づく大まかな推測ではなく、実際のトークナイザーで正確なトークン数が表示されます。出力トークン数は事前予測が難しいため、実際のAPIレスポンスをいくつか確認し、その使用量を目安にするのが現実的な方法です。
この価格は最新であると保証されていますか?
いいえ——AIベンダーのAPI価格は比較的頻繁に、時にはほとんど予告なく変更されます。このツール内の価格は、計算ツール付近に表示された日付時点で各ベンダーの公式価格ページと直接照合して確認したものです。予算や購入の判断を下す前に、必ずご自身で最新ページをご確認ください:OpenAI 価格(developers.openai.com/api/docs/pricing)、Anthropic/Claude 価格(platform.claude.com/docs/en/about-claude/pricing)、Google Gemini 価格(ai.google.dev/gemini-api/docs/pricing)。
なぜお気に入りのモデルがリストにないのですか?
このツールは各ベンダーの全モデルではなく、OpenAI・Anthropic・Google・DeepSeek・Qwen・Moonshot・Zhipu・xAI それぞれのエントリー/ミドル/フラッグシップ級を代表する計19モデルに絞って対応しています。これはリストを見やすく保ち、価格データを正確に維持しやすくするためです。掲載されていないモデルが必要な場合は、ベンダーのページで100万トークンあたりの価格を確認し、同じ計算式(入力コスト+出力コスト)で手計算してください。
Gemini 3.1 Pro Preview の価格は長いプロンプトの割増を含んでいますか?
含んでいません——表示されている価格は Google の20万トークン以下の階層のものです。Gemini はこの閾値を超えるプロンプトでは価格が上がりますが、このツールをシンプルに保つため、その割増階層は実装していません。プロンプトが常時20万トークンを超える場合は、Google の価格ページで正確な長コンテキスト料金をご確認ください。
DeepSeek・Qwen・Kimi・GLM の価格は米ドル表示ですか?
はい——中国のモデルを含め、このツール内のすべての価格は各社の公式な国際版APIの米ドル建てレートです。これにより全モデルを同じ基準で比較できます。これらのベンダーの一部は中国本土向けに人民元建てのコンソールも提供しており、レートが異なる(多くの場合より安い)場合があります。人民元建てで利用している場合は、各ベンダーのコンソールをご確認ください。