CodeKitHub
Інструменти ШІ

Калькулятор вартості LLM API

Останнє оновлення:

Оберіть модель, введіть кількість вхідних і вихідних токенів — і побачите точну вартість запиту, а також орієнтовну місячну вартість, якщо ви приблизно знаєте кількість запитів. Таблиця порівняння нижче ранжує всі 19 моделей за вартістю для тих самих значень токенів, тож можна одразу побачити, що дешевше для вашого навантаження — GPT, Claude, Gemini, DeepSeek, Qwen, Kimi, GLM чи Grok. Охоплює актуальні моделі OpenAI, Anthropic, Google, DeepSeek, Qwen (Alibaba), Moonshot (Kimi), Zhipu (GLM) та xAI (Grok), з цінами, перевіреними безпосередньо за офіційними сторінками цін кожного постачальника. Усе виконується локально у вашому браузері.

Prices last verified: August 17, 2026

AI vendor API pricing changes frequently — these figures are for reference only. Check the vendor's official pricing page before making budget or purchasing decisions.

Що це за інструмент?

API LLM тарифікуються за токен, а не за запит — і вхідні токени (ваш промпт, системне повідомлення, історія чату) оцінюються інакше, ніж вихідні (те, що генерує модель), зазвичай із націнкою 4-8x для виходу. Через це важко «на око» прикинути вартість, особливо коли порівнюєте моделі різних постачальників з різними тарифами.

Цей калькулятор бере кількість ваших вхідних і вихідних токенів, множить кожну на тариф обраної моделі за мільйон токенів і додає результати — та сама математика, яку виконує білінгова система постачальника. Додайте місячний обсяг запитів, і калькулятор спрогнозує місячну суму — корисно для планування бюджету перед тим, як обрати модель для продакшн.

Навіщо його використовувати?

  • 19 моделей від OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu та xAI — бюджетні, середні та флагманські варіанти, включно з основними китайськими API моделей і Grok.
  • Таблиця порівняння поруч ранжує кожну модель за вартістю для ваших точних значень токенів, тож не доведеться рахувати кожну вручну.
  • Окремий розподіл вартості на вхід/вихід, оскільки вихідні токени коштують у кілька разів дорожче за вхідні в кожного постачальника.
  • Опційний місячний обсяг запитів для швидкого прогнозу бюджету, а не лише оцінки одного запиту.
  • Ціни перевірені безпосередньо за документацією постачальників, з відображеною датою перевірки — не зібрані скрейпінгом і не оцінені приблизно.
  • 100% локально — без API-ключа, без облікового запису, жодні дані не покидають ваш браузер.

Як користуватися

  1. Оберіть модель зі списку, згрупованого за постачальником (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
  2. Введіть кількість вхідних токенів (промпт + системне повідомлення + будь-який контекст) та очікувану кількість вихідних токенів.
  3. Перегляньте вартість запиту, розподілену на вартість входу та вартість виходу.
  4. За бажанням введіть кількість запитів на місяць, щоб побачити орієнтовну місячну вартість.
  5. Прокрутіть униз до таблиці порівняння, щоб побачити всі моделі, ранжовані за вартістю для тих самих значень токенів.

Приклад

Введення

GPT-5.6 Terra, 1000 вхідних токенів, 500 вихідних токенів

Результат

Вартість входу $0,0025 + вартість виходу $0,0075 = $0,01 за запит

При 10 000 запитах на місяць це приблизно $100/місяць — невеликі витрати на запит швидко накопичуються в масштабі, і саме тому важливо перевіряти математику перед вибором моделі.

Розуміння вартості входу та виходу

Кожна модель у цьому списку оцінює вхідні й вихідні токени окремо, і розрив між ними великий і послідовний у всіх постачальників — вихід зазвичай коштує в 5-6 разів дорожче за токен, ніж вхід. Це означає, що багатослівна, розлога відповідь моделі коштує непропорційно більше, ніж довгий промпт із короткою відповіддю, навіть якщо загальна кількість токенів виглядає схожою.

Практичний висновок: якщо ви оптимізуєте витрати на API, скорочення довжини виходу (коротші інструкції в системному промпті на кшталт «відповідай одним абзацом») зазвичай економить більше, ніж скорочення входу, у перерахунку на токен.

Орієнтовна місячна вартість за типом навантаження

Це ілюстративні приклади, а не котирування — використовуйте калькулятор вище з власною кількістю токенів і вибором моделі для точного значення.

Тип навантаженняТипова кількість токенів/запитПриклад моделіОрієнтовна місячна вартість (10 тис. запитів)
Короткі відповіді чат-бота300 вхід / 150 вихідGPT-5.4 Nano≈ $2-3/місяць
Розмітка даних і класифікація500 вхід / 50 вихідDeepSeek V4 Flash≈ $1/місяць
Реферування документів3000 вхід / 400 вихідClaude Sonnet 5≈ $100/місяць
Асистент генерації коду1500 вхід / 1000 вихідGemini 3.5 Flash≈ $110-115/місяць
Написання довгих текстів1000 вхід / 2500 вихідGPT-5.6 Sol≈ $800/місяць

Часті запитання

Чому вихід оцінюється значно дорожче за вхід у кожної моделі?

Генерація токенів (вихід) вимагає повного прямого проходу через модель для кожного нового токена, виконуваного послідовно, тоді як обробку вхідних токенів (промпту) можна виконати паралельно в одному пакеті. Саме ця асиметрія обчислювальних витрат пояснює, чому кожен великий постачальник встановлює ціну на вихід приблизно у 4-8 разів вищу за вхід.

Як дізнатися, скільки токенів займе мій промпт?

Скористайтеся інструментом «Лічильник токенів» на CodeKitHub — вставте свій реальний промпт чи системне повідомлення, і він покаже точну кількість токенів за допомогою справжнього токенізатора, а не приблизну оцінку за кількістю символів. Кількість вихідних токенів передбачити заздалегідь складніше; розумний підхід — перевірити фактичне використання за кількома реальними відповідями API й використати це як орієнтир.

Чи гарантовано ці ціни актуальні?

Ні — ціни на API постачальників ШІ змінюються досить часто, іноді майже без попередження. Ціни в цьому інструменті перевірені безпосередньо за офіційною сторінкою цін кожного постачальника на дату, вказану поруч з калькулятором. Перед прийняттям бюджетного чи закупівельного рішення перевірте актуальну сторінку самостійно: ціни OpenAI (developers.openai.com/api/docs/pricing), ціни Anthropic/Claude (platform.claude.com/docs/en/about-claude/pricing) і ціни Google Gemini (ai.google.dev/gemini-api/docs/pricing).

Чому в списку немає [моєї улюбленої моделі]?

Цей інструмент охоплює репрезентативний набір бюджетних/середніх/флагманських моделей від OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu та xAI (усього 19 моделей), а не кожну модель, яку пропонує кожен постачальник, щоб список залишався легким для перегляду, а дані про ціни — легкими для підтримки в актуальному стані. Якщо вам потрібна модель, якої немає в списку, перевірте її ціну за 1 млн токенів на сторінці постачальника й виконайте той самий розрахунок вартості входу + вартості виходу вручну.

Чи враховує ціна Gemini 3.1 Pro Preview довгі промпти?

Ні — показана ціна відповідає тарифу Google для промптів ≤200 000 токенів. Ціна Gemini підвищується для промптів, довших за цей поріг, і цей калькулятор не моделює цю надбавку, щоб інструмент залишався простим. Якщо ваші промпти регулярно перевищують 200 тис. токенів, перевірте сторінку цін Google для точного тарифу на довгий контекст.

Чи ціни на DeepSeek, Qwen, Kimi та GLM вказані в доларах США?

Так — усі ціни в цьому інструменті, включно з китайськими моделями, — це офіційні міжнародні тарифи API в доларах США, тож усі моделі можна порівнювати на однаковій основі. Деякі з цих постачальників також пропонують консолі з тарифікацією в юанях для облікових записів материкового Китаю за іншими (часто нижчими) тарифами; якщо ви розраховуєтесь у юанях, перевірте власну консоль постачальника.

Що варто оптимізувати — вартість входу чи виходу?

Подивіться на характер свого навантаження. Якщо воно переважно вхідне — довгі документи на вході, короткі відповіді на виході (класифікація, вилучення інформації, RAG) — вартість входу та кешування промптів визначатимуть основну частину рахунку. Якщо навантаження переважно вихідне — довгі генерації з коротких промптів — головну роль відіграє ціна виходу, а вихідні токени зазвичай коштують у кілька разів дорожче за токен, ніж вхідні в тій самій моделі.

Схожі інструменти