Що це за інструмент?
API LLM тарифікуються за токен, а не за запит — і вхідні токени (ваш промпт, системне повідомлення, історія чату) оцінюються інакше, ніж вихідні (те, що генерує модель), зазвичай із націнкою 4-8x для виходу. Через це важко «на око» прикинути вартість, особливо коли порівнюєте моделі різних постачальників з різними тарифами.
Цей калькулятор бере кількість ваших вхідних і вихідних токенів, множить кожну на тариф обраної моделі за мільйон токенів і додає результати — та сама математика, яку виконує білінгова система постачальника. Додайте місячний обсяг запитів, і калькулятор спрогнозує місячну суму — корисно для планування бюджету перед тим, як обрати модель для продакшн.
Навіщо його використовувати?
- 19 моделей від OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu та xAI — бюджетні, середні та флагманські варіанти, включно з основними китайськими API моделей і Grok.
- Таблиця порівняння поруч ранжує кожну модель за вартістю для ваших точних значень токенів, тож не доведеться рахувати кожну вручну.
- Окремий розподіл вартості на вхід/вихід, оскільки вихідні токени коштують у кілька разів дорожче за вхідні в кожного постачальника.
- Опційний місячний обсяг запитів для швидкого прогнозу бюджету, а не лише оцінки одного запиту.
- Ціни перевірені безпосередньо за документацією постачальників, з відображеною датою перевірки — не зібрані скрейпінгом і не оцінені приблизно.
- 100% локально — без API-ключа, без облікового запису, жодні дані не покидають ваш браузер.
Як користуватися
- Оберіть модель зі списку, згрупованого за постачальником (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
- Введіть кількість вхідних токенів (промпт + системне повідомлення + будь-який контекст) та очікувану кількість вихідних токенів.
- Перегляньте вартість запиту, розподілену на вартість входу та вартість виходу.
- За бажанням введіть кількість запитів на місяць, щоб побачити орієнтовну місячну вартість.
- Прокрутіть униз до таблиці порівняння, щоб побачити всі моделі, ранжовані за вартістю для тих самих значень токенів.
Приклад
Введення
GPT-5.6 Terra, 1000 вхідних токенів, 500 вихідних токенівРезультат
Вартість входу $0,0025 + вартість виходу $0,0075 = $0,01 за запитПри 10 000 запитах на місяць це приблизно $100/місяць — невеликі витрати на запит швидко накопичуються в масштабі, і саме тому важливо перевіряти математику перед вибором моделі.
Розуміння вартості входу та виходу
Кожна модель у цьому списку оцінює вхідні й вихідні токени окремо, і розрив між ними великий і послідовний у всіх постачальників — вихід зазвичай коштує в 5-6 разів дорожче за токен, ніж вхід. Це означає, що багатослівна, розлога відповідь моделі коштує непропорційно більше, ніж довгий промпт із короткою відповіддю, навіть якщо загальна кількість токенів виглядає схожою.
Практичний висновок: якщо ви оптимізуєте витрати на API, скорочення довжини виходу (коротші інструкції в системному промпті на кшталт «відповідай одним абзацом») зазвичай економить більше, ніж скорочення входу, у перерахунку на токен.
Орієнтовна місячна вартість за типом навантаження
Це ілюстративні приклади, а не котирування — використовуйте калькулятор вище з власною кількістю токенів і вибором моделі для точного значення.
| Тип навантаження | Типова кількість токенів/запит | Приклад моделі | Орієнтовна місячна вартість (10 тис. запитів) |
|---|---|---|---|
| Короткі відповіді чат-бота | 300 вхід / 150 вихід | GPT-5.4 Nano | ≈ $2-3/місяць |
| Розмітка даних і класифікація | 500 вхід / 50 вихід | DeepSeek V4 Flash | ≈ $1/місяць |
| Реферування документів | 3000 вхід / 400 вихід | Claude Sonnet 5 | ≈ $100/місяць |
| Асистент генерації коду | 1500 вхід / 1000 вихід | Gemini 3.5 Flash | ≈ $110-115/місяць |
| Написання довгих текстів | 1000 вхід / 2500 вихід | GPT-5.6 Sol | ≈ $800/місяць |
Часті запитання
Чому вихід оцінюється значно дорожче за вхід у кожної моделі?
Генерація токенів (вихід) вимагає повного прямого проходу через модель для кожного нового токена, виконуваного послідовно, тоді як обробку вхідних токенів (промпту) можна виконати паралельно в одному пакеті. Саме ця асиметрія обчислювальних витрат пояснює, чому кожен великий постачальник встановлює ціну на вихід приблизно у 4-8 разів вищу за вхід.
Як дізнатися, скільки токенів займе мій промпт?
Скористайтеся інструментом «Лічильник токенів» на CodeKitHub — вставте свій реальний промпт чи системне повідомлення, і він покаже точну кількість токенів за допомогою справжнього токенізатора, а не приблизну оцінку за кількістю символів. Кількість вихідних токенів передбачити заздалегідь складніше; розумний підхід — перевірити фактичне використання за кількома реальними відповідями API й використати це як орієнтир.
Чи гарантовано ці ціни актуальні?
Ні — ціни на API постачальників ШІ змінюються досить часто, іноді майже без попередження. Ціни в цьому інструменті перевірені безпосередньо за офіційною сторінкою цін кожного постачальника на дату, вказану поруч з калькулятором. Перед прийняттям бюджетного чи закупівельного рішення перевірте актуальну сторінку самостійно: ціни OpenAI (developers.openai.com/api/docs/pricing), ціни Anthropic/Claude (platform.claude.com/docs/en/about-claude/pricing) і ціни Google Gemini (ai.google.dev/gemini-api/docs/pricing).
Чому в списку немає [моєї улюбленої моделі]?
Цей інструмент охоплює репрезентативний набір бюджетних/середніх/флагманських моделей від OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu та xAI (усього 19 моделей), а не кожну модель, яку пропонує кожен постачальник, щоб список залишався легким для перегляду, а дані про ціни — легкими для підтримки в актуальному стані. Якщо вам потрібна модель, якої немає в списку, перевірте її ціну за 1 млн токенів на сторінці постачальника й виконайте той самий розрахунок вартості входу + вартості виходу вручну.
Чи враховує ціна Gemini 3.1 Pro Preview довгі промпти?
Ні — показана ціна відповідає тарифу Google для промптів ≤200 000 токенів. Ціна Gemini підвищується для промптів, довших за цей поріг, і цей калькулятор не моделює цю надбавку, щоб інструмент залишався простим. Якщо ваші промпти регулярно перевищують 200 тис. токенів, перевірте сторінку цін Google для точного тарифу на довгий контекст.
Чи ціни на DeepSeek, Qwen, Kimi та GLM вказані в доларах США?
Так — усі ціни в цьому інструменті, включно з китайськими моделями, — це офіційні міжнародні тарифи API в доларах США, тож усі моделі можна порівнювати на однаковій основі. Деякі з цих постачальників також пропонують консолі з тарифікацією в юанях для облікових записів материкового Китаю за іншими (часто нижчими) тарифами; якщо ви розраховуєтесь у юанях, перевірте власну консоль постачальника.
Що варто оптимізувати — вартість входу чи виходу?
Подивіться на характер свого навантаження. Якщо воно переважно вхідне — довгі документи на вході, короткі відповіді на виході (класифікація, вилучення інформації, RAG) — вартість входу та кешування промптів визначатимуть основну частину рахунку. Якщо навантаження переважно вихідне — довгі генерації з коротких промптів — головну роль відіграє ціна виходу, а вихідні токени зазвичай коштують у кілька разів дорожче за токен, ніж вхідні в тій самій моделі.