Czym jest to narzędzie?
Opłaty za korzystanie z interfejsów API LLM naliczane są na podstawie liczby tokenów, a nie liczby żądań — przy czym tokeny wejściowe (prompt użytkownika, komunikaty systemowe, historia czatu) są wyceniane inaczej niż tokeny wyjściowe (wyniki generowane przez model), zazwyczaj z 4-8-krotną marżą w przypadku tokenów wyjściowych. Taki podział utrudnia oszacowanie „ile to będzie kosztować”, zwłaszcza gdy porównuje się modele różnych dostawców o odmiennych cennikach.
Ten kalkulator pobiera podane przez użytkownika liczby tokenów wejściowych i wyjściowych, mnoży każdą z nich przez stawkę za milion tokenów wybranego modelu, a następnie sumuje wyniki — tak samo jak działa system rozliczeniowy dostawcy. Po wprowadzeniu miesięcznej liczby żądań narzędzie wylicza miesięczną sumę, co jest przydatne przy planowaniu budżetu przed wdrożeniem modelu do środowiska produkcyjnego.
Dlaczego warto go używać?
- 19 modeli z firm OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu i xAI — opcje ekonomiczne, średniej klasy i flagowe, w tym interfejsy API głównych chińskich modeli oraz Grok.
- W tabeli porównawczej, w której modele zestawiono obok siebie, każdy z nich został uszeregowany według ceny dla konkretnej liczby tokenów, dzięki czemu nie musisz obliczać kosztów ręcznie dla każdego z nich.
- Należy przedstawić oddzielny podział kosztów tokenów wejściowych i wyjściowych, ponieważ u każdego dostawcy cena tokenów wyjściowych jest kilkakrotnie wyższa od ceny tokenów wejściowych.
- Opcjonalna miesięczna liczba wniosków, pozwalająca na szybką prognozę budżetową, a nie tylko oszacowanie dotyczące pojedynczego wniosku.
- Ceny zostały zweryfikowane bezpośrednio na podstawie dokumentacji dostawcy, z podaniem daty weryfikacji — nie są to dane zebrane z internetu ani szacunkowe.
- W 100% lokalnie — bez klucza API, bez konta, żadne dane nie opuszczają Twojej przeglądarki.
Jak używać
- Wybierz model z listy rozwijanej, pogrupowanej według dostawców (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
- Wprowadź liczbę tokenów wejściowych (monit + komunikat systemowy + dowolny kontekst) oraz oczekiwaną liczbę tokenów wyjściowych.
- Sprawdź koszt na żądanie, w podziale na koszt wejściowy i koszt wyjściowy.
- Opcjonalnie można wprowadzić liczbę wniosków miesięcznie, aby sprawdzić szacunkowy koszt miesięczny.
- Przewiń w dół do tabeli porównawczej, aby zobaczyć wszystkie modele uszeregowane według ceny przy tej samej liczbie tokenów.
Przykład
Wejście
GPT-5.6 Terra, 1,000 input tokens, 500 output tokensWynik
Input cost $0.0025 + output cost $0.0075 = $0.01 per requestPrzy 10 000 żądań miesięcznie daje to około 100 dolarów miesięcznie — niewielkie koszty poszczególnych żądań szybko się sumują przy większej skali, i właśnie dlatego przed wyborem modelu warto dokładnie przeliczyć koszty.
Różnica między kosztami nakładów a kosztami wynikowymi
W każdym modelu z tej listy ceny tokenów wejściowych i wyjściowych są ustalane oddzielnie, a różnica między nimi jest znaczna i spójna u wszystkich dostawców — token wyjściowy rutynowo kosztuje 5–6 razy więcej niż token wejściowy. Oznacza to, że rozbudowana, szczegółowa odpowiedź modelu kosztuje nieproporcjonalnie więcej niż długi prompt z krótką odpowiedzią, nawet jeśli łączna liczba tokenów wydaje się podobna.
Wniosek praktyczny: jeśli chcesz zoptymalizować koszty korzystania z API, skrócenie długości odpowiedzi (krótsze instrukcje wyświetlane przez system, np. „odpowiedz jednym akapitem”) zazwyczaj pozwala zaoszczędzić więcej niż skrócanie długości danych wejściowych, token po tokenie.
Przybliżony miesięczny koszt w zależności od wzorca użytkowania
Są to przykłady poglądowe, a nie konkretne wartości — aby uzyskać dokładną liczbę, skorzystaj z powyższego kalkulatora, wprowadzając własne wartości liczby tokenów i wybrany model.
| Wzorzec użytkowania | Typowe tokeny/żądania | Przykładowy model | Przybliżony miesięczny koszt (10 tys. żądań) |
|---|---|---|---|
| Krótkie odpowiedzi chatbota | 300 na wejściu / 150 na wyjściu | GPT-5.4 Nano | ≈ 2–3 USD miesięcznie |
| Oznaczanie i klasyfikacja danych | 500 wejść / 50 wyjść | DeepSeek V4 Flash | ≈ 1 dolar miesięcznie |
| Podsumowanie dokumentu | 3 000 na wejściu / 400 na wyjściu | Claude Sonnet 5 | ≈ 100 dolarów miesięcznie |
| Asystent generowania kodu | 1 500 na wejściu / 1 000 na wyjściu | Gemini 3.5 Flash | ≈ 110–115 dolarów miesięcznie |
| Tworzenie długich treści | 1 000 na wejściu / 2 500 na wyjściu | GPT-5.6 Sol | ≈ 800 dolarów miesięcznie |
Najczęściej zadawane pytania
Dlaczego w każdym modelu cena produktu końcowego jest tak znacznie wyższa od ceny czynników produkcji?
Generowanie tokenów (wyników) wymaga pełnego przejścia przez model dla każdego nowego tokenu, realizowanego sekwencyjnie, podczas gdy przetwarzanie tokenów wejściowych (promptu) może odbywać się równolegle w ramach jednej partii. Ta asymetria kosztów obliczeniowych sprawia, że każdy z głównych dostawców wycenia generowanie wyników na około 4–8 razy więcej niż przetwarzanie danych wejściowych.
Skąd mam wiedzieć, ile tokenów zużyje moje polecenie?
Skorzystaj z narzędzia „Token Counter” serwisu CodeKitHub — wklej rzeczywisty tekst polecenia lub komunikat systemowy, a narzędzie wyświetli dokładną liczbę tokenów przy użyciu prawdziwego modułu tokenizującego, a nie przybliżoną liczbę opartą na liczbie znaków. Liczbę tokenów w wynikach trudniej jest przewidzieć z góry; rozsądnym podejściem jest sprawdzenie rzeczywistego zużycia na podstawie kilku prawdziwych odpowiedzi API i wykorzystanie tych danych jako szacunku.
Czy te ceny są na pewno aktualne?
Nie — ceny API dostawców rozwiązań AI zmieniają się dość często, czasami bez większego uprzedzenia. Ceny podane w tym narzędziu zostały zweryfikowane bezpośrednio na oficjalnych stronach cenowych poszczególnych dostawców w dniu wskazanym obok kalkulatora. Przed sporządzeniem budżetu lub podjęciem decyzji o zakupie należy samodzielnie sprawdzić aktualną stronę: Ceny OpenAI (developers.openai.com/api/docs/pricing), ceny Anthropic/Claude (platform.claude.com/docs/en/about-claude/pricing) oraz ceny Google Gemini (ai.google.dev/gemini-api/docs/pricing).
Dlaczego na liście nie ma [mojego ulubionego modelu]?
Narzędzie to obejmuje reprezentatywny przekrój modeli z segmentów budżetowego, średniej klasy i flagowego od firm OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu i xAI (łącznie 19 modeli), a nie wszystkie modele oferowane przez każdego dostawcę, aby lista była przejrzysta, a dane dotyczące cen łatwe do zaktualizowania. Jeśli potrzebujesz modelu, którego nie ma na liście, sprawdź jego cenę za 1 mln tokenów na stronie dostawcy i ręcznie oblicz różnicę między kosztem danych wejściowych a kosztem danych wyjściowych.
Czy cena wersji Gemini 3.1 Pro Preview uwzględnia długie polecenia?
Nie — podana cena dotyczy przedziału Google ≤200 000 tokenów. W przypadku poleceń dłuższych niż ten próg ceny w Gemini są wyższe, a ten kalkulator nie uwzględnia tego przedziału opłat dodatkowych, aby narzędzie pozostało proste. Jeśli Twoje polecenia regularnie przekraczają 200 tys. tokenów, sprawdź stronę z cennikiem Google, aby poznać dokładną stawkę za długie konteksty.
Czy ceny DeepSeek, Qwen, Kimi i GLM są podane w dolarach amerykańskich?
Tak — wszystkie ceny w tym narzędziu, w tym ceny modeli chińskich, to oficjalne międzynarodowe stawki API w USD, dzięki czemu każdy model można porównać na tej samej podstawie. Niektórzy z tych dostawców oferują również konsole rozliczane w CNY dla kont z Chin kontynentalnych po innych (często niższych) stawkach; jeśli rozliczasz się w CNY, sprawdź konsolę danego dostawcy.