Kas yra šis įrankis?
LLM API apmokestinamas už tokeną, o ne už užklausą — ir įvesties tokenai (jūsų raginimas, sistemos pranešimas, pokalbio istorija) kainuoja kitaip nei išvesties tokenai (tai, ką modelis sugeneruoja), dažniausiai su 4-8 kartų antkainiu už išvestį. Dėl to sunku iš akies įvertinti, kiek tai kainuos, ypač lyginant modelius tarp skirtingų tiekėjų su skirtingais kainoraščiais.
Ši skaičiuoklė paima jūsų įvesties ir išvesties tokenų skaičių, padaugina kiekvieną iš pasirinkto modelio kainos už milijoną tokenų ir sudeda kartu — lygiai taip pat, kaip skaičiuoja tiekėjo apmokestinimo sistema. Pridėjus mėnesio užklausų kiekį, gaunama mėnesio bendra suma — naudinga biudžetui planuoti prieš pasirenkant modelį gamybai.
Kodėl jį naudoti?
- 19 modelių iš OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu ir xAI — biudžetiniai, vidutinio lygio ir pažangiausi variantai, įskaitant pagrindinius Kinijos modelių API ir Grok.
- Palyginimo lentelė surikiuoja kiekvieną modelį pagal kainą jūsų tiksliems tokenų skaičiams, tad nereikia skaičiuoti kiekvieno rankiniu būdu.
- Atskiras įvesties/išvesties kainų suskirstymas, nes išvesties tokenai kainuoja kelis kartus daugiau nei įvesties tokenai pas visus tiekėjus.
- Pasirinktinis mėnesio užklausų kiekis greitai biudžeto projekcijai, o ne tik vienos užklausos įverčiui.
- Kainos patikrintos tiesiogiai pagal tiekėjų dokumentaciją, nurodant patikrinimo datą — ne surinktos automatiškai ar apytikslės.
- 100% lokaliai — jokio API rakto, jokios paskyros, jokie duomenys nepalieka jūsų naršyklės.
Kaip naudoti
- Pasirinkite modelį iš išskleidžiamo sąrašo, suskirstyto pagal tiekėją (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
- Įveskite savo įvesties tokenų skaičių (raginimas + sistemos pranešimas + bet koks kontekstas) ir tikėtiną išvesties tokenų skaičių.
- Peržiūrėkite užklausos kainą, suskirstytą į įvesties ir išvesties kainas.
- Jei norite, įveskite užklausų per mėnesį skaičių, kad pamatytumėte apytikslę mėnesio kainą.
- Slinkite žemyn prie palyginimo lentelės, kad pamatytumėte visus modelius, surikiuotus pagal kainą tiems patiems tokenų skaičiams.
Pavyzdys
Įvestis
GPT-5.6 Terra, 1 000 įvesties tokenų, 500 išvesties tokenųIšvestis
Įvesties kaina 0,0025 USD + išvesties kaina 0,0075 USD = 0,01 USD už užklausąEsant 10 000 užklausų per mėnesį, tai apytiksliai 100 USD per mėnesį — nedidelės vienos užklausos kainos greitai susisumuoja dideliu mastu, todėl skaičiavimo patikrinimas prieš pasirenkant modelį yra tikrai svarbus.
Įvesties ir išvesties kainos supratimas
Kiekvienas šio sąrašo modelis įvesties ir išvesties tokenus kainuoja atskirai, ir skirtumas tarp jų yra didelis ir nuoseklus tarp tiekėjų — išvestis dažniausiai kainuoja 5-6 kartus daugiau už toką nei įvestis. Tai reiškia, kad išsamus, gausus modelio atsakymas kainuoja neproporcingai daugiau nei ilgas raginimas su trumpu atsakymu, net jei bendras tokenų skaičius atrodo panašus.
Praktinė pasekmė: jei optimizuojate API išlaidas, išvesties ilgio trumpinimas (trumpesnės sistemos raginimo instrukcijos, pvz., "atsakykite viena pastraipa") paprastai sutaupo daugiau nei įvesties trumpinimas, skaičiuojant tokenų požiūriu.
Apytikslė mėnesio kaina pagal naudojimo modelį
Tai iliustraciniai pavyzdžiai, o ne kainos pasiūlymai — naudokite aukščiau esančią skaičiuoklę su savo tokenų skaičiais ir modelio pasirinkimu, kad gautumėte tikslų skaičių.
| Naudojimo modelis | Tipiniai tokenai/užklausa | Modelio pavyzdys | Apytikslė mėnesio kaina (10 tūkst. užklausų) |
|---|---|---|---|
| Trumpi pokalbių boto atsakymai | 300 įv. / 150 išv. | GPT-5.4 Nano | ≈ 2-3 USD/mėn. |
| Duomenų žymėjimas ir klasifikavimas | 500 įv. / 50 išv. | DeepSeek V4 Flash | ≈ 1 USD/mėn. |
| Dokumentų santraukos | 3 000 įv. / 400 išv. | Claude Sonnet 5 | ≈ 100 USD/mėn. |
| Kodo generavimo asistentas | 1 500 įv. / 1 000 išv. | Gemini 3.5 Flash | ≈ 110-115 USD/mėn. |
| Ilgo turinio rašymas | 1 000 įv. / 2 500 išv. | GPT-5.6 Sol | ≈ 800 USD/mėn. |
Dažniausiai užduodami klausimai
Kodėl išvestis kainuoja tiek daugiau nei įvestis pas visus modelius?
Tokenų generavimas (išvestis) reikalauja pilno modelio praėjimo kiekvienam naujam tokenui, atliekamo nuosekliai, o įvesties tokenų (raginimo) apdorojimas gali vykti lygiagrečiai vienu paketu. Šis asimetriškas skaičiavimo kaštas ir yra priežastis, kodėl visi pagrindiniai tiekėjai išvestį kainuoja maždaug 4-8 kartus brangiau nei įvestį.
Kaip sužinoti, kiek tokenų sunaudos mano raginimas?
Naudokite CodeKitHub tokenų skaičiuoklę — įklijuokite savo tikrą raginimą ar sistemos pranešimą, ir ji parodys tikslų tokenų skaičių naudodama tikrą tokenizatorių, o ne apytikslį spėjimą pagal simbolių skaičių. Išvesties tokenų skaičių iš anksto numatyti sunkiau; protingas būdas – patikrinti realų naudojimą iš kelių tikrų API atsakymų ir naudoti tai kaip įvertį.
Ar šios kainos garantuotai aktualios?
Ne — DI tiekėjų API kainos keičiasi gana dažnai, kartais be didesnio įspėjimo. Šio įrankio kainos buvo patikrintos tiesiogiai pagal kiekvieno tiekėjo oficialų kainoraščio puslapį, nurodytą datą prie skaičiuoklės. Prieš priimdami biudžeto ar pirkimo sprendimą, patikrinkite dabartinį puslapį patys: OpenAI kainoraštį (developers.openai.com/api/docs/pricing), Anthropic/Claude kainoraštį (platform.claude.com/docs/en/about-claude/pricing) ir Google Gemini kainoraštį (ai.google.dev/gemini-api/docs/pricing).
Kodėl sąraše nėra [mano mėgstamiausio modelio]?
Šis įrankis apima reprezentatyvų biudžetinių/vidutinio lygio/pažangiausių modelių pasirinkimą iš OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu ir xAI (iš viso 19 modelių), o ne kiekvieną tiekėjo siūlomą modelį, kad sąrašą būtų lengva peržiūrėti, o kainų duomenis – lengva palaikyti tiksliais. Jei jums reikia modelio, kurio nėra sąraše, patikrinkite jo kainą už 1M tokenų tiekėjo puslapyje ir atlikite tą patį įvesties kainos + išvesties kainos skaičiavimą rankiniu būdu.
Ar Gemini 3.1 Pro Preview kaina įvertina ilgus raginimus?
Ne — rodoma kaina yra Google ≤200 000 tokenų pakopos kaina. Gemini kainos didėja raginimams, viršijantiems šią ribą, ir ši skaičiuoklė šio antkainio pakopos nemodeliuoja, kad įrankis liktų paprastas. Jei jūsų raginimai reguliariai viršija 200k tokenų, patikrinkite tikslią ilgo konteksto kainą Google kainoraščio puslapyje.
Ar DeepSeek, Qwen, Kimi ir GLM kainos nurodytos JAV doleriais?
Taip — visos šio įrankio kainos, įskaitant Kinijos modelius, yra oficialūs tarptautiniai API tarifai JAV doleriais, todėl visus modelius galima lyginti tuo pačiu pagrindu. Kai kurie iš šių tiekėjų taip pat siūlo CNY apmokestinamas konsoles žemyninės Kinijos paskyroms su kitomis (dažnai mažesnėmis) kainomis; jei atsiskaitote CNY, patikrinkite tiekėjo paties konsolę.
Ar reikėtų optimizuoti įvesties, ar išvesties kainą?
Priklauso nuo jūsų darbo krūvio pobūdžio. Jei jis įvesties-intensyvus — ilgi dokumentai įvedami, trumpi atsakymai gaunami (klasifikavimas, ištraukimas, RAG) — įvesties kaina ir raginimų talpinimas (caching) lemia didžiąją sąskaitos dalį. Jei jis išvesties-intensyvus — ilgi generavimai iš trumpų raginimų — svarbiausia išvesties kaina, o išvesties tokenai paprastai kainuoja kelis kartus daugiau už toką nei įvestis to paties modelio atveju.