Apakah alat ini?
API LLM dikenakan bayaran mengikut token, bukan mengikut permintaan — dan token input (prompt anda, mesej sistem, sejarah sembang) diharga berbeza daripada token output (apa yang model hasilkan), biasanya dengan markup 4-8x untuk output. Perbezaan ini menjadikan "berapa kos ini" sukar dianggar, terutamanya apabila anda membandingkan model merentasi vendor dengan kad kadar berbeza.
Kalkulator ini mengambil kiraan token input dan output anda, mendarabkan setiap satu dengan kadar per-juta-token model yang dipilih, dan menjumlahkannya — matematik yang sama seperti sistem bil vendor lakukan. Tambah volum permintaan bulanan dan ia mengunjurkan jumlah bulanan, berguna untuk belanjawan sebelum anda komited kepada satu model dalam produksi.
Kenapa guna alat ini?
- 19 model merentasi OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu dan xAI — pilihan bajet, pertengahan dan unggulan, termasuk API model China utama dan Grok.
- Jadual perbandingan bersebelahan menyusun setiap model mengikut kos untuk kiraan token tepat anda, jadi anda tidak perlu kira setiap satu secara manual.
- Pecahan kos input/output berasingan, kerana token output diharga beberapa kali lebih tinggi daripada token input pada setiap vendor.
- Volum permintaan bulanan pilihan untuk unjuran belanjawan segera, bukan sekadar anggaran satu permintaan.
- Harga disahkan terus terhadap dokumentasi vendor, dengan tarikh pengesahan ditunjukkan — bukan dikikis atau dianggar.
- 100% tempatan — tiada kunci API, tiada akaun, tiada data meninggalkan pelayar anda.
Cara menggunakannya
- Pilih model daripada dropdown, dikumpulkan mengikut vendor (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
- Masukkan kiraan token input anda (prompt + mesej sistem + sebarang konteks) dan kiraan token output yang dijangka.
- Baca kos setiap permintaan, dipecah kepada kos input dan kos output.
- Jika perlu, masukkan permintaan setiap bulan untuk lihat anggaran kos bulanan.
- Skrol ke bawah ke jadual perbandingan untuk lihat setiap model disusun mengikut kos untuk kiraan token yang sama.
Contoh
Input
GPT-5.6 Terra, 1,000 token input, 500 token outputHasil
Kos input $0.0025 + kos output $0.0075 = $0.01 setiap permintaanPada 10,000 permintaan/bulan itu kira-kira $100/bulan — kos kecil setiap permintaan bertambah dengan cepat pada skala besar, itulah sebabnya menyemak matematik sebelum memilih model itu penting.
Memahami kos input berbanding output
Setiap model dalam senarai ini mengharga token input dan output secara berasingan, dan jurang antara keduanya besar dan konsisten merentasi vendor — output secara rutin kos 5-6x lebih tinggi setiap token berbanding input. Ini bermakna respons model yang berjela dan panjang kos lebih tidak berkadar berbanding prompt panjang dengan jawapan pendek, walaupun jumlah kiraan token kelihatan serupa.
Implikasi praktikal: jika anda mengoptimumkan perbelanjaan API, memendekkan panjang output (arahan prompt sistem yang lebih pendek seperti "jawab dalam satu perenggan") biasanya menjimatkan lebih banyak berbanding memendekkan input, token demi token.
Anggaran kos bulanan kasar mengikut corak penggunaan
Ini adalah contoh ilustratif, bukan sebut harga — gunakan kalkulator di atas dengan kiraan token dan pilihan model anda sendiri untuk nombor yang tepat.
| Corak penggunaan | Token/permintaan biasa | Contoh model | Anggaran kos bulanan kasar (10k permintaan) |
|---|---|---|---|
| Balasan chatbot pendek | 300 masuk / 150 keluar | GPT-5.4 Nano | ≈ $2-3/bulan |
| Pelabelan data & klasifikasi | 500 masuk / 50 keluar | DeepSeek V4 Flash | ≈ $1/bulan |
| Ringkasan dokumen | 3,000 masuk / 400 keluar | Claude Sonnet 5 | ≈ $100/bulan |
| Pembantu penjanaan kod | 1,500 masuk / 1,000 keluar | Gemini 3.5 Flash | ≈ $110-115/bulan |
| Penulisan kandungan panjang | 1,000 masuk / 2,500 keluar | GPT-5.6 Sol | ≈ $800/bulan |
Soalan lazim
Kenapa output diharga jauh lebih tinggi daripada input pada setiap model?
Menjana token (output) memerlukan laluan hadapan penuh melalui model bagi setiap token baharu, dijalankan secara berurutan, manakala memproses token input (prompt) boleh dilakukan secara selari dalam satu kelompok. Kos pengiraan yang tidak simetri ini adalah sebab kenapa setiap vendor utama mengharga output pada kira-kira 4-8x kadar input.
Bagaimana saya tahu berapa banyak token prompt saya akan gunakan?
Gunakan alat Token Counter CodeKitHub — tampal prompt atau mesej sistem sebenar anda dan ia menunjukkan kiraan token tepat menggunakan tokenizer sebenar, bukannya anggaran kasar berasaskan aksara. Kiraan token output lebih sukar diramal terlebih dahulu; pendekatan yang munasabah ialah semak penggunaan sebenar daripada beberapa respons API sebenar dan gunakan itu sebagai anggaran anda.
Adakah harga ini dijamin terkini?
Tidak — harga API vendor AI berubah agak kerap, kadangkala dengan sedikit notis. Harga dalam alat ini telah disahkan terus terhadap laman harga rasmi setiap vendor pada tarikh yang ditunjukkan berhampiran kalkulator. Sebelum membuat keputusan belanjawan atau pembelian, semak laman semasa sendiri: harga OpenAI (developers.openai.com/api/docs/pricing), harga Anthropic/Claude (platform.claude.com/docs/en/about-claude/pricing), dan harga Google Gemini (ai.google.dev/gemini-api/docs/pricing).
Kenapa [model kegemaran saya] tiada dalam senarai?
Alat ini meliputi sebaran wakil bajet/pertengahan/unggulan daripada OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu dan xAI (19 model jumlahnya) berbanding setiap model yang ditawarkan setiap vendor, untuk mengekalkan senarai mudah diimbas dan data harga mudah dikekalkan tepat. Jika anda memerlukan model yang tiada dalam senarai, semak harganya per 1 juta token pada laman vendor dan buat matematik kos-input + kos-output yang sama secara manual.
Adakah harga Gemini 3.1 Pro Preview mengambil kira prompt panjang?
Tidak — harga yang ditunjukkan ialah tingkat ≤200,000-token Google. Harga Gemini meningkat untuk prompt lebih panjang daripada ambang itu, dan kalkulator ini tidak memodelkan tingkat surcaj itu, untuk mengekalkan alat ini mudah. Jika prompt anda sentiasa melebihi 200k token, semak laman harga Google untuk kadar konteks-panjang yang tepat.
Adakah harga DeepSeek, Qwen, Kimi dan GLM dalam USD?
Ya — semua harga dalam alat ini, termasuk model China, ialah kadar API antarabangsa rasmi dalam USD, supaya setiap model boleh dibandingkan atas asas yang sama. Sesetengah vendor ini juga menawarkan konsol berbil CNY untuk akaun China tanah besar pada kadar berbeza (selalunya lebih rendah); semak konsol vendor sendiri jika anda membil dalam CNY.
Patutkah saya optimumkan kos input atau kos output?
Lihat bentuk beban kerja anda. Jika ia berat-input — dokumen panjang masuk, jawapan pendek keluar (klasifikasi, pengekstrakan, RAG) — harga input dan caching prompt mendominasi bil anda. Jika ia berat-output — penjanaan panjang daripada prompt pendek — harga output paling penting, dan token output biasanya kos beberapa kali ganda lebih tinggi setiap token berbanding input pada model yang sama.