CodeKitHub
Bahasa Indonesia
Alat AI

Kalkulator Harga API LLM

Pilih model, masukkan jumlah token input dan output Anda, dan lihat biaya pasti per request — plus estimasi biaya bulanan jika Anda tahu kira-kira berapa banyak request yang akan Anda lakukan. Tabel perbandingan di bawah mengurutkan seluruh 19 model berdasarkan biaya untuk jumlah token yang sama, sehingga Anda bisa langsung melihat apakah GPT, Claude, Gemini, DeepSeek, Qwen, Kimi, GLM, atau Grok paling murah untuk beban kerja Anda. Mencakup model terkini dari OpenAI, Anthropic, Google, DeepSeek, Qwen (Alibaba), Moonshot (Kimi), Zhipu (GLM), dan xAI (Grok), dengan harga yang diverifikasi langsung dari halaman harga resmi masing-masing vendor. Semuanya berjalan secara lokal di browser Anda.

Prices last verified: July 25, 2026

AI vendor API pricing changes frequently — these figures are for reference only. Check the vendor's official pricing page before making budget or purchasing decisions.

Apa Itu Alat Ini?

API LLM ditagih per token, bukan per request — dan token input (prompt Anda, pesan sistem, riwayat chat) dihargai berbeda dari token output (yang dihasilkan model), biasanya dengan markup 4-8x untuk output. Perbedaan ini membuat "berapa biaya yang akan dikeluarkan" sulit diperkirakan, apalagi saat membandingkan model dari berbagai penyedia dengan tarif yang berbeda-beda.

Kalkulator ini mengambil jumlah token input dan output Anda, mengalikan masing-masing dengan tarif per juta token dari model yang dipilih, lalu menjumlahkannya — perhitungan yang sama seperti yang dilakukan sistem billing vendor. Tambahkan volume request bulanan dan kalkulator akan memproyeksikan total bulanan, berguna untuk penganggaran sebelum Anda memutuskan menggunakan suatu model di produksi.

Mengapa Menggunakannya?

  • 19 model dari OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu, dan xAI — pilihan hemat, menengah, dan flagship, termasuk API model Tiongkok utama dan Grok.
  • Tabel perbandingan berdampingan mengurutkan setiap model berdasarkan biaya untuk jumlah token Anda yang tepat, sehingga Anda tidak perlu menghitung masing-masing secara manual.
  • Rincian biaya input/output terpisah, karena token output dihargai beberapa kali lebih tinggi daripada token input di setiap penyedia.
  • Volume request bulanan opsional untuk proyeksi anggaran cepat, bukan hanya estimasi satu request.
  • Harga diverifikasi langsung dari dokumentasi vendor, dengan tanggal verifikasi ditampilkan — bukan hasil scraping atau perkiraan.
  • 100% lokal — tanpa API key, tanpa akun, tidak ada data yang meninggalkan browser Anda.

Cara Menggunakan

  1. Pilih model dari dropdown, dikelompokkan berdasarkan penyedia (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
  2. Masukkan jumlah token input Anda (prompt + pesan sistem + konteks apa pun) dan perkiraan jumlah token output.
  3. Lihat biaya per request, dipecah menjadi biaya input dan biaya output.
  4. Opsional, masukkan jumlah request per bulan untuk melihat estimasi biaya bulanan.
  5. Gulir ke bawah ke tabel perbandingan untuk melihat setiap model diurutkan berdasarkan biaya untuk jumlah token yang sama.

Contoh

Input

GPT-5.6 Terra, 1.000 token input, 500 token output

Output

Biaya input $0,0025 + biaya output $0,0075 = $0,01 per request

Pada 10.000 request/bulan itu setara sekitar $100/bulan — biaya kecil per request bisa cepat menumpuk dalam skala besar, itulah tepatnya mengapa memeriksa perhitungan sebelum memilih model itu penting.

Memahami biaya input vs. output

Setiap model dalam daftar ini menetapkan harga token input dan output secara terpisah, dan selisihnya besar dan konsisten di seluruh penyedia — output rutin berbiaya 5-6x lebih mahal per token dibanding input. Artinya respons model yang panjang dan bertele-tele berbiaya jauh lebih besar daripada prompt panjang dengan jawaban singkat, bahkan jika total jumlah token terlihat mirip.

Implikasi praktisnya: jika Anda ingin mengoptimalkan pengeluaran API, memangkas panjang output (instruksi system-prompt yang lebih singkat seperti "jawab dalam satu paragraf") biasanya lebih menghemat daripada memangkas input, per token.

Perkiraan biaya bulanan menurut pola penggunaan

Ini adalah contoh ilustratif, bukan kutipan harga pasti — gunakan kalkulator di atas dengan jumlah token dan pilihan model Anda sendiri untuk angka yang tepat.

Pola penggunaanToken tipikal/requestContoh modelPerkiraan biaya bulanan (10 rb request)
Balasan chatbot singkat300 in / 150 outGPT-5.4 Nano≈ $2-3/bulan
Pelabelan data & klasifikasi500 in / 50 outDeepSeek V4 Flash≈ $1/bulan
Ringkasan dokumen3.000 in / 400 outClaude Sonnet 5≈ $100/bulan
Asisten pembuatan kode1.500 in / 1.000 outGemini 3.5 Flash≈ $110-115/bulan
Penulisan konten panjang1.000 in / 2.500 outGPT-5.6 Sol≈ $800/bulan

Pertanyaan yang Sering Diajukan

Mengapa harga output jauh lebih tinggi daripada input pada setiap model?

Menghasilkan token (output) memerlukan satu forward pass penuh melalui model untuk setiap token baru, dijalankan secara berurutan, sementara memproses token input (prompt) bisa dilakukan secara paralel dalam satu batch. Biaya komputasi yang tidak simetris inilah yang membuat setiap penyedia utama menetapkan harga output sekitar 4-8x lebih tinggi daripada tarif input.

Bagaimana saya tahu berapa banyak token yang akan digunakan prompt saya?

Gunakan alat Token Counter dari CodeKitHub — tempel prompt atau pesan sistem Anda yang sebenarnya dan alat itu menampilkan jumlah token pasti menggunakan tokenizer sungguhan, bukan perkiraan kasar berbasis jumlah karakter. Jumlah token output lebih sulit diprediksi di muka; pendekatan yang masuk akal adalah memeriksa penggunaan aktual dari beberapa respons API sungguhan dan menjadikannya sebagai estimasi.

Apakah harga-harga ini dijamin selalu terkini?

Tidak — harga API vendor AI cukup sering berubah, terkadang tanpa pemberitahuan yang jelas. Harga dalam alat ini diverifikasi langsung dari halaman harga resmi masing-masing vendor pada tanggal yang tertera dekat kalkulator. Sebelum membuat keputusan anggaran atau pembelian, periksa sendiri halaman resminya: harga OpenAI (developers.openai.com/api/docs/pricing), harga Anthropic/Claude (platform.claude.com/docs/en/about-claude/pricing), dan harga Google Gemini (ai.google.dev/gemini-api/docs/pricing).

Mengapa [model favorit saya] tidak ada di daftar?

Alat ini mencakup rentang representatif hemat/menengah/flagship dari OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu, dan xAI (total 19 model), bukan seluruh model yang ditawarkan setiap vendor, agar daftar tetap mudah dibaca dan data harga tetap mudah dijaga akurasinya. Jika Anda membutuhkan model yang tidak tercantum, periksa harganya per 1 juta token di halaman vendor dan lakukan perhitungan biaya input + biaya output yang sama secara manual.

Apakah harga Gemini 3.1 Pro Preview memperhitungkan prompt yang panjang?

Tidak — harga yang ditampilkan adalah tarif tier ≤200.000 token milik Google. Harga Gemini naik untuk prompt yang lebih panjang dari ambang batas itu, dan kalkulator ini tidak memodelkan tier biaya tambahan tersebut, agar alat tetap sederhana. Jika prompt Anda secara rutin melebihi 200 ribu token, periksa halaman harga Google untuk tarif konteks panjang yang pasti.

Apakah harga DeepSeek, Qwen, Kimi, dan GLM dalam USD?

Ya — semua harga dalam alat ini, termasuk model-model Tiongkok, adalah tarif API internasional resmi dalam USD, sehingga setiap model bisa dibandingkan dengan basis yang sama. Beberapa vendor ini juga menawarkan konsol berbasis CNY untuk akun Tiongkok daratan dengan tarif yang berbeda (sering lebih rendah); periksa konsol vendor sendiri jika Anda menagih dalam CNY.

Alat Terkait