CodeKitHub
Bahasa Indonesia
API LLM termurah di 2026: perbandingan harga lengkap, 19 model

API LLM termurah di 2026: perbandingan harga lengkap, 19 model

Dipublikasikan 25 Jul 2026

Kalau kamu memilih API LLM murni berdasarkan biaya, selisihnya lebih besar dari yang kebanyakan orang kira. Membandingkan semua 19 model yang dilacak Kalkulator Harga API LLM di situs ini — OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot/Kimi, Zhipu/GLM, dan xAI — model termurah dan termahal berbeda lebih dari 60x pada basis yang setara. Selisih ini jauh lebih penting daripada logo vendor mana yang biasa kamu pakai.

Peringkatnya

Untuk membandingkan secara adil, setiap model di bawah dinilai dengan tarif blended: 750.000 token input + 250.000 token output per 1 juta token total, kira-kira mendekati permintaan chat khas di mana balasannya lebih pendek dari prompt-nya. Harga per 1 juta token, sudah diverifikasi ulang dengan halaman harga resmi masing-masing vendor.

Peringkat Model Provider Input Output Blended (3:1)
1 Gemini 2.5 Flash-Lite Google $0.10 $0.40 $0.175
1 DeepSeek V4 Flash DeepSeek $0.14 $0.28 $0.175
3 Qwen3.6 Flash Qwen $0.19 $1.13 $0.42
4 GPT-5.4 Nano OpenAI $0.20 $1.25 $0.46
5 DeepSeek V4 Pro DeepSeek $0.44 $0.87 $0.54
6 Grok Code Fast 1 xAI $1.00 $2.00 $1.25
7 GPT-5.4 Mini OpenAI $0.75 $4.50 $1.69
8 Claude Haiku 4.5 Anthropic $1.00 $5.00 $2.00
9 GLM-5.2 Zhipu $1.40 $4.40 $2.15
10 GPT-5.6 Luna OpenAI $1.00 $6.00 $2.25
11 Grok 4.5 xAI $2.00 $6.00 $3.00
12 Gemini 3.5 Flash Google $1.50 $9.00 $3.38
13 Qwen3.7 Max Qwen $2.50 $7.50 $3.75
14 Claude Sonnet 5 Anthropic $2.00 $10.00 $4.00
15 Gemini 3.1 Pro Preview Google $2.00 $12.00 $4.50
16 GPT-5.6 Terra OpenAI $2.50 $15.00 $5.63
17 Kimi K3 Moonshot $3.00 $15.00 $6.00
18 Claude Opus 5 Anthropic $5.00 $25.00 $10.00
19 GPT-5.6 Sol OpenAI $5.00 $30.00 $11.25

Ada beberapa hal yang menonjol. Setiap provider — bukan cuma satu — punya tier hemat dan tier andalan (flagship) yang selisihnya beberapa kali lipat, jadi pertanyaan “provider mana yang paling murah” itu keliru; pertanyaan yang tepat adalah “model spesifik yang mana”. Kedua, dua model termurah (Gemini 2.5 Flash-Lite dan DeepSeek V4 Flash) berada di tarif blended yang persis sama meski berasal dari perusahaan yang tidak berhubungan sama sekali — di segmen paling bawah, harga tier hemat sudah konvergen, bukan karena satu vendor sengaja membanting harga di bawah yang lain.

Kenapa model termurah belum tentu pilihan yang tepat

Harga saja tidak memberi tahu apakah sebuah model cukup baik untuk tugasmu. Model tier hemat biasanya cocok untuk klasifikasi, ekstraksi data, balasan singkat, dan pekerjaan sempit lain yang sudah jelas definisinya — jenis pekerjaan di mana kemampuan penalaran ekstra dari model flagship justru tidak terpakai. Model-model ini kurang cocok untuk penalaran terbuka, alur kerja agent multi-langkah yang panjang, atau tugas di mana jawaban yang salah baru ketahuan belakangan dan mahal untuk diperbaiki; model murah yang salah mengerjakan tugas dan butuh diulang (atau diperbaiki manual) bisa berakhir lebih mahal daripada model yang lebih mahal tapi benar sejak percobaan pertama.

Default yang masuk akal: buat prototipe dengan model yang paling kamu kenal, lalu setelah tugasnya sudah jelas definisinya, uji apakah model tier hemat dari tabel yang sama bisa menghasilkan output yang cukup mirip secara kualitas — kalau iya, penghematannya akan terasa besar ketika diskalakan; kalau tidak, berarti selisih harga memang bukan faktor biaya utamanya.

Menghitung angka sebenarnya untuk kasusmu

Tabel ini memakai rasio blended tetap 3:1 supaya bisa dibuat peringkat, tapi rasio input/output token nyata kamu hampir pasti bukan 3:1 — tugas peringkasan bisa saja 10:1, tugas menghasilkan kode bisa mendekati 1:2. Peringkat blended di atas adalah titik awal yang masuk akal untuk memilih kandidat yang akan diuji, bukan pengganti untuk menghitung biaya spesifikmu sendiri.

Untuk itu, gunakan langsung Kalkulator Harga API LLM: masukkan jumlah token input dan output yang sebenarnya, dan alat ini menghitung biaya persis untuk salah satu dari 19 model ini, plus perkiraan bulanan kalau kamu sudah tahu kira-kira berapa banyak permintaan yang akan kamu buat. Kalau kamu belum tahu jumlah tokenmu, alat Token Counter memberi angka sebenarnya dari prompt asli, bukan sekadar tebakan kasar. Keduanya berjalan sepenuhnya di browser kamu — tanpa API key, tanpa akun, tidak ada yang diunggah ke mana pun.

← Kembali ke Blog