
API LLM Paling Murah 2026: perbandingan harga penuh, 19 model
Diterbitkan pada 25 Jul 2026
Jika anda memilih API LLM semata-mata berdasarkan kos, julat harganya lebih besar daripada yang disangka kebanyakan orang. Membandingkan kesemua 19 model yang dijejaki oleh Kalkulator Harga API LLM laman ini — OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot/Kimi, Zhipu/GLM dan xAI — model termurah dan termahal berbeza lebih daripada 60x atas dasar perbandingan setara. Jurang itu jauh lebih penting daripada logo vendor mana yang anda biasa gunakan.
Susunan kedudukan
Untuk perbandingan yang adil, setiap model di bawah dinilai pada kadar campuran: 750,000 token input + 250,000 token output bagi setiap 1M jumlah token, lebih kurang sepadan dengan permintaan gaya sembang biasa di mana balasan lebih pendek daripada prom. Harga adalah per 1M token, disahkan dengan halaman harga rasmi setiap vendor.
| Kedudukan | Model | Penyedia | Input | Output | Campuran (3:1) |
|---|---|---|---|---|---|
| 1 | Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.175 | |
| 1 | DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | $0.175 |
| 3 | Qwen3.6 Flash | Qwen | $0.19 | $1.13 | $0.42 |
| 4 | GPT-5.4 Nano | OpenAI | $0.20 | $1.25 | $0.46 |
| 5 | DeepSeek V4 Pro | DeepSeek | $0.44 | $0.87 | $0.54 |
| 6 | Grok Code Fast 1 | xAI | $1.00 | $2.00 | $1.25 |
| 7 | GPT-5.4 Mini | OpenAI | $0.75 | $4.50 | $1.69 |
| 8 | Claude Haiku 4.5 | Anthropic | $1.00 | $5.00 | $2.00 |
| 9 | GLM-5.2 | Zhipu | $1.40 | $4.40 | $2.15 |
| 10 | GPT-5.6 Luna | OpenAI | $1.00 | $6.00 | $2.25 |
| 11 | Grok 4.5 | xAI | $2.00 | $6.00 | $3.00 |
| 12 | Gemini 3.5 Flash | $1.50 | $9.00 | $3.38 | |
| 13 | Qwen3.7 Max | Qwen | $2.50 | $7.50 | $3.75 |
| 14 | Claude Sonnet 5 | Anthropic | $2.00 | $10.00 | $4.00 |
| 15 | Gemini 3.1 Pro Preview | $2.00 | $12.00 | $4.50 | |
| 16 | GPT-5.6 Terra | OpenAI | $2.50 | $15.00 | $5.63 |
| 17 | Kimi K3 | Moonshot | $3.00 | $15.00 | $6.00 |
| 18 | Claude Opus 5 | Anthropic | $5.00 | $25.00 | $10.00 |
| 19 | GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | $11.25 |
Beberapa perkara menarik perhatian. Setiap penyedia — bukan satu sahaja — mempunyai peringkat bajet dan peringkat perdana yang berbeza beberapa kali ganda, jadi “vendor mana yang paling murah” adalah soalan yang salah; “model spesifik yang mana” adalah soalan yang betul. Kedua, dua model termurah (Gemini 2.5 Flash-Lite dan DeepSeek V4 Flash) mendarat pada kadar campuran yang sama persis walaupun datang daripada syarikat yang tiada kaitan — di hujung paling rendah, harga peringkat bajet telah menumpu, bukannya satu vendor memotong harga yang lain.
Mengapa model termurah bukan automatik pilihan yang tepat
Harga semata-mata tidak memberitahu anda sama ada sesuatu model cukup baik untuk tugas anda. Model peringkat bajet biasanya memadai untuk pengelasan, pengekstrakan, balasan pendek, dan kerja-kerja sempit yang jelas takrifnya — jenis kerja di mana keupayaan penaakulan tambahan model perdana tidak digunakan pun. Ia kurang sesuai untuk penaakulan terbuka, aliran kerja ejen berbilang langkah yang panjang, atau tugas di mana jawapan yang salah mahal untuk dikesan kemudian; model murah yang tersilap dan perlu diulang (atau dibetulkan oleh manusia) boleh jadi lebih mahal daripada model mahal yang betul pada percubaan pertama.
Pendekatan lalai yang munasabah: buat prototaip dengan model yang paling anda biasa, kemudian setelah tugas itu jelas takrifnya, uji sama ada model peringkat bajet daripada jadual yang sama menghasilkan output yang cukup serupa — jika ya, penjimatan itu berganda pada skala besar; jika tidak, perbezaan harga memang bukan pemacu kos yang sebenar.
Mendapatkan angka sebenar anda
Jadual ini menggunakan campuran tetap 3:1 supaya penyusunan kedudukan boleh dibuat, tetapi nisbah token input/output sebenar anda hampir pasti bukan 3:1 — tugas ringkasan mungkin 10:1, tugas penjanaan kod lebih hampir kepada 1:2. Kedudukan campuran di atas ialah titik permulaan yang munasabah untuk memilih calon untuk diuji, bukan pengganti bagi pengiraan kos spesifik anda.
Untuk itu, gunakan terus Kalkulator Harga API LLM: masukkan kiraan token input dan output sebenar anda dan ia mengira kos tepat bagi mana-mana daripada 19 model ini, berserta anggaran bulanan jika anda tahu lebih kurang berapa banyak permintaan yang akan dibuat. Jika anda belum tahu kiraan token anda, alat Token Counter memberi anda angka sebenar daripada prom sebenar, bukan tekaan kasar. Kedua-duanya berjalan sepenuhnya dalam pelayar anda — tiada kunci API, tiada akaun, tiada apa yang dimuat naik.