
API LLM rẻ nhất năm 2026: so sánh giá đầy đủ, 19 mô hình
Đăng ngày 25 thg 7, 2026
Nếu bạn chọn API LLM chỉ dựa trên chi phí, khoảng cách giá lớn hơn nhiều so với hầu hết mọi người nghĩ. So sánh toàn bộ 19 mô hình mà Công cụ tính giá API LLM của trang này theo dõi — OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot/Kimi, Zhipu/GLM và xAI — mô hình rẻ nhất và đắt nhất chênh nhau hơn 60 lần trên cùng một cơ sở so sánh. Khoảng cách này quan trọng hơn nhiều so với việc bạn quen dùng logo của hãng nào.
Bảng xếp hạng
Để so sánh công bằng, mỗi mô hình dưới đây được tính theo tỷ lệ trung bình (blended): 750.000 token đầu vào + 250.000 token đầu ra trên mỗi 1 triệu token tổng, gần đúng với một yêu cầu chat điển hình mà câu trả lời ngắn hơn câu hỏi. Giá tính trên 1 triệu token, đã được đối chiếu với trang giá chính thức của từng nhà cung cấp.
| Hạng | Mô hình | Nhà cung cấp | Đầu vào | Đầu ra | Trung bình (3:1) |
|---|---|---|---|---|---|
| 1 | Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.175 | |
| 1 | DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | $0.175 |
| 3 | Qwen3.6 Flash | Qwen | $0.19 | $1.13 | $0.42 |
| 4 | GPT-5.4 Nano | OpenAI | $0.20 | $1.25 | $0.46 |
| 5 | DeepSeek V4 Pro | DeepSeek | $0.44 | $0.87 | $0.54 |
| 6 | Grok Code Fast 1 | xAI | $1.00 | $2.00 | $1.25 |
| 7 | GPT-5.4 Mini | OpenAI | $0.75 | $4.50 | $1.69 |
| 8 | Claude Haiku 4.5 | Anthropic | $1.00 | $5.00 | $2.00 |
| 9 | GLM-5.2 | Zhipu | $1.40 | $4.40 | $2.15 |
| 10 | GPT-5.6 Luna | OpenAI | $1.00 | $6.00 | $2.25 |
| 11 | Grok 4.5 | xAI | $2.00 | $6.00 | $3.00 |
| 12 | Gemini 3.5 Flash | $1.50 | $9.00 | $3.38 | |
| 13 | Qwen3.7 Max | Qwen | $2.50 | $7.50 | $3.75 |
| 14 | Claude Sonnet 5 | Anthropic | $2.00 | $10.00 | $4.00 |
| 15 | Gemini 3.1 Pro Preview | $2.00 | $12.00 | $4.50 | |
| 16 | GPT-5.6 Terra | OpenAI | $2.50 | $15.00 | $5.63 |
| 17 | Kimi K3 | Moonshot | $3.00 | $15.00 | $6.00 |
| 18 | Claude Opus 5 | Anthropic | $5.00 | $25.00 | $10.00 |
| 19 | GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | $11.25 |
Có vài điểm đáng chú ý. Mỗi nhà cung cấp — không chỉ riêng một hãng — đều có cả gói giá rẻ và gói cao cấp (flagship) chênh nhau nhiều lần, nên câu hỏi “nhà cung cấp nào rẻ nhất” là sai trọng tâm; câu hỏi đúng phải là “mô hình cụ thể nào”. Thứ hai, hai mô hình rẻ nhất (Gemini 2.5 Flash-Lite và DeepSeek V4 Flash) có mức giá trung bình bằng nhau tuyệt đối dù đến từ hai công ty không liên quan gì đến nhau — ở phân khúc thấp nhất, giá của gói giá rẻ đã hội tụ về cùng một mức chứ không phải do một hãng cố tình phá giá.
Vì sao mô hình rẻ nhất chưa chắc là lựa chọn đúng
Giá cả không nói lên được liệu một mô hình có đủ tốt cho công việc của bạn hay không. Các mô hình giá rẻ thường phù hợp với phân loại, trích xuất dữ liệu, trả lời ngắn và những công việc hẹp, đã được định nghĩa rõ ràng — loại việc mà khả năng suy luận nâng cao của mô hình cao cấp gần như không dùng đến. Chúng kém phù hợp hơn với suy luận mở, các quy trình agent nhiều bước phức tạp, hoặc những tác vụ mà một câu trả lời sai sẽ tốn kém để phát hiện và sửa sau này; một mô hình rẻ làm sai và cần thử lại (hoặc phải sửa thủ công) có thể cuối cùng tốn kém hơn một mô hình đắt nhưng làm đúng ngay từ đầu.
Một cách mặc định hợp lý: dựng bản thử nghiệm với mô hình bạn quen thuộc nhất, sau đó khi công việc đã được định nghĩa rõ ràng, thử xem một mô hình giá rẻ trong cùng bảng trên có cho ra kết quả tương đương hay không — nếu có, khoản tiết kiệm sẽ cộng dồn đáng kể khi mở rộng quy mô; nếu không, thì chênh lệch giá vốn không phải là yếu tố chi phí thực sự.
Tính con số thực tế cho trường hợp của bạn
Bảng này dùng tỷ lệ trung bình cố định 3:1 để có thể xếp hạng, nhưng tỷ lệ token đầu vào/đầu ra thực tế của bạn gần như chắc chắn không phải 3:1 — một tác vụ tóm tắt có thể là 10:1, một tác vụ tạo mã có thể gần 1:2. Bảng xếp hạng trung bình ở trên là điểm khởi đầu hợp lý để chọn ra các ứng viên cần thử nghiệm, chứ không thay thế cho việc tính chi phí cụ thể của riêng bạn.
Để làm điều đó, hãy dùng trực tiếp Công cụ tính giá API LLM: nhập số token đầu vào và đầu ra thực tế, công cụ sẽ tính chính xác chi phí cho bất kỳ mô hình nào trong số 19 mô hình này, cùng với ước tính chi phí hàng tháng nếu bạn biết sơ bộ số lượng yêu cầu sẽ thực hiện. Nếu chưa biết số token của mình, công cụ Token Counter cho bạn con số thực tế từ một prompt cụ thể, thay vì chỉ là ước lượng sơ sài. Cả hai công cụ đều chạy hoàn toàn trong trình duyệt của bạn — không cần API key, không cần tài khoản, không có gì được tải lên máy chủ.