Công Cụ Này Là Gì?
API của LLM được tính phí theo token, không theo yêu cầu — và token đầu vào (prompt, thông điệp hệ thống, lịch sử chat) được tính giá khác với token đầu ra (những gì mô hình tạo ra), thường với mức chênh 4-8 lần cho đầu ra. Sự khác biệt đó khiến việc ước lượng "cái này sẽ tốn bao nhiêu" trở nên khó, đặc biệt khi so sánh các mô hình từ nhiều nhà cung cấp với bảng giá khác nhau.
Công cụ tính toán này lấy số token đầu vào và đầu ra của bạn, nhân mỗi loại với mức giá trên mỗi triệu token của mô hình đã chọn, rồi cộng lại — chính phép tính mà hệ thống thanh toán của nhà cung cấp thực hiện. Thêm khối lượng yêu cầu hàng tháng và công cụ sẽ dự báo tổng chi phí hàng tháng, hữu ích để lập ngân sách trước khi bạn cam kết dùng một mô hình trong production.
Tại Sao Nên Dùng?
- 19 mô hình từ OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu và xAI — các lựa chọn tiết kiệm, tầm trung và cao cấp, bao gồm các API mô hình Trung Quốc lớn và Grok.
- Bảng so sánh cạnh nhau xếp hạng mọi mô hình theo chi phí cho đúng số token của bạn, nên bạn không phải tính từng cái bằng tay.
- Phân tách chi phí đầu vào/đầu ra riêng biệt, vì token đầu ra được tính giá cao hơn nhiều lần so với token đầu vào ở mọi nhà cung cấp.
- Tùy chọn khối lượng yêu cầu hàng tháng để có dự báo ngân sách nhanh, không chỉ ước tính cho một yêu cầu đơn lẻ.
- Giá được xác minh trực tiếp với tài liệu nhà cung cấp, kèm ngày xác minh hiển thị — không phải thu thập tự động hay ước lượng.
- 100% cục bộ — không cần API key, không cần tài khoản, không có dữ liệu nào rời khỏi trình duyệt của bạn.
Cách Sử Dụng
- Chọn một mô hình từ danh sách xổ xuống, được nhóm theo nhà cung cấp (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
- Nhập số token đầu vào (prompt + thông điệp hệ thống + ngữ cảnh) và số token đầu ra dự kiến.
- Đọc chi phí cho mỗi yêu cầu, chia thành chi phí đầu vào và chi phí đầu ra.
- Tùy chọn nhập số yêu cầu mỗi tháng để xem chi phí hàng tháng ước tính.
- Cuộn xuống bảng so sánh để xem mọi mô hình được xếp hạng theo chi phí cho cùng số token.
Ví dụ
Đầu vào
GPT-5.6 Terra, 1.000 token đầu vào, 500 token đầu raĐầu ra
Chi phí đầu vào $0,0025 + chi phí đầu ra $0,0075 = $0,01 mỗi yêu cầuVới 10.000 yêu cầu/tháng, con số đó là khoảng $100/tháng — chi phí nhỏ trên mỗi yêu cầu cộng dồn rất nhanh ở quy mô lớn, đó chính xác là lý do việc kiểm tra phép tính trước khi chọn mô hình lại quan trọng.
Hiểu về chi phí đầu vào so với đầu ra
Mọi mô hình trong danh sách này định giá token đầu vào và đầu ra riêng biệt, và khoảng cách giữa chúng lớn và nhất quán giữa các nhà cung cấp — đầu ra thường tốn gấp 5-6 lần mỗi token so với đầu vào. Điều đó nghĩa là một phản hồi mô hình dài dòng, nhiều lời tốn kém không tương xứng hơn một prompt dài với câu trả lời ngắn, ngay cả khi tổng số token trông tương tự.
Ứng dụng thực tế: nếu bạn đang tối ưu chi tiêu API, việc cắt giảm độ dài đầu ra (hướng dẫn system-prompt ngắn hơn như "trả lời trong một đoạn văn") thường tiết kiệm nhiều hơn cắt giảm đầu vào, tính theo từng token.
Chi phí hàng tháng ước lượng theo mô hình sử dụng
Đây là các ví dụ minh họa, không phải báo giá — hãy dùng công cụ tính toán ở trên với số token và lựa chọn mô hình của riêng bạn để có con số chính xác.
| Mô hình sử dụng | Token/yêu cầu điển hình | Mô hình ví dụ | Chi phí hàng tháng ước lượng (10k yêu cầu) |
|---|---|---|---|
| Trả lời chatbot ngắn | 300 vào / 150 ra | GPT-5.4 Nano | ≈ $2-3/tháng |
| Gán nhãn & phân loại dữ liệu | 500 vào / 50 ra | DeepSeek V4 Flash | ≈ $1/tháng |
| Tóm tắt tài liệu | 3.000 vào / 400 ra | Claude Sonnet 5 | ≈ $100/tháng |
| Trợ lý tạo code | 1.500 vào / 1.000 ra | Gemini 3.5 Flash | ≈ $110-115/tháng |
| Soạn nội dung dài | 1.000 vào / 2.500 ra | GPT-5.6 Sol | ≈ $800/tháng |
Câu Hỏi Thường Gặp
Tại sao đầu ra luôn được tính giá cao hơn nhiều so với đầu vào ở mọi mô hình?
Việc tạo token (đầu ra) đòi hỏi một lượt tính toán forward pass đầy đủ qua mô hình cho mỗi token mới, chạy tuần tự, trong khi xử lý token đầu vào (prompt) có thể được thực hiện song song trong một lô duy nhất. Chi phí tính toán bất đối xứng đó là lý do mọi nhà cung cấp lớn định giá đầu ra ở mức khoảng 4-8 lần giá đầu vào.
Làm sao tôi biết prompt của mình sẽ dùng bao nhiêu token?
Dùng công cụ Token Counter của CodeKitHub — dán prompt hoặc thông điệp hệ thống thực tế của bạn và nó hiển thị số token chính xác bằng tokenizer thật, thay vì ước lượng thô dựa trên số ký tự. Số token đầu ra khó dự đoán trước hơn; một cách tiếp cận hợp lý là kiểm tra mức sử dụng thực tế từ vài phản hồi API thật và dùng đó làm ước tính.
Các mức giá này có được đảm bảo là mới nhất không?
Không — giá API của các nhà cung cấp AI thay đổi khá thường xuyên, đôi khi ít thông báo trước. Giá trong công cụ này đã được xác minh trực tiếp với trang giá chính thức của từng nhà cung cấp vào ngày hiển thị gần công cụ tính toán. Trước khi lập ngân sách hoặc quyết định mua, hãy tự kiểm tra trang hiện tại: giá OpenAI (developers.openai.com/api/docs/pricing), giá Anthropic/Claude (platform.claude.com/docs/en/about-claude/pricing), và giá Google Gemini (ai.google.dev/gemini-api/docs/pricing).
Tại sao mô hình yêu thích của tôi không có trong danh sách?
Công cụ này bao gồm một phổ đại diện tiết kiệm/tầm trung/cao cấp từ OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu và xAI (tổng cộng 19 mô hình) thay vì mọi mô hình mỗi nhà cung cấp có, để giữ danh sách dễ xem và dữ liệu giá dễ cập nhật chính xác. Nếu bạn cần một mô hình không có trong danh sách, hãy kiểm tra giá trên mỗi 1 triệu token trên trang của nhà cung cấp và tự tính chi phí đầu vào + chi phí đầu ra tương tự.
Giá của Gemini 3.1 Pro Preview có tính đến prompt dài không?
Không — giá hiển thị là mức giá cho tầng ≤200.000 token của Google. Giá của Gemini tăng lên với prompt dài hơn ngưỡng đó, và công cụ tính toán này không mô hình hóa mức phụ phí đó, để giữ công cụ đơn giản. Nếu prompt của bạn thường xuyên vượt quá 200k token, hãy kiểm tra trang giá của Google để biết mức giá ngữ cảnh dài chính xác.
Giá của DeepSeek, Qwen, Kimi và GLM có tính bằng USD không?
Có — mọi mức giá trong công cụ này, kể cả các mô hình Trung Quốc, đều là mức giá API quốc tế chính thức tính bằng USD, để mọi mô hình có thể được so sánh trên cùng cơ sở. Một số nhà cung cấp này cũng có bảng điều khiển tính phí bằng CNY cho tài khoản tại Trung Quốc đại lục với mức giá khác (thường thấp hơn); hãy kiểm tra bảng điều khiển riêng của nhà cung cấp nếu bạn thanh toán bằng CNY.