
La API de LLM más barata en 2026: comparativa completa de precios, 19 modelos
Publicado el 25 jul 2026
Si eliges una API de LLM basándote solo en el coste, la diferencia es mayor de lo que la mayoría espera. Comparando los 19 modelos que rastrea la Calculadora de precios de API LLM de este sitio — OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot/Kimi, Zhipu/GLM y xAI — el modelo más barato y el más caro difieren en más de 60 veces sobre una base comparable. Esa diferencia importa mucho más que el logotipo del proveedor al que estés acostumbrado.
La clasificación
Para comparar de forma justa, cada modelo de abajo se puntúa con una tarifa combinada: 750.000 tokens de entrada + 250.000 tokens de salida por cada 1M de tokens totales, lo que se aproxima a una solicitud típica de tipo chat donde la respuesta es más corta que el prompt. Los precios son por 1M de tokens, verificados contra la página de precios oficial de cada proveedor.
| Puesto | Modelo | Proveedor | Entrada | Salida | Combinado (3:1) |
|---|---|---|---|---|---|
| 1 | Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.175 | |
| 1 | DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | $0.175 |
| 3 | Qwen3.6 Flash | Qwen | $0.19 | $1.13 | $0.42 |
| 4 | GPT-5.4 Nano | OpenAI | $0.20 | $1.25 | $0.46 |
| 5 | DeepSeek V4 Pro | DeepSeek | $0.44 | $0.87 | $0.54 |
| 6 | Grok Code Fast 1 | xAI | $1.00 | $2.00 | $1.25 |
| 7 | GPT-5.4 Mini | OpenAI | $0.75 | $4.50 | $1.69 |
| 8 | Claude Haiku 4.5 | Anthropic | $1.00 | $5.00 | $2.00 |
| 9 | GLM-5.2 | Zhipu | $1.40 | $4.40 | $2.15 |
| 10 | GPT-5.6 Luna | OpenAI | $1.00 | $6.00 | $2.25 |
| 11 | Grok 4.5 | xAI | $2.00 | $6.00 | $3.00 |
| 12 | Gemini 3.5 Flash | $1.50 | $9.00 | $3.38 | |
| 13 | Qwen3.7 Max | Qwen | $2.50 | $7.50 | $3.75 |
| 14 | Claude Sonnet 5 | Anthropic | $2.00 | $10.00 | $4.00 |
| 15 | Gemini 3.1 Pro Preview | $2.00 | $12.00 | $4.50 | |
| 16 | GPT-5.6 Terra | OpenAI | $2.50 | $15.00 | $5.63 |
| 17 | Kimi K3 | Moonshot | $3.00 | $15.00 | $6.00 |
| 18 | Claude Opus 5 | Anthropic | $5.00 | $25.00 | $10.00 |
| 19 | GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | $11.25 |
Hay varias cosas que llaman la atención. Cada proveedor — no solo uno — tiene un nivel económico y un nivel insignia separados por varios múltiplos, así que “qué proveedor es más barato” es la pregunta equivocada; la correcta es “qué modelo concreto”. Segundo, los dos modelos más baratos (Gemini 2.5 Flash-Lite y DeepSeek V4 Flash) coinciden exactamente en la misma tarifa combinada pese a venir de empresas sin ninguna relación entre sí — en el extremo más bajo, los precios de gama económica han convergido en lugar de que un proveedor esté rebajando al resto del mercado.
Por qué el modelo más barato no es automáticamente la mejor opción
El precio por sí solo no te dice si un modelo es lo bastante bueno para tu tarea. Los modelos de gama económica suelen ser suficientes para clasificación, extracción, respuestas cortas y otras tareas acotadas y bien definidas — el tipo de trabajo donde la capacidad de razonamiento extra de un modelo insignia no se llega a usar. Son peor opción para razonamiento abierto, flujos de agentes largos con muchos pasos, o tareas donde una respuesta equivocada sale cara de detectar más tarde; un modelo más barato que se equivoca y necesita un reintento (o una corrección humana) puede acabar costando más que un modelo más caro que acierta a la primera.
Un punto de partida razonable: prototipa con el modelo que más conozcas y, una vez que la tarea esté bien definida, comprueba si un modelo de gama económica de la misma tabla produce un resultado aceptablemente similar — si es así, el ahorro se acumula a escala; si no lo es, la diferencia de precio no era en realidad el factor de coste determinante.
Calcular tu cifra real
Esta tabla usa una mezcla fija de 3:1 para hacer posible la clasificación, pero tu proporción real de tokens de entrada/salida casi seguro no es 3:1 — una tarea de resumen podría ser 10:1, una tarea de generación de código más cercana a 1:2. La clasificación combinada de arriba es un buen punto de partida para elegir candidatos que probar, no un sustituto de calcular tu coste específico.
Para eso, usa directamente la Calculadora de precios de API LLM: introduce tus recuentos reales de tokens de entrada y salida y calcula el coste exacto para cualquiera de estos 19 modelos, además de una estimación mensual si sabes aproximadamente cuántas solicitudes harás. Si todavía no sabes cuántos tokens usas, la herramienta Contador de tokens de IA te da el número real a partir de un prompt concreto, en lugar de una estimación aproximada. Ambas se ejecutan por completo en tu navegador — sin clave de API, sin cuenta, nada se sube a ningún sitio.