CodeKitHub
Español
Herramientas de IA

Calculadora de precios de API LLM

Elige un modelo, introduce tus tokens de entrada y salida, y verás el coste exacto por solicitud — además de un coste mensual estimado si sabes aproximadamente cuántas solicitudes harás. Una tabla comparativa debajo ordena los 19 modelos por coste para el mismo número de tokens, así ves de un vistazo si GPT, Claude, Gemini, DeepSeek, Qwen, Kimi, GLM o Grok es el más barato para tu caso. Cubre los modelos actuales de OpenAI, Anthropic, Google, DeepSeek, Qwen (Alibaba), Moonshot (Kimi), Zhipu (GLM) y xAI (Grok), con precios verificados directamente en la página oficial de cada proveedor. Todo funciona localmente en tu navegador.

Precios verificados el: 25 de julio de 2026

Los precios de las API de IA cambian con frecuencia; estas cifras son solo orientativas — consulta la página de precios oficial del proveedor antes de tomar decisiones de presupuesto o compra.

¿Qué es esta herramienta?

Las API de LLM se facturan por token, no por solicitud — y los tokens de entrada (tu prompt, mensaje de sistema, historial de chat) tienen un precio distinto al de los tokens de salida (lo que genera el modelo), normalmente con un recargo de 4 a 8 veces en la salida. Esa división hace que calcular «cuánto va a costar esto» a ojo sea complicado, sobre todo al comparar modelos de distintos proveedores con tarifas diferentes.

Esta calculadora toma tus tokens de entrada y salida, multiplica cada uno por la tarifa por millón de tokens del modelo elegido, y los suma — el mismo cálculo que hace el sistema de facturación del proveedor. Si añades un volumen mensual de solicitudes, proyecta un total mensual, útil para presupuestar antes de comprometerte con un modelo en producción.

¿Por qué utilizarlo?

  • 19 modelos de OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu y xAI — opciones económicas, intermedias y de gama alta, incluyendo las principales APIs de modelos chinos y Grok.
  • Una tabla comparativa ordena todos los modelos por coste para tus tokens exactos, sin que tengas que calcular cada uno a mano.
  • Desglose separado de coste de entrada/salida, ya que los tokens de salida cuestan varias veces más que los de entrada en todos los proveedores.
  • Volumen mensual de solicitudes opcional para una proyección de presupuesto rápida, no solo una estimación de una sola solicitud.
  • Precios verificados directamente en la documentación del proveedor, con la fecha de verificación indicada — no extraídos ni estimados.
  • 100% local — sin clave de API, sin cuenta, ningún dato sale de tu navegador.

Cómo utilizarlo

  1. Selecciona un modelo en el desplegable, agrupado por proveedor (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
  2. Introduce tu número de tokens de entrada (prompt + mensaje de sistema + contexto) y el número esperado de tokens de salida.
  3. Consulta el coste por solicitud, dividido en coste de entrada y coste de salida.
  4. Opcionalmente, introduce solicitudes al mes para ver un coste mensual estimado.
  5. Desplázate hasta la tabla comparativa para ver todos los modelos ordenados por coste con los mismos tokens.

Ejemplo

Entrada

GPT-5.6 Terra, 1000 tokens de entrada, 500 tokens de salida

Resultado

Coste de entrada $0.0025 + coste de salida $0.0075 = $0.01 por solicitud

Con 10.000 solicitudes al mes, eso es aproximadamente $100/mes — los costes pequeños por solicitud se acumulan rápido a escala, por eso conviene hacer las cuentas antes de elegir un modelo.

Entender el coste de entrada frente al de salida

Todos los modelos de esta lista tienen precios separados para tokens de entrada y salida, y la diferencia entre ambos es grande y consistente entre proveedores — la salida suele costar 5-6 veces más por token que la entrada. Eso significa que una respuesta del modelo larga y detallada cuesta desproporcionadamente más que un prompt largo con una respuesta corta, aunque el recuento total de tokens parezca similar.

Implicación práctica: si estás optimizando el gasto en la API, recortar la longitud de la salida (instrucciones más breves en el mensaje de sistema, como «responde en un párrafo») suele ahorrar más, token por token, que recortar la entrada.

Coste mensual aproximado según el patrón de uso

Estos son ejemplos ilustrativos, no presupuestos — usa la calculadora de arriba con tus propios tokens y modelo elegido para obtener una cifra exacta.

Patrón de usoTokens típicos/solicitudModelo de ejemploCoste mensual aproximado (10.000 solicitudes)
Respuestas cortas de chatbot300 entrada / 150 salidaGPT-5.4 Nano≈ $2-3/mes
Etiquetado y clasificación de datos500 entrada / 50 salidaDeepSeek V4 Flash≈ $1/mes
Resumen de documentos3.000 entrada / 400 salidaClaude Sonnet 5≈ $100/mes
Asistente de generación de código1.500 entrada / 1.000 salidaGemini 3.5 Flash≈ $110-115/mes
Redacción de contenido extenso1.000 entrada / 2.500 salidaGPT-5.6 Sol≈ $800/mes

Preguntas frecuentes

¿Por qué la salida tiene un precio tan superior al de la entrada en todos los modelos?

Generar tokens (salida) requiere un paso completo por el modelo para cada token nuevo, ejecutado de forma secuencial, mientras que procesar los tokens de entrada (el prompt) puede hacerse en paralelo en un único lote. Esa asimetría en el coste de cómputo es la razón por la que todos los proveedores principales cobran la salida a un ritmo de aproximadamente 4-8 veces el de la entrada.

¿Cómo sé cuántos tokens usará mi prompt?

Usa el Contador de tokens de CodeKitHub — pega tu prompt o mensaje de sistema real y verás el recuento exacto de tokens con el tokenizador real, en lugar de una estimación aproximada basada en caracteres. Los tokens de salida son más difíciles de predecir de antemano; un enfoque razonable es revisar el uso real de algunas respuestas de la API y usarlo como estimación.

¿Estos precios están garantizados como actuales?

No — los precios de las API de los proveedores de IA cambian con cierta frecuencia, a veces con poco aviso. Los precios de esta herramienta se verificaron directamente en la página oficial de precios de cada proveedor en la fecha indicada junto a la calculadora. Antes de tomar una decisión de presupuesto o compra, comprueba tú mismo la página actual: precios de OpenAI (developers.openai.com/api/docs/pricing), precios de Anthropic/Claude (platform.claude.com/docs/en/about-claude/pricing) y precios de Google Gemini (ai.google.dev/gemini-api/docs/pricing).

¿Por qué no está mi modelo favorito en la lista?

Esta herramienta cubre una muestra representativa de gama económica/intermedia/alta de OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu y xAI (19 modelos en total), en lugar de todos los modelos de cada proveedor, para que la lista sea fácil de leer y los datos de precios fáciles de mantener actualizados. Si necesitas un modelo que no aparece, consulta su precio por millón de tokens en la página del proveedor y haz tú mismo el mismo cálculo de coste de entrada + coste de salida.

¿El precio de Gemini 3.1 Pro Preview tiene en cuenta los prompts largos?

No — el precio mostrado corresponde al tramo de ≤200.000 tokens de Google. La tarifa de Gemini sube para prompts más largos que ese umbral, y esta calculadora no incluye ese nivel de recargo, para mantener la herramienta sencilla. Si tus prompts suelen superar los 200k tokens, consulta la página de precios de Google para la tarifa exacta de contexto largo.

¿Los precios de DeepSeek, Qwen, Kimi y GLM están en dólares?

Sí — todos los precios de esta herramienta, incluidos los modelos chinos, corresponden a la tarifa oficial de la API internacional en dólares, así todos los modelos se pueden comparar con la misma base. Algunos de estos proveedores también ofrecen consolas facturadas en yuanes para cuentas de China continental con tarifas distintas (a menudo más bajas); consulta la consola del propio proveedor si facturas en yuanes.

Herramientas relacionadas