¿Qué es esta herramienta?
Las API de LLM se facturan por token, no por solicitud — y los tokens de entrada (tu prompt, mensaje de sistema, historial de chat) tienen un precio distinto al de los tokens de salida (lo que genera el modelo), normalmente con un recargo de 4 a 8 veces en la salida. Esa división hace que calcular «cuánto va a costar esto» a ojo sea complicado, sobre todo al comparar modelos de distintos proveedores con tarifas diferentes.
Esta calculadora toma tus tokens de entrada y salida, multiplica cada uno por la tarifa por millón de tokens del modelo elegido, y los suma — el mismo cálculo que hace el sistema de facturación del proveedor. Si añades un volumen mensual de solicitudes, proyecta un total mensual, útil para presupuestar antes de comprometerte con un modelo en producción.
¿Por qué utilizarlo?
- 19 modelos de OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu y xAI — opciones económicas, intermedias y de gama alta, incluyendo las principales APIs de modelos chinos y Grok.
- Una tabla comparativa ordena todos los modelos por coste para tus tokens exactos, sin que tengas que calcular cada uno a mano.
- Desglose separado de coste de entrada/salida, ya que los tokens de salida cuestan varias veces más que los de entrada en todos los proveedores.
- Volumen mensual de solicitudes opcional para una proyección de presupuesto rápida, no solo una estimación de una sola solicitud.
- Precios verificados directamente en la documentación del proveedor, con la fecha de verificación indicada — no extraídos ni estimados.
- 100% local — sin clave de API, sin cuenta, ningún dato sale de tu navegador.
Cómo utilizarlo
- Selecciona un modelo en el desplegable, agrupado por proveedor (OpenAI / Anthropic / Google / DeepSeek / Qwen / Moonshot / Zhipu / xAI).
- Introduce tu número de tokens de entrada (prompt + mensaje de sistema + contexto) y el número esperado de tokens de salida.
- Consulta el coste por solicitud, dividido en coste de entrada y coste de salida.
- Opcionalmente, introduce solicitudes al mes para ver un coste mensual estimado.
- Desplázate hasta la tabla comparativa para ver todos los modelos ordenados por coste con los mismos tokens.
Ejemplo
Entrada
GPT-5.6 Terra, 1000 tokens de entrada, 500 tokens de salidaResultado
Coste de entrada $0.0025 + coste de salida $0.0075 = $0.01 por solicitudCon 10.000 solicitudes al mes, eso es aproximadamente $100/mes — los costes pequeños por solicitud se acumulan rápido a escala, por eso conviene hacer las cuentas antes de elegir un modelo.
Entender el coste de entrada frente al de salida
Todos los modelos de esta lista tienen precios separados para tokens de entrada y salida, y la diferencia entre ambos es grande y consistente entre proveedores — la salida suele costar 5-6 veces más por token que la entrada. Eso significa que una respuesta del modelo larga y detallada cuesta desproporcionadamente más que un prompt largo con una respuesta corta, aunque el recuento total de tokens parezca similar.
Implicación práctica: si estás optimizando el gasto en la API, recortar la longitud de la salida (instrucciones más breves en el mensaje de sistema, como «responde en un párrafo») suele ahorrar más, token por token, que recortar la entrada.
Coste mensual aproximado según el patrón de uso
Estos son ejemplos ilustrativos, no presupuestos — usa la calculadora de arriba con tus propios tokens y modelo elegido para obtener una cifra exacta.
| Patrón de uso | Tokens típicos/solicitud | Modelo de ejemplo | Coste mensual aproximado (10.000 solicitudes) |
|---|---|---|---|
| Respuestas cortas de chatbot | 300 entrada / 150 salida | GPT-5.4 Nano | ≈ $2-3/mes |
| Etiquetado y clasificación de datos | 500 entrada / 50 salida | DeepSeek V4 Flash | ≈ $1/mes |
| Resumen de documentos | 3.000 entrada / 400 salida | Claude Sonnet 5 | ≈ $100/mes |
| Asistente de generación de código | 1.500 entrada / 1.000 salida | Gemini 3.5 Flash | ≈ $110-115/mes |
| Redacción de contenido extenso | 1.000 entrada / 2.500 salida | GPT-5.6 Sol | ≈ $800/mes |
Preguntas frecuentes
¿Por qué la salida tiene un precio tan superior al de la entrada en todos los modelos?
Generar tokens (salida) requiere un paso completo por el modelo para cada token nuevo, ejecutado de forma secuencial, mientras que procesar los tokens de entrada (el prompt) puede hacerse en paralelo en un único lote. Esa asimetría en el coste de cómputo es la razón por la que todos los proveedores principales cobran la salida a un ritmo de aproximadamente 4-8 veces el de la entrada.
¿Cómo sé cuántos tokens usará mi prompt?
Usa el Contador de tokens de CodeKitHub — pega tu prompt o mensaje de sistema real y verás el recuento exacto de tokens con el tokenizador real, en lugar de una estimación aproximada basada en caracteres. Los tokens de salida son más difíciles de predecir de antemano; un enfoque razonable es revisar el uso real de algunas respuestas de la API y usarlo como estimación.
¿Estos precios están garantizados como actuales?
No — los precios de las API de los proveedores de IA cambian con cierta frecuencia, a veces con poco aviso. Los precios de esta herramienta se verificaron directamente en la página oficial de precios de cada proveedor en la fecha indicada junto a la calculadora. Antes de tomar una decisión de presupuesto o compra, comprueba tú mismo la página actual: precios de OpenAI (developers.openai.com/api/docs/pricing), precios de Anthropic/Claude (platform.claude.com/docs/en/about-claude/pricing) y precios de Google Gemini (ai.google.dev/gemini-api/docs/pricing).
¿Por qué no está mi modelo favorito en la lista?
Esta herramienta cubre una muestra representativa de gama económica/intermedia/alta de OpenAI, Anthropic, Google, DeepSeek, Qwen, Moonshot, Zhipu y xAI (19 modelos en total), en lugar de todos los modelos de cada proveedor, para que la lista sea fácil de leer y los datos de precios fáciles de mantener actualizados. Si necesitas un modelo que no aparece, consulta su precio por millón de tokens en la página del proveedor y haz tú mismo el mismo cálculo de coste de entrada + coste de salida.
¿El precio de Gemini 3.1 Pro Preview tiene en cuenta los prompts largos?
No — el precio mostrado corresponde al tramo de ≤200.000 tokens de Google. La tarifa de Gemini sube para prompts más largos que ese umbral, y esta calculadora no incluye ese nivel de recargo, para mantener la herramienta sencilla. Si tus prompts suelen superar los 200k tokens, consulta la página de precios de Google para la tarifa exacta de contexto largo.
¿Los precios de DeepSeek, Qwen, Kimi y GLM están en dólares?
Sí — todos los precios de esta herramienta, incluidos los modelos chinos, corresponden a la tarifa oficial de la API internacional en dólares, así todos los modelos se pueden comparar con la misma base. Algunos de estos proveedores también ofrecen consolas facturadas en yuanes para cuentas de China continental con tarifas distintas (a menudo más bajas); consulta la consola del propio proveedor si facturas en yuanes.