Calculadora de coste de IA por tokens
El coste de una API de IA se resume en cuatro números: peticiones al mes, tokens de entrada, tokens de salida y el precio del modelo. Los valores iniciales son el ejemplo de nuestro artículo sobre cómo calcular el coste de un proyecto de IA: un chatbot de soporte con 300.000 peticiones al mes. También puedes llamarlo simulador: los valores cambian a medida que mueves los controles.
Mil usuarios con diez peticiones al día son 300.000 al mes.
Pregunta, instrucciones y contexto. 1 token ≈ 0,75 palabras.
La respuesta generada.
Para picos y respuestas más largas: del 20% al 30%.
| Modelo | Input / output por millón | Coste al mes |
|---|---|---|
| Claude Fable 5.1 | $10.00 / $50.00 | 6.000 US$ |
| Claude Opus 5 | $5.00 / $25.00 | 3.000 US$ |
| Claude Sonnet 5 | $2.00 / $10.00 | 1.200 US$ |
| Claude Haiku 4.5 | $1.00 / $5.00 | 600 US$ |
| GPT-5.5 | $5.00 / $30.00 | 3.450 US$ |
| GPT-5.6 sol | $4.00 / $20.00 | 2.400 US$ |
| GPT-5.4 | $2.50 / $15.00 | 1.725 US$ |
| GPT-5.6 terra | $2.00 / $12.00 | 1.380 US$ |
| GPT-5.4 nano | $0.20 / $1.25 | 143 US$ |
| GPT-5.6 luna | $0.20 / $1.20 | 138 US$ |
| Gemini 3.1 Pro | $2.00 / $12.00 | 1.380 US$ |
| Gemini 3.5 Flash | $1.50 / $9.00 | 1.035 US$ |
| Gemini 3.8 Flash | $0.75 / $3.75 | 450 US$ |
| Gemini 2.5 Flash-Lite | $0.10 / $0.40 | 51,00 US$ |
Precios de tarifa en dólares, sin descuentos de caching (hasta el 90%) ni batch (50%), comprobados en las páginas oficiales de los proveedores el 16 de septiembre de 2026 (enlaces en Fuentes). Cambian a menudo: confírmalos siempre antes de decidir.
Estimación orientativa: los valores reales dependen de tu proceso y de tus datos.
Cómo se calcula
Coste al mes = peticiones × (tokens de entrada × precio de entrada + tokens de salida × precio de salida) ÷ 1.000.000.
Los precios son por millón de tokens y el de salida es casi siempre unas cinco veces el de entrada. Por eso la respuesta pesa más en la factura que la pregunta, aunque tenga menos tokens.
El margen de seguridad cubre variaciones de uso, conversaciones largas y respuestas más largas de lo previsto. En una propuesta, presenta siempre un rango y el volumen en el que se basa.
Fuentes
Preguntas frecuentes
¿Qué es un token?
Es la unidad con la que los modelos leen y escriben texto. De media, un token corresponde a unas 0,75 palabras, y un millón de tokens a unas 750.000 palabras.
¿Cómo reduzco el coste sin perder calidad?
La mayor palanca es elegir el modelo adecuado para cada tarea: las tareas sencillas rara vez necesitan la gama alta. Después, prompt caching para el contexto repetido, batch para lo que no necesita respuesta inmediata y límites a la longitud de las respuestas.
¿Por qué el mismo volumen cuesta tan distinto según el modelo?
Porque el precio por token varía más de cien veces entre el modelo más barato y el más caro. Dentro de un mismo proveedor, la diferencia entre modelos pesa más que la diferencia entre proveedores.
Los precios están en dólares. ¿Cuánto es en euros?
Los proveedores facturan en dólares. Convierte al cambio del día; como los precios y el cambio varían, trata el resultado como una estimación y no como un presupuesto.
¿Esto es una calculadora o un simulador?
Es lo mismo: cambias los valores y ves el resultado al momento, sin instalar nada ni dejar tus datos. Si buscabas un simulador de costes de IA, es esto.
- Cómo calcular el coste de un proyecto de IA basado en tokens
- ¿Cuánto cuesta usar la API de IA en 2026: comparación de precios (OpenAI, Claude y Gemini)
- Cuánto cuesta la IA por caso de uso real: chatbot, código, documentos y contenido
- Cómo reducir los costes de tokens en tu aplicación de IA: 8 estrategias
Otras calculadoras
¿Quieres ayuda para ponerlo en práctica?
En una evaluación gratuita de 30 minutos miramos tu operación y te mostramos dónde está el mayor retorno.
Solicitar evaluación gratuita