¿Qué es un token en IA y por qué es la unidad que define tu coste?
Si ya has mirado la factura de una API de IA o la tabla de precios de ChatGPT, Claude o Gemini, habrás visto la misma expresión repetida: por millón de tokens. El token es la unidad que está detrás de casi todo lo que pagas cuando usas inteligencia artificial. Entenderlo es el primer paso para controlar los costes en lugar de llevarse sustos a final de mes.
Este artículo explica qué es un token, cómo se cuenta y por qué esta unidad aparentemente técnica determina directamente cuánto gastas.
Qué es un token, al fin y al cabo
Un token es un pedazo de texto que el modelo procesa cada vez. No es una palabra ni una letra, es algo intermedio: un subconjunto de caracteres que el modelo usa internamente para leer y generar lenguaje.
En la práctica, la regla aproximada es simple: un token equivale a aproximadamente cuatro caracteres en inglés, o aproximadamente 0,75 palabras. Dicho de otra forma, un millón de tokens corresponde a unas 750 mil palabras. Una palabra corta puede ser un solo token, una palabra larga o poco frecuente puede dividirse en dos o tres.
Por qué el texto se divide así
Los modelos de lenguaje no leen palabras enteras como nosotros. Trabajan con un vocabulario fijo de tokens y convierten todo el texto a esa moneda interna antes de procesarlo. Esta división les permite manejar cualquier palabra, incluyendo nombres propios, código o términos que nunca han visto, construyéndolos a partir de pedazos conocidos.
Por eso el recuento de tokens varía con el idioma y con el tipo de texto. El español tiende a generar más tokens que el inglés para la misma idea, y el texto con muchos símbolos, números o código suele ser más pesado en tokens que la prosa simple.
Input y output: dos tipos de token
Esta es la distinción más importante para tu bolsillo. Cuando usas una API de IA, pagas dos tipos de token:
- Tokens de input. Todo lo que envías al modelo: tu pregunta, las instrucciones del sistema y cualquier contexto que añades, como documentos o historial de conversación.
- Tokens de output. Todo lo que el modelo genera en respuesta.
Y aquí está el detalle que pilla a mucha gente desprevenida: el output casi siempre cuesta más caro que el input. En la mayoría de los modelos actuales, la relación es de aproximadamente cinco a uno. Es decir, generar texto sale más caro que enviarlo.
Por qué esto define tu coste
La factura de una API de IA es, en su esencia, una multiplicación simple:
(tokens de input × precio del input) + (tokens de output × precio del output)
Todo lo que aumenta el recuento de tokens aumenta la cuenta. Prompts largos, historiales de conversación que crecen con cada turno, documentos grandes enviados como contexto, respuestas extensas. En una única llamada el valor es minúsculo, pero una aplicación con miles de usuarios procesa cientos de millones de tokens al mes, y ahí cada token cuenta.
Es por eso que los equipos que usan IA en producción hablan de tokens constantemente. No es obsesión técnica, es gestión de costes. Quien entiende la unidad, entiende dónde está gastando y dónde puede ahorrar.
Lo que esto significa en la práctica
Tres conclusiones útiles que puedes sacar de aquí:
- Prompts más cortos y directos cuestan menos. Cada palabra extra en el input es dinero.
- Respuestas más largas cuestan más, y cuestan el doble. Limitar el tamaño del output, cuando tiene sentido, tiene un impacto directo.
- La elección del modelo es el mayor factor. El precio por token varía enormemente entre modelos, y usar el modelo adecuado para cada tarea es la palanca más poderosa de todas.
Conclusión
El token es la moneda de la inteligencia artificial. Todo lo que envías y todo lo que recibes se convierte en esta unidad, y es por ella que pagas. Comprender qué es un token, la diferencia entre input y output y cómo aumenta el recuento es la base para usar IA de forma sostenible, sin que el coste se convierta en una sorpresa.
En los próximos pasos vale la pena entender cómo se comparan los precios entre proveedores y qué estrategias existen para reducir el consumo de tokens sin perder calidad.

Escribe sobre IA aplicada, operación, GEO/SEO y cómo transformar empresas en máquinas que siguen funcionando incluso cuando nadie mira.
