"¿Y esto cuánto me va a costar al mes?" Es la primera pregunta de cualquier directivo cuando le proponen automatizar algo con inteligencia artificial, y es notablemente difícil de responder — porque la industria cobra en una unidad que nadie de fuera entiende: el token.
Esta guía traduce esa unidad a pesos y a decisiones. Al final vas a poder estimar tú mismo el costo mensual de cualquier proceso antes de aprobarlo.
Qué es un token (en dos líneas)
Un token es el pedacito de texto con el que el modelo cuenta su trabajo: aproximadamente tres cuartas partes de una palabra en español. Las cifras que necesitas memorizar:
- 1,000 tokens ≈ 750 palabras ≈ página y media
- 10,000 tokens ≈ un documento de 15 páginas
- 100,000 tokens ≈ un libro corto
Y el detalle que cambia todo: se cobran por separado los tokens que entran y los que salen, y los de salida cuestan alrededor de cinco veces más.
La tabla de precios de 2026
Precios por millón de tokens en la familia de Claude, que sirve como referencia de mercado (las otras casas se mueven en rangos parecidos):
| Modelo | Entrada | Salida | Para qué |
|---|---|---|---|
| Haiku 4.5 | 1 USD | 5 USD | Volumen enorme, tareas triviales |
| Sonnet 5 | 3 USD (2 hasta el 31 de agosto) | 15 USD (10 hasta el 31 de agosto) | El caballo de batalla diario |
| Opus 5 | 5 USD | 25 USD | Criterio, análisis, riesgo alto |
| Fable 5 | 10 USD | 50 USD | Lo más difícil que existe |
Lo primero que salta a la vista: entre el más barato y el más caro hay un factor de diez. Esa es la razón por la que asignar el modelo correcto a cada tarea no es optimización fina, es la decisión de costo principal del proyecto. Lo desarrollamos paso a paso en cómo elegir el modelo de IA correcto para cada tarea.
Cómo calcular tu caso: la fórmula
Costo mensual =
(tokens de entrada por tarea × tareas al mes × precio de entrada / 1,000,000)
+ (tokens de salida por tarea × tareas al mes × precio de salida / 1,000,000)
Suena peor de lo que es. Tres ejemplos reales para que la uses de plantilla.
Ejemplo 1: análisis de contratos
Un despacho revisa 40 contratos al mes, de unas 30 páginas cada uno (≈ 20,000 tokens de entrada), y pide un resumen de riesgos de dos páginas (≈ 1,300 tokens de salida).
| Con Sonnet 5 | Con Opus 5 | |
|---|---|---|
| Entrada (800,000 tokens) | 2.40 USD | 4.00 USD |
| Salida (52,000 tokens) | 0.78 USD | 1.30 USD |
| Total mensual | ≈ 3.20 USD | ≈ 5.30 USD |
Sí, leíste bien: menos de seis dólares al mes. Para tareas de bajo volumen y alto valor, el costo del modelo es prácticamente irrelevante — y discutir si usar el modelo caro o el barato es perder el tiempo. Usa el caro.
Ejemplo 2: clasificación de correos de soporte
Una empresa clasifica 1,500 correos al mes (≈ 400 tokens de entrada cada uno) y solo necesita la categoría de vuelta (≈ 20 tokens de salida).
| Con Haiku 4.5 | Con Opus 5 | |
|---|---|---|
| Entrada (600,000 tokens) | 0.60 USD | 3.00 USD |
| Salida (30,000 tokens) | 0.15 USD | 0.75 USD |
| Total mensual | ≈ 0.75 USD | ≈ 3.75 USD |
Diferencia de cinco veces sobre cifras pequeñas. Ahora multiplica el volumen por cien —una operación grande clasificando 150,000 mensajes al mes— y la diferencia es de 75 contra 375 dólares. Ahí sí importa.
Ejemplo 3: el que sí duele
Un proceso automatizado que revisa el catálogo completo de productos cada noche: 300,000 tokens de entrada por corrida, 30 corridas al mes, y genera un reporte de 20,000 tokens.
| Con Sonnet 5 | Con Fable 5 | |
|---|---|---|
| Entrada (9 millones de tokens) | 27 USD | 90 USD |
| Salida (600,000 tokens) | 9 USD | 30 USD |
| Total mensual | ≈ 36 USD | ≈ 120 USD |
Y este es el caso donde el caché de prompts cambia la ecuación por completo.
Las tres palancas de ahorro que sí funcionan
1. Caché de prompts (hasta 90% de descuento en la parte repetida). Si tus peticiones empiezan siempre con el mismo bloque de texto —el catálogo, el manual de la empresa, las instrucciones largas—, el proveedor lo guarda y te cobra alrededor de una décima parte en las siguientes peticiones. En el ejemplo 3, si los 300,000 tokens del catálogo son idénticos cada noche, la factura se desploma. Se activa con una opción de configuración, sin rediseñar nada.
2. La escalera de modelos. Un modelo barato filtra y clasifica; solo lo que realmente lo necesita sube al modelo caro. En operaciones de volumen alto es la diferencia entre un proyecto rentable y uno que se cancela al ver la primera factura.
3. Respuestas cortas. Como la salida cuesta cinco veces más, pedir "las tres conclusiones en viñetas" en vez de "un análisis completo" recorta la porción cara de la factura sin perder valor de negocio. La mayoría de las respuestas largas que produce una IA nadie las lee completas.
Diferencia de precio entre el modelo más económico y el de frontera por el mismo trabajo
Suscripción o API: cuál te conviene
| Suscripción (Pro, Max, Team) | API (pago por tokens) | |
|---|---|---|
| Cómo se cobra | Fijo por usuario al mes (≈ 20-30 USD) | Variable según consumo real |
| Ideal para | Personas usando el chat | Procesos automatizados sin humano |
| Ventaja | Predecible, sin sorpresas | Solo pagas lo que usas |
| Riesgo | Licencias que nadie usa | Factura que se dispara sin vigilancia |
La mayoría de las empresas necesita las dos cosas: suscripciones para el equipo que trabaja con el chat y una cuenta de API para las automatizaciones. Lo que no funciona es intentar cubrir un proceso automatizado con suscripciones —los límites de uso te frenan— ni darle a cada empleado una llave de API sin control de gasto.
La regla de presupuesto que recomendamos
- Empieza con un tope mensual bajo en la consola de tu proveedor. Todos permiten poner un límite duro. Ponlo antes de la primera prueba, no después del primer susto.
- Mide el costo por tarea, no el total. "Gastamos 180 dólares" no dice nada. "Cada contrato analizado nos cuesta 13 centavos y nos ahorra 40 minutos de un abogado" es una decisión de negocio.
- Compara contra el costo humano de la tarea, no contra cero. El marco completo está en cómo medir el ROI real de la inteligencia artificial.
- Revisa el modelo asignado cada trimestre. Los precios bajan y las capacidades suben: en julio de 2026 el modelo insignia de Anthropic pasó a costar la mitad que su modelo de frontera ganándole en la mayoría de las pruebas. Quien no revisó, siguió pagando el doble.
Lo que casi siempre sorprende
Que la IA sale más barata de lo que la gente teme y más cara de lo que los entusiastas prometen. Un proceso bien diseñado en una PyME mexicana normalmente vive entre 30 y 300 dólares al mes — menos que una licencia de software contable, más que cero.
Lo que dispara ese número casi nunca es el volumen de trabajo. Es usar el modelo de frontera para tareas que un modelo estándar resuelve igual de bien, y pedir respuestas de veinte párrafos donde bastaban cinco viñetas.
Números antes de firmar
Estimamos el costo real de tu proceso con IA
Te entregamos el cálculo mensual con el modelo adecuado, las palancas de ahorro aplicables y el punto de equilibrio contra el costo actual.



