Anthropic lanzó el martes 7 de octubre de 2026 Claude Haiku 5.5, su modelo pequeño, rápido y barato, con un precio de lista 90% más bajo que el de su antecesor en peticiones normales. En el mismo anuncio hubo dos cosas más que le importan a una empresa: las lecturas de caché de Sonnet 5.5 bajan a la mitad y los planes Max y Team de Claude empiezan a incluir créditos mensuales de API.
Si tu empresa usa IA para trabajo repetitivo —leer facturas, clasificar correos, resumir tickets, sacar datos de PDFs—, esta es la noticia de precio más relevante del mes.
Los precios
| Modelo | Entrada (por millón de tokens) | Salida (por millón de tokens) |
|---|---|---|
| Haiku 5.5 (peticiones de hasta 100,000 tokens) | 0.10 USD | 0.50 USD |
| Haiku 5.5 (peticiones de más de 100,000 tokens) | 0.50 USD | 2.50 USD |
| Haiku 4.5 (antes) | 1.00 USD | 5.00 USD |
| GPT-6 Luna (OpenAI) | 0.10 USD | 0.50 USD |
El identificador en la API es claude-haiku-5-5, y está disponible en la plataforma de Claude, AWS, Google Cloud y Microsoft Azure. Anthropic no aclaró en su anuncio si llega a las aplicaciones de chat; esta noticia es, sobre todo, para quien usa la API.
Ojo con el "90%". Anthropic misma estima que el costo promedio baja alrededor de 75%, no 90%. La razón: el modelo nuevo usa un tokenizador distinto y gasta más tokens por tarea. Y una medición externa lo matiza más: Artificial Analysis calculó que Haiku 5.5 gasta unos 162,000 tokens de salida por tarea, cerca de tres veces lo que usa GPT-6 Luna (unos 50,000), y concluyó que Luna logra una calificación parecida por aproximadamente un tercio del costo. El precio por token es igual; la factura, no necesariamente.
Qué tan bueno es
Según las pruebas que publicó Anthropic, el salto contra Haiku 4.5 es grande: en OSWorld 2.1 (usar una computadora para completar tareas) pasa de 15.7% a 72.4%, y en sus comparaciones supera a GPT-6 Luna en todas las categorías. Son cifras del fabricante; las independientes, como la de arriba, dan un cuadro más parejo.
Dos novedades prácticas:
- Esfuerzo ajustable. Es el primer Haiku en el que puedes elegir cuánto "piensa" (de bajo a máximo). Para clasificar correos, esfuerzo bajo; para revisar un contrato, más. Si la diferencia te suena, la explicamos en IA rápida contra IA que piensa.
- Ventana de contexto de un millón de tokens, contra 200,000 de Haiku 4.5, según The Decoder. Recuerda que arriba de 100,000 tokens por petición el precio se multiplica por cinco.
En seguridad, Help Net Security reporta que resiste mejor las instrucciones ocultas en correos o páginas web, aunque queda por debajo de Sonnet 5.5 y Opus 5.5 en la prueba de Gray Swan. Si un agente con Haiku lee correos de clientes, sigue siendo necesario limitar qué puede hacer.
Créditos de API incluidos en Team y Max
Esta es la parte que más le sirve a una PyME que ya paga Claude para su equipo:
| Plan | Crédito mensual de API |
|---|---|
| Max 5x | 100 USD |
| Max 20x | 200 USD |
| Team | 20 USD por asiento estándar y 100 por asiento premium, tope de 500 USD por organización |
Las condiciones, según iClarified: se reclaman en el sitio de Claude, la suscripción debe tener al menos siete días activa, caducan cada mes (no se acumulan), no se pueden usar en nubes de terceros y no amplían los límites de uso de la aplicación ni cubren sesiones interactivas de Claude Code. Se pueden gastar en cualquier modelo.
Para una empresa con diez asientos estándar de Team son 200 dólares al mes de API sin costo adicional. Con Haiku 5.5 a estos precios, eso alcanza para procesar volúmenes que antes requerían presupuesto aparte. Si estás decidiendo plan, la comparación está en Claude Pro, Max y Team.
Un ejemplo con números
Supón que lees 10,000 facturas al mes, con unos 3,000 tokens de entrada (instrucciones más el PDF convertido a texto) y 500 de salida cada una. Es un cálculo ilustrativo, con precio de lista:
- Haiku 4.5: 30 millones de tokens de entrada × 1 USD + 5 millones de salida × 5 USD = 55 USD al mes.
- Haiku 5.5: 30 × 0.10 + 5 × 0.50 = 5.50 USD al mes, antes de contar los tokens extra que gasta el modelo nuevo.
Aunque el ahorro real quede en el 75% que estima Anthropic, la cuenta cabe completa dentro del crédito de un Team chico. El método para hacer este cálculo con tus propios procesos está en cuánto cuesta la IA por token.
Qué hacer esta semana
- Ubica dónde usas Haiku 4.5. En la consola de Claude, Usage → Export te da el consumo por llave y por modelo. Sigue activo y sin fecha de retiro, pero la tabla de Anthropic dice "no antes del 15 de octubre de 2026"; el aviso puede llegar en cualquier momento, como acaba de pasar con Sonnet 4.5 y GPT-5.1.
- Prueba Haiku 5.5 contra lo que usas hoy con 20 o 30 casos reales, midiendo calidad y tokens gastados, no solo precio de lista. Si ya usas GPT-6 Luna, ponlos lado a lado: es justo el caso que describe cómo probar dos modelos con tus casos reales.
- Si tienes Team o Max, reclama el crédito y úsalo para ese piloto. Caduca al mes.
- Si usas Sonnet 5.5 en agentes, verifica que el caché esté activado: con la lectura a 0.10 dólares, Anthropic calcula alrededor de 20% menos en trabajo con agentes.
- Revisa qué tareas mandas al modelo grande por costumbre. Con un modelo pequeño así de capaz, muchas ya no lo necesitan. La regla está en cómo elegir el modelo correcto para cada tarea.



