Anthropic publicó el 7 de octubre de 2026 el lanzamiento de Claude Haiku 5.5, el modelo de lenguaje más económico que ha producido hasta ahora. Para prompts de hasta 100.000 tokens —que representan alrededor del 90% de las solicitudes que recibe la línea Haiku— el coste es de 0,10 dólares por millón de tokens de entrada y 0,50 dólares por millón de salida, un 90% menos que Haiku 4.5. En promedio, considerando también las consultas más largas, el ahorro ronda el 75%. Es también el primer modelo Haiku que llega con controles de esfuerzo ajustables, igual que los modelos mayores de Anthropic.
Llevo probando los modelos de la familia Claude desde que lanzaron Claude 2 en 2023, y hay un patrón que se repite: cada generación Haiku parece un salto demasiado pequeño hasta que empiezas a ejecutarlo en escala. Con Haiku 5.5, el salto es visible en los benchmarks antes de arrancar ninguna prueba. La comparación con GPT-6 Luna, el modelo de OpenAI en el mismo segmento, da una idea de dónde se sitúa.
¿Qué puede hacer Haiku 5.5 que su predecesor no podía?
Los datos de benchmark son el punto de partida. En OSWorld 2.1, que mide uso de ordenador real en tareas largas y complejas, Haiku 5.5 alcanza el 72,4% en el subconjunto offline. Haiku 4.5 obtenía el 15,7% en el mismo test. GPT-6 Luna queda en el 48,9%. No es un ajuste fino: es un rediseño completo de la capacidad de razonamiento en el rango compacto.
En Terminal-Bench 4.0, que mide tareas profesionales complejas en línea de comandos, Haiku 5.5 sube al 39,2%. Haiku 4.5 marcó exactamente 0,0% en esa prueba. En Humanity’s Last Exam, la batería de preguntas de dificultad máxima creada por investigadores, Haiku 5.5 llega al 45,9% sin herramientas y al 57,4% con herramientas. El salto en codificación agéntica —medido por FrontierCode 1.1— es del 46,4%, por encima de los 42,4% de GPT-6 Luna.
Es el primer modelo Haiku con control de esfuerzo. El ajuste por defecto es «medio»; los equipos pueden bajar a «bajo» para reducir coste o subir a «alto» y «muy alto» para tareas que requieren más razonamiento. Esto lo equipara funcionalmente a Sonnet 5.5 y Opus 5.5 en cuanto a flexibilidad operativa.
El desglose real de precios y cuándo vale la pena usarlo
La estructura de precios tiene dos tramos según longitud de contexto. Para prompts de hasta 100.000 tokens: entrada 0,10 dólares/millón, salida 0,50 dólares/millón, escritura en caché 0,125 dólares/millón, lecturas de caché 0,01 dólares/millón. Para prompts de más de 100.000 tokens: los precios suben a 0,50/2,50/0,625/0,05 dólares respectivamente.
La comparación con Haiku 4.5 (1,00/5,00 dólares de entrada/salida) y con Sonnet 5.5 (2,00/10,00 dólares) muestra que Haiku 5.5 es el punto de entrada correcto para tareas como compactación de contexto, resúmenes automatizados, consultas a bases de datos y clasificación. Anthopic lo describe como el modelo idóneo cuando un modelo mayor trabaja en la tarea principal y Haiku actúa como subagente. Aquí también tiene sentido vincularlo a la apuesta de Anthropic por desarrollar sus propios chips de IA: construir infraestructura propia permite precisamente comprimir el coste de los modelos compactos.
Hay también una novedad en la tokenización: Haiku 5.5 usa el mismo tokenizador que Sonnet 5.5 y Opus 5.5, lo que implica un ligero aumento de tokens por tarea respecto a Haiku 4.5. Anthropic lo menciona en la nota al pie del anuncio, pero el efecto neto sigue siendo un ahorro muy significativo.
Lo que dicen los clientes que ya lo probaron
Los testimonios incluidos en el anuncio aportan cifras concretas. Box obtuvo una puntuación 11 puntos más alta que con Haiku 4.5 a aproximadamente la mitad de latencia en sus pruebas de análisis de contenido empresarial. Asana midió una reducción de más del 30% en latencia de finalización de tareas y hasta 2,5 veces más velocidad de inferencia por turno de agente en casos de uso como triaje de errores y búsqueda en portfolios grandes.
HubSpot ejecutó sus portales simulados de CRM y Haiku 5.5 obtuvo el 92,8% de media en tres ejecuciones, la mejor puntuación que han visto en ese test. En la tarea de identificar registros obsoletos, Haiku 5.5 fue el más rápido, el de mayor tasa de acierto y el de menor tasa de falsos positivos. Cognition lo usa como modelo lateral en Devin Fusion —con Opus 5.5 como modelo principal— y reporta un FrontierCode de 66,2 con esa combinación. Estos datos concretos son más fiables que los benchmarks internos. Sirven también para calibrar qué tipo de tareas encajan con Haiku 5.5 y cuáles siguen requiriendo un modelo mayor. Para trabajos de edición y flujos de uso de Claude en la redacción, ya publiqué cómo la integración de Claude directamente en Microsoft Word para trabajo legal abre otra vía de acceso al ecosistema de Anthropic.
Más allá de Haiku: créditos de API y Sonnet 5.5 más barato
El lanzamiento viene acompañado de dos cambios adicionales. Primero, Anthropic reduce a la mitad el precio de las lecturas de caché de Sonnet 5.5: de 0,20 a 0,10 dólares por millón de tokens. En la mayoría de trabajos agénticos, donde las lecturas de caché representan una fracción importante del consumo total, esto equivale a un ahorro de alrededor del 20% en costes de Sonnet 5.5.
Segundo, introduce un crédito de API mensual para los suscriptores de Claude Max y Team. Los usuarios Max 5x reciben 100 dólares (≈ 94 euros) al mes, los Max 20x reciben 200 dólares (≈ 188 euros) y los suscriptores Team reciben hasta 500 dólares (≈ 470 euros) agrupados por organización. El objetivo declarado es que los usuarios puedan construir herramientas, aplicaciones y agentes propios que llamen a la API de Anthropic sin coste adicional hasta agotar ese crédito.
Haiku 5.5 está disponible desde hoy en AWS, Google Cloud y Microsoft Azure. El identificador de modelo en la plataforma es claude-haiku-5-5. Para quienes ya usan Haiku 4.5, Anthropic ha publicado una guía de migración. Y la pregunta que acompañará al modelo durante los próximos meses es si su capacidad en use cases agénticos —como los que muestran Box y Asana— aguanta en producción con la variabilidad real de los datos empresariales. Los benchmarks dicen que sí; los pilotos de los clientes también. Lo que viene ahora es el test a escala.
El dato que más me llama la atención no es el precio ni el OSWorld: es el 0,0% de Terminal-Bench de Haiku 4.5 frente al 39,2% de Haiku 5.5. Eso no es una mejora incremental. Es pasar de inútil a competitivo en tareas profesionales de terminal en una sola versión. Aquí, el modo socrático que Anthropic lanzó para aprender con Claude también sugiere que la compañía entiende que el modelo pequeño no es solo para procesar texto barato, sino para interacciones frecuentes donde la experiencia importa. Haiku 5.5 es, por primera vez en su generación, un modelo con el que vale la pena hablar.
