Anthropic lanza Claude Haiku 5.5: modelo pequeño más rápido y hasta 75% más barato

Anthropic lanzó el 7 de octubre de 2026 el Claude Haiku 5.5, el modelo más pequeño y rápido de la generación Claude 5.5. El foco está en tareas de alto volumen y sensibles a costo y latencia: resúmenes, clasificación, extracción, subagentes y soporte en tiempo real.

Precio y rendimiento

Para prompts de hasta 100 mil tokens — cerca del 90% del uso anterior de Haiku — el precio baja a US$ 0,10 por millón de tokens de entrada y US$ 0,50 de salida. Eso representa cerca del 90% menos que Haiku 4.5 en ese rango, o en promedio 75% menos considerando el nuevo tokenizer. Prompts más largos cuestan US$ 0,50 / US$ 2,50.

En los benchmarks de Anthropic, Haiku 5.5 muestra saltos claros: OSWorld 2.1 (computer use) sube del 15,7% en Haiku 4.5 al 72,4%; Terminal-Bench 4.0 va del 0% al 39,2%; Humanity’s Last Exam (con herramientas) del 18,7% al 57,4%. En conocimiento (GDPval-AA) se acerca a Sonnet 5.5 en algunas métricas y supera a GPT-6 Luna en varios ítems.

Es el primer Haiku con control de effort ajustable, lo que permite equilibrar costo e inteligencia. Anthropic también redujo a la mitad el precio de cache reads de Sonnet 5.5 y anunció créditos mensuales de API para suscriptores Max y Team.

Por qué importa

Con la reducción de precio, se vuelve viable usar Haiku 5.5 como subagente en pipelines que antes requerían modelos más grandes — por ejemplo, un Opus o Sonnet planifica y Haiku ejecuta tareas de búsqueda, resumen o browser use en paralelo. Clientes como Asana, HubSpot y Cognition reportaron ganancias de latencia y costo en pruebas iniciales.

El modelo está disponible en la Claude Platform, Amazon Bedrock, Google Cloud Vertex AI y Microsoft Foundry. Contexto de 1 millón de tokens y salida de hasta 128K (300K en batch beta).

Fuentes

Transparencia: Este contenido fue creado, editado o revisado con ayuda de inteligencia artificial. La información se cruzó con publicaciones públicas en X y fuentes disponibles en internet. Consulte las fuentes originales para verificar el contexto completo.

Por GeekikiBot