Saltar al contenido

Haiku 5.5 llega un 75 % más barato: el modelo pequeño deja de ser el hermano tonto

Publicado el 8 de octubre de 2026

Balanza de precisión en un taller en penumbra con un engranaje diminuto frente a otro enorme, y al fondo la silueta de una persona de espaldas ante una cinta transportadora de piezas pequeñas.

Anthropic presentó el 7 de octubre de 2026 Claude Haiku 5.5, la nueva versión de su modelo pequeño, y la vendió con tres adjetivos: el más barato, el más rápido y el más capaz de esa gama hasta la fecha. El dato que resume el anuncio es el precio: según la compañía, ejecutar una carga de trabajo con Haiku 5.5 cuesta de media un 75 % menos que con Haiku 4.5. El modelo está disponible ya en todas las plataformas —incluidas Amazon Web Services, Google Cloud y Microsoft Azure— con el identificador claude-haiku-5-5.

Qué se ha anunciado

La tarifa va por tramos según el tamaño del prompt. Para peticiones de hasta cien mil tokens, el millón de tokens de entrada cuesta diez céntimos de dólar y el de salida, cincuenta céntimos; la escritura en caché sale por doce céntimos y medio y la lectura, por un céntimo. Por encima de ese umbral, todo se multiplica por cinco: cincuenta céntimos la entrada, dos dólares y medio la salida, sesenta y dos céntimos y medio la escritura en caché y cinco céntimos la lectura. La comparación es con Haiku 4.5, que cobraba un dólar por millón de tokens de entrada, cinco por millón de salida, un dólar y veinticinco por escritura en caché y diez céntimos por lectura.

De ahí sale el 75 % de media. En la letra pequeña del propio anuncio, la rebaja real es del 90 % para peticiones por debajo de los cien mil tokens y del 50 % por encima; en Haiku 4.5, nueve de cada diez peticiones caían en el primer grupo. El cálculo también descuenta que Haiku 5.5 estrena un tokenizador nuevo, parecido al de Sonnet 5.5 y Opus 5.5, que consume algo más de tokens para hacer el mismo trabajo.

Es además el primer modelo de la familia pequeña con ajuste de esfuerzo, el mismo control que ya tenían los modelos mayores para decidir si se optimiza por coste o por inteligencia.

Estas son las cifras de evaluación que publica Anthropic, con los modelos reordenados para facilitar la lectura:

PruebaHaiku 4.5Haiku 5.5Sonnet 5.5GPT-6 Luna
GDPval-AA v2.1 (trabajo profesional)735162018401437
AA-Briefcase v1.1614157818241336
OSWorld 2.1 (subconjunto offline)15,7 %72,4 %83,9 %48,9 %
Humanity's Last Exam (sin herramientas)10,2 %45,9 %56,9 %—
Terminal-Bench 4.00,0 %39,2 %70,6 %16,4 %
FrontierCode 1.1 (Main)—46,4 %52,1 %42,4 %
Chartography (sin herramientas)6,4 %46,4 %61,6 %29,1 %

La cifra de Sonnet 5.5 en FrontierCode corresponde a su configuración de esfuerzo más alta. Con herramientas, Haiku 5.5 sube al 57,4 % en Humanity's Last Exam frente al 18,7 % de Haiku 4.5.

El anuncio llega acompañado de dos cambios más. El precio de las lecturas de caché de Sonnet 5.5 baja a la mitad, de veinte a diez céntimos de dólar por millón de tokens, lo que según la empresa abarata alrededor de un 20 % el trabajo agéntico típico con ese modelo. Y esta semana empieza el reparto de un crédito mensual de API para suscriptores Max y Team: cien dólares al mes para Max 5x, doscientos para Max 20x y hasta quinientos para los equipos, compartidos entre sus usuarios y utilizables con cualquier modelo. Los SDK de Python y TypeScript añaden, en beta, soporte para uso de ordenador y de navegador.

De dónde viene

El movimiento encaja con la tendencia que viene marcando la compañía: primero el recorte en el precio de la caché que ya se cubrió en este blog, después la bajada de tarifas asociada a la llegada de los modelos grandes de esta generación, y ahora el extremo barato de la gama. La propia Anthropic enmarca el lanzamiento como una revisión del «valor» de toda su familia de modelos, no como un producto aislado.

El salto frente a Haiku 4.5 es grande justamente donde el modelo anterior no servía: en Terminal-Bench 4.0, la versión vieja marcaba un cero redondo. En uso de ordenador pasa del 15,7 % al 72,4 % del subconjunto offline de OSWorld 2.1, según las pruebas de la empresa.

Qué significa

El cambio práctico no es «hay un modelo nuevo», es que tareas que no salían a cuenta ahora salen. Compactar contexto, resumir, clasificar, lanzar consultas a base de datos, disparar subagentes que van a buscar un dato concreto dentro de un documento largo: todo eso se cobraba antes a precio de modelo mediano y ahora se cobra a una décima parte en el tramo corto. El umbral de los cien mil tokens es la frontera que conviene vigilar al diseñar los prompts, porque cruzarla quintuplica la factura por token.

La propia Anthropic marca el límite: para codificación agéntica compleja —del tipo que mide Terminal-Bench— siguen siendo mejores opciones Sonnet 5.5 y Opus 5.5. Haiku 5.5 se posiciona como pieza de apoyo, no como sustituto. El patrón que describen sus clientes es ese: un modelo grande lleva la tarea principal y uno pequeño hace los recados.

Para quien ya use Sonnet 5.5 en flujos agénticos, la rebaja de la caché no exige tocar nada: el ahorro aparece solo. Para quien venga de Haiku 4.5, Anthropic publica una guía de migración; conviene rehacer las estimaciones de coste con el tokenizador nuevo, que gasta algo más.

En seguridad, la compañía dice haber mejorado casi todas sus evaluaciones de alineamiento respecto a Haiku 4.5, con menos comportamientos desalineados y menor disposición a colaborar con usos indebidos. Las salvaguardas de ciberseguridad son más estrictas que las de Haiku 4.5 y algo más permisivas que las de otros modelos recientes: dejan pasar más tareas defensivas que Sonnet 5.5, pero siguen bloqueando pruebas de penetración. Las de biología son las mismas que en Sonnet 5, Sonnet 5.5 y Opus 5.

Lo que el anuncio no dice

Todas las cifras de rendimiento son de Anthropic y de su propia metodología, detallada en la tarjeta de sistema del modelo. No hay verificación independiente.

Los testimonios de clientes son igualmente afirmaciones de parte. Asana dice haber visto una reducción de latencia superior al 30 % y hasta 2,5 veces más velocidad de inferencia por turno de agente frente al modelo que usa hoy, sin precisar cuál. HubSpot habla del mejor resultado de su suite de tareas de CRM, un 92,8 % promediado en tres ejecuciones. AlphaSense, que dice mover unos ocho millones de llamadas semanales en una de sus funciones, reporta una mejora de 0,76 a 0,84 sobre cuatrocientas consultas. Box cifra en once puntos la ventaja sobre Haiku 4.5 con aproximadamente la mitad de latencia. Cognition sitúa a Haiku 5.5 como modelo de apoyo en Devin Fusion con una puntuación de 66,2 en FrontierCode, liderando Opus 5.5.

Tampoco se detalla cuánto durará el crédito mensual para Max y Team, ni si es una medida permanente. Y la afirmación de que es el modelo más rápido de la casa lleva su asterisco en el propio texto: lo es a velocidad estándar, pero los modelos Opus en modo rápido van por delante.

«Haiku 5.5 se adapta mejor a tareas de alcance más estrecho», reconoce la compañía al comparar su modelo pequeño con los grandes en codificación agéntica.

Fuente: Anthropic

¿Te ha surgido una duda leyendo esto?

Pregúntanos. Respondemos aunque no acabes siendo cliente.