Claude Haiku 5.5: Anthropic rebaja precios hasta un 90 %
Anthropic ha lanzado Claude Haiku 5.5, que presenta como su modelo pequeño más rápido y barato hasta la fecha. El lanzamiento llega acompañado de una rebaja de precios en Sonnet 5.5 y de un nuevo sistema de créditos mensuales de API para los suscriptores de pago. En conjunto, los anuncios muestran que la guerra de precios entre los laboratorios de IA sigue recrudeciéndose.
Más barato por token, pero con letra pequeña
Haiku 5.5 está pensado para trabajos de gran volumen en los que el coste es lo que más pesa. Anthropic cita como usos habituales los resúmenes, las consultas a bases de datos, la clasificación y la atención al cliente en tiempo real.
Lo más llamativo es el precio. De media, Haiku 5.5 cuesta alrededor de un 75 % menos que Haiku 4.5. En las peticiones de hasta 100.000 tokens, los precios bajan hasta un 90 %. Según Anthropic, ese tramo abarcaba aproximadamente el 90 % de todas las peticiones anteriores a Haiku. Las peticiones de más de 100.000 tokens cuestan cinco veces más.
Hay un matiz. Haiku 5.5 utiliza un tokenizador actualizado que necesita algo más de tokens para la misma tarea. Anthropic ya observó un efecto parecido con sus modelos Opus 4.x, en los que el cambio de tokenizador por sí solo elevó el consumo de tokens en torno a un 30 %. Lo más probable es que el ahorro real sea menor de lo que sugieren las cifras por token.
Grandes saltos en los benchmarks
Frente a Haiku 4.5, las mejoras son considerables:
- GDPval-AA v2.1 (trabajo del conocimiento): 1620, frente a 735.
- Humanity's Last Exam: 45,9 % sin herramientas y 57,4 % con herramientas, frente al 10,2 % y el 18,7 %.
- OSWorld-2.1 (uso del ordenador): 72,4 %, frente al 15,7 %.
- Terminal-Bench 4.0 (programación agéntica): 39,2 %, cuando Haiku 4.5 obtuvo un cero.
El uso del ordenador es el resultado más destacado. En este modo, el modelo maneja un ordenador por su cuenta, algo que consume muchísimos tokens. Un modelo rápido y barato encaja de forma natural en ese tipo de cargas de trabajo.
Anthropic también compara Haiku 5.5 con GPT-6 Luna, el modelo económico de OpenAI, y Haiku sale por delante en todas las categorías evaluadas. Las puntuaciones de referencia de Sonnet 5.5 dejan ver, eso sí, una diferencia clara. El modelo pequeño sigue muy por detrás del grande de Anthropic.
Razonamiento ajustable y normas de ciberseguridad más estrictas
Haiku 5.5 es el primer modelo de la gama Haiku con niveles de razonamiento ajustables, de modo que los usuarios pueden equilibrar coste y calidad. Anthropic lo recomienda para tareas de alcance acotado, como la compactación, los resúmenes o el trabajo como subagente. Para la programación agéntica compleja, la compañía sigue remitiendo a Sonnet 5.5 y Opus 5.5.
Las salvaguardas de ciberseguridad son más estrictas que en Haiku 4.5. Al mismo tiempo, permiten un abanico más amplio de tareas defensivas que Sonnet 5.5, en parte porque Haiku es menos capaz en general. Las pruebas de penetración siguen bloqueadas. Las organizaciones con necesidades más amplias pueden solicitar el acceso a los programas de verificación de Anthropic para ciencias de la vida y ciberseguridad.
El modelo ya está disponible en todas las plataformas, entre ellas Amazon Web Services, Google Cloud y Microsoft Azure.
Rebaja en Sonnet y créditos de API
Anthropic también reduce a la mitad el precio de lectura de caché de Sonnet 5.5, de 0,20 a 0,10 dólares por millón de tokens. La compañía calcula que esto abaratará la mayoría de las tareas agénticas en torno a un 20 %. El momento elegido apunta a una respuesta a la nueva serie GPT-6.1 de OpenAI, que incluye GPT-6.1 Sol, presentado a una fracción del coste de su modelo estrella.
Los suscriptores recibirán a partir de ahora créditos mensuales de API. Los usuarios de Max-5x obtienen 100 dólares, los de Max-20x, 200 dólares, y los suscriptores de Team, hasta 500 dólares al mes. Los créditos pueden usarse para probar herramientas, aplicaciones y agentes a través de la API. Esto llega después de la anterior ofensiva de Anthropic con créditos gratuitos para startups.
Anthropic actualiza además sus SDK de Python y TypeScript, con soporte en beta para el uso del ordenador y del navegador.
Nuestra opinión
Para los equipos que ejecutan agentes a gran escala, este lanzamiento importa más de lo que importaría otro modelo de frontera. Buena parte del trabajo de los agentes es repetitivo: resumir contexto, clasificar entradas, hacer clic por las interfaces. Un modelo barato que resuelva bien estos pasos puede cambiar las cuentas de todo un flujo de trabajo, sobre todo cuando actúa como subagente de un modelo más grande.
El matiz del tokenizador recuerda que hay que medir, no dar las cosas por supuestas. El precio por token es solo la mitad de la factura. Los equipos deberían comparar el coste completo de cada tarea antes de cambiar de modelo.
La tendencia de fondo está clara. Los laboratorios compiten con dureza en precio, y la rebaja de Sonnet por parte de Anthropic parece una respuesta directa a OpenAI. Encaja con los indicios de que el gasto empresarial en IA cae aunque su uso aumente. Habrá que ver si OpenAI responde con sus propias rebajas y si pruebas independientes confirman las puntuaciones de Haiku 5.5 en uso del ordenador fuera de los benchmarks de la propia Anthropic.
