Claude Haiku 5.5 : Anthropic baisse ses prix jusqu'à 90 %

Claude Haiku 5.5 : Anthropic baisse ses prix jusqu'à 90 %

Anthropic a lancé Claude Haiku 5.5, présenté comme son petit modèle le plus rapide et le moins cher à ce jour. L'annonce s'accompagne d'une baisse de prix pour Sonnet 5.5 et d'un nouveau système de crédits API mensuels pour les abonnés payants. Prises ensemble, ces nouveautés montrent que la guerre des prix entre laboratoires d'IA continue de s'intensifier.

Moins cher au token, mais avec une nuance

Haiku 5.5 est conçu pour les tâches à fort volume, où le coût compte avant tout. Anthropic cite comme usages typiques la synthèse de texte, les requêtes de bases de données, la classification et le support client en temps réel.

Le prix est le principal argument. En moyenne, Haiku 5.5 coûte environ 75 % de moins que Haiku 4.5. Pour les prompts allant jusqu'à 100 000 tokens, la baisse atteint 90 %. Selon Anthropic, cette tranche représentait environ 90 % de l'ensemble des requêtes Haiku jusqu'ici. Au-delà de 100 000 tokens, le prix est multiplié par cinq.

Il y a toutefois une réserve. Haiku 5.5 utilise un tokenizer mis à jour qui consomme un peu plus de tokens pour une même tâche. Anthropic a observé un effet similaire avec ses modèles Opus 4.x, où le seul changement de tokenizer avait augmenté la consommation de tokens d'environ 30 %. Les économies réelles seront donc probablement inférieures à ce que laissent entendre les prix au token.

Des bonds spectaculaires sur les benchmarks

Par rapport à Haiku 4.5, les progrès sont considérables :

  1. GDPval-AA v2.1 (travail intellectuel) : 1 620, contre 735 auparavant.
  2. Humanity's Last Exam : 45,9 % sans outils et 57,4 % avec outils, contre 10,2 et 18,7 %.
  3. OSWorld-2.1 (utilisation d'un ordinateur) : 72,4 %, contre 15,7 %.
  4. Terminal-Bench 4.0 (codage agentique) : 39,2 %, là où Haiku 4.5 obtenait zéro.

Le résultat le plus marquant concerne l'utilisation d'un ordinateur. Dans ce mode, le modèle pilote une machine de façon autonome, ce qui consomme énormément de tokens. Un modèle rapide et bon marché est tout indiqué pour ce type de charge de travail.

Anthropic compare aussi Haiku 5.5 au modèle économique d'OpenAI, GPT-6 Luna, et Haiku arrive en tête dans toutes les catégories testées. Les scores de référence de Sonnet 5.5 révèlent cependant un net écart : le petit modèle reste loin derrière son grand frère.

Raisonnement réglable et règles de cybersécurité renforcées

Haiku 5.5 est le premier modèle de la gamme Haiku à proposer des niveaux de raisonnement réglables, ce qui permet d'arbitrer entre coût et qualité. Anthropic le recommande pour des tâches bien délimitées comme la compaction, la synthèse ou le rôle de sous-agent. Pour le codage agentique complexe, l'entreprise renvoie toujours vers Sonnet 5.5 et Opus 5.5.

Les garde-fous en matière de cybersécurité sont plus stricts que sur Haiku 4.5. Ils autorisent néanmoins un éventail de tâches défensives plus large que Sonnet 5.5, en partie parce que Haiku est globalement moins performant. Les tests d'intrusion restent bloqués. Les organisations aux besoins plus étendus peuvent postuler aux programmes de vérification d'Anthropic dédiés aux sciences de la vie et à la cybersécurité.

Le modèle est disponible dès maintenant sur toutes les plateformes, y compris Amazon Web Services, Google Cloud et Microsoft Azure.

Baisse de prix pour Sonnet et crédits API

Anthropic divise également par deux le prix de lecture du cache pour Sonnet 5.5, qui passe de 0,20 à 0,10 dollar par million de tokens. L'entreprise s'attend à ce que cela réduise d'environ 20 % le coût de la plupart des tâches agentiques. Le calendrier laisse penser à une réponse à la nouvelle série GPT-6.1 d'OpenAI, qui comprend GPT-6.1 Sol, vendu pour une fraction du prix de son modèle phare.

Les abonnés recevront désormais des crédits API chaque mois : 100 dollars pour les utilisateurs Max-5x, 200 dollars pour les utilisateurs Max-20x et jusqu'à 500 dollars par mois pour les abonnés Team. Ces crédits permettent de tester des outils, des applications et des agents via l'API. Cette initiative fait suite à l'offensive précédente d'Anthropic avec des crédits gratuits pour les startups.

Anthropic met aussi à jour ses SDK Python et TypeScript, avec une prise en charge en bêta de l'utilisation d'un ordinateur et d'un navigateur.

Notre analyse

Pour les équipes qui font tourner des agents à grande échelle, cette sortie compte davantage qu'un nouveau modèle de pointe. Une bonne partie du travail des agents est répétitive : résumer le contexte, classer des entrées, cliquer dans des interfaces. Un modèle bon marché qui gère bien ces étapes peut changer l'équation économique de toute une chaîne de traitement, surtout lorsqu'il sert de sous-agent à un modèle plus puissant.

La réserve sur le tokenizer rappelle qu'il faut mesurer plutôt que supposer. Le prix au token ne représente que la moitié de la facture. Les équipes devraient comparer le coût total des tâches avant de basculer.

La tendance de fond est claire. Les laboratoires se livrent une rude bataille sur les prix, et la baisse sur Sonnet ressemble à une réponse directe à OpenAI. Cela concorde avec les signes indiquant que les dépenses des entreprises en IA reculent alors même que l'usage progresse. Reste à voir si OpenAI répliquera par ses propres baisses, et si des tests indépendants confirmeront les scores de Haiku 5.5 en utilisation d'un ordinateur, en dehors des benchmarks maison d'Anthropic.