Analyses

Actualité et analyses

Claude Haiku 5.5 : prix affiché en baisse de 90 %, mais la facture est à recalculer

Le 7 octobre 2026, Anthropic a lancé Claude Haiku 5.5, présenté comme son petit modèle le moins cher, le plus rapide et le plus capable à ce jour, destiné aux tâches à haut volume et sensibles au coût. Le titre, c'est le prix : 0,10 USD en entrée et 0,50 USD en sortie par million de tokens pour les prompts de moins de 100K tokens, soit 90 % de moins que la génération précédente. Les petits caractères comptent davantage : un nouveau tokeniseur compte environ 30 % de tokens en plus pour le même texte, cinq anciens schémas d'intégration renvoient désormais HTTP 400, et la réflexion adaptative est activée par défaut. Pendant ce temps, la guerre des prix du secteur s'est déplacée vers l'entrée de gamme, DeepSeek, Google et Anthropic facturant chacun à sa manière.

SlateMoth Editorial · Muse ·

Recherche et rédaction par Muse ; révision par étapes par Muse dans le même contexte de rédaction. Recherche, rédaction, revue des faits et traduction en huit langues réalisées par Muse dans le cadre d'une revue étagée du même auteur (reviewMode=muse_same_platform_staged, contextRelationship=same_author_context) ; déclaré comme contexte du même auteur, et non comme un audit indépendant. Prix et benchmarks sont des chiffres du fournisseur ; les détails de migration proviennent de la documentation officielle ; les comparaisons de tiers sont attribuées avec leurs limites.

Ce qui s'est passé

Le 7 octobre, Anthropic a lancé Claude Haiku 5.5, décrit comme son petit modèle le moins cher, le plus rapide et le plus capable à ce jour. Le positionnement est explicite : les tâches à haut volume et sensibles au coût - résumés, compaction de contexte, requêtes de bases de données, classification, et les missions de sous-agent sous Opus 5.5 et Sonnet 5.5.

Le prix fait la une : pour les prompts jusqu'à 100K tokens, 0,10 USD par million de tokens en entrée et 0,50 USD en sortie ; au-delà de 100K tokens, les tarifs passent à 0,50 et 2,50 USD. Le précédent Haiku 4.5 facturait des tarifs uniques de 1,00 et 5,00 USD. Anthropic affirme qu'environ 90 % des requêtes vers l'ancien Haiku tombaient dans la tranche bon marché.

[1]

Lire la baisse de prix : une étiquette à deux tranches

Selon Anthropic, Haiku 5.5 coûte en moyenne environ 75 % moins cher à exploiter que 4.5. Notez l'attribution : c'est une affirmation du fournisseur construite sur ses propres hypothèses de trafic. Votre facture réelle dépend de la longueur de vos prompts, de votre usage du cache et de l'inflation de tokens du nouveau tokeniseur.

Deux autres ajustements de valeur accompagnaient le lancement : le prix des lectures de cache sur Sonnet 5.5 a été divisé par deux, ce qui selon Anthropic rend la plupart des tâches agentiques environ 20 % moins chères ; et les abonnés Max et Team reçoivent de nouveaux crédits API mensuels - 100 USD pour Max 5x, 200 USD pour Max 20x, jusqu'à 500 USD mutualisés pour Team - destinés à expérimenter des agents sur la plateforme.

Haiku 5.5 est aussi le premier Haiku avec un réglage d'effort ajustable : on peut privilégier l'économie ou l'intelligence au sein d'une même requête sans changer de palier de modèle. C'est la première fois qu'un petit modèle reçoit l'accélérateur de réflexion jusqu'ici réservé aux fleurons.

[1]

Benchmarks : comment lire le bulletin du fournisseur

Le bulletin est celui d'Anthropic lui-même : en travail de connaissance, GDPval-AA v2.1 atteint 1620 points (735 pour 4.5, 1437 pour GPT-6 Luna) ; AA-Briefcase v1.1 atteint 1578 (614 / 1336) ; en usage d'ordinateur, le sous-ensemble hors-ligne d'OSWorld 2.1 atteint 72,4 % (15,7 % / 48,9 %) ; en codage agentique, Terminal-Bench 4.0 atteint 39,2 % (0,0 % pour 4.5, 16,4 % pour Luna) ; en raisonnement visuel, Chartography atteint 46,4 % (6,4 % / 29,1 %).

Comment le lire : les plus grands bonds concernent les tâches manuelles - OSWorld de 15,7 % à 72,4 %, Terminal-Bench de zéro à 39,2 %. Mais gardez deux réserves : tous les chiffres sont ceux du fournisseur et n'ont pas été reproduits indépendamment ; et Anthropic lui-même indique que le codage agentique complexe reste le territoire de Sonnet et Opus, Haiku convenant aux tâches étroites et répétitives.

[1]

Migration : cinq endroits où votre ancien code renvoie 400

Au-delà du prix, le vrai coût se cache dans le guide de migration. Haiku 5.5 adopte le tokeniseur plus récent partagé avec Claude 4.7 et les modèles ultérieurs : le même texte compte environ 30 % de tokens en plus que sur 4.5. Chaque budget, seuil de troncature et tableau de bord exprimés en tokens doit être recalculé avec les comptes du nouveau modèle, pas avec d'anciens chiffres recyclés.

Plus durs encore sont cinq erreurs 400 directes : temperature doit valoir 1, top_p doit valoir 0,99, tout top_k est rejeté ; le pré-remplissage de l'assistant est refusé ; les budgets manuels de réflexion (budget_tokens) sont rejetés ; l'usage d'ordinateur doit migrer vers le nouveau jeu d'outils ; et renvoyer des blocs de réflexion après avoir modifié des tours antérieurs renvoie aussi 400. L'ancienne recette de classifieur avec temperature=0 plus pré-remplissage plus max_tokens=20 échoue à chaque étape.

Puis les changements silencieux : la réflexion adaptative est activée par défaut, donc les réponses peuvent s'ouvrir sur un bloc de réflexion qui ne porte qu'un champ vide et une signature ; les tokens de réflexion comptent dans max_tokens, donc de petites limites peuvent tronquer juste après la réflexion ; et un nouveau classifieur de sécurité peut interrompre une requête avec un motif de refus sans solution de repli côté serveur. Migrer n'est pas changer l'ID du modèle ; c'est une petite refonte.

[2] [4]

L'entrée de gamme devient une course à trois

Avec du recul : entre septembre et début octobre 2026, l'entrée de gamme s'est lancée en une rafale de cinq semaines - DeepSeek V4.1 Flash, Google Gemini 3.8 Flash et Anthropic Haiku 5.5 sont arrivés coup sur coup. Les gros titres des fleurons ont cédé la place à l'entrée de gamme : pour les chatbots, les routeurs de tickets et les tâches d'extraction appelés des dizaines de milliers de fois par jour, la facture est le vrai benchmark.

Les trois fournisseurs ont choisi trois logiques de prix : DeepSeek facture selon les heures pleines et creuses, avec doublement en pointe ; Anthropic facture selon la longueur du prompt, avec quintuplement au-delà de 100K tokens ; Google facture un tarif fixe. Un comparatif tiers situe le prix de sortie d'entrée de gamme de Haiku 5.5 à environ un septième de celui de Gemini 3.8 Flash - mais il n'existe pas de formule universelle de comparaison entre fournisseurs, et changer les hypothèses de cache, d'horaire ou de longueur change la conclusion.

Un alignement de prix mérite l'attention : plusieurs médias rapportent que le tarif de Haiku 5.5 pour les prompts courts égale exactement celui de GPT-6 Luna d'OpenAI. Mais l'annonce d'Anthropic elle-même n'a jamais publié les prix de Luna : l'affirmation de parité vient d'informations de tiers et ne doit pas être citée comme une confirmation officielle.

[3] [2] [4]

Conclusion et liste d'actions

La conclusion : la concurrence des modèles en 2026 est entrée dans la phase du coût total de possession. L'inflation du tokeniseur, le coût de la réflexion par défaut, les taux de succès du cache et la distribution des longueurs de prompt déterminent ensemble une facture ; ne regarder que les dollars par million de tokens trompe les budgets. Anthropic lui-même positionne Haiku comme la couche rapide d'un système d'agents - routage, classification, extraction, sous-agents - en laissant le codage complexe à Sonnet et Opus.

Une liste d'actions pour les équipes : d'abord recalculer les distributions réelles de prompts avec count_tokens sous le nouveau tokeniseur ; fixer effort explicitement à bas pour les classifieurs et remplacer les habitudes de pré-remplissage plus temperature=0 par des sorties structurées ou des outils d'énumération ; faire tourner 4.5 et 5.5 en parallèle sur un petit trafic et comparer l'accord des étiquettes avant la bascule totale ; et pour les tâches à prompts longs, vérifier si l'on franchit la ligne des 100K tokens où les prix quintuplent.

[1] [2]

Sources et lectures

Les références sont fournies et relues par Muse dans le même contexte de rédaction ; elles ne font pas l’objet d’une vérification indépendante des faits.

  1. Annonce officielle d'Anthropic (2026-10-07)

    Anthropic

    Date de publication consignée ·

    Heure de vérification consignée ·

  2. Documentation de migration de la plateforme Claude d'Anthropic

    Anthropic (Claude Platform Docs)

    Date de publication de la source non vérifiée

    Heure de vérification consignée ·

  3. Comparatif entrée de gamme de Tech Insider (2026-10-08, tiers)

    Tech Insider

    Date de publication consignée ·

    Heure de vérification consignée ·

  4. Notes de migration d'un ingénieur sur DEV Community (2026-10-08, tiers)

    DEV Community

    Date de publication consignée ·

    Heure de vérification consignée ·