Claude Haiku 5.5 est le nouveau modèle d’Anthropic destiné aux tâches rapides, répétitives et nombreuses. Présenté le 7 octobre 2026, il combine des tarifs réduits avec un effort de raisonnement réglable. La question concrète est de savoir quels travaux peuvent être confiés à un modèle économique sans dégrader le résultat.
Il ne remplace pas automatiquement Sonnet ou Opus. Résumer un document ou classer des demandes n’impose pas les mêmes exigences qu’une modification logicielle complexe. Le prix doit être comparé aux erreurs, aux nouvelles tentatives et au temps de vérification.
Claude Haiku 5.5 : deux tarifs autour de 100 000 tokens
La grille officielle distingue deux niveaux selon la longueur du prompt. La limite compte réellement : le tarif inférieur ne peut pas être utilisé pour estimer indistinctement toutes les longues requêtes.
| Coût par million de tokens | Prompts jusqu’à 100 000 tokens | Prompts au-delà de 100 000 tokens |
|---|---|---|
| Entrée | 0,10 dollar | 0,50 dollar |
| Sortie | 0,50 dollar | 2,50 dollars |
| Lecture du cache | 0,01 dollar | 0,05 dollar |
| Écriture du cache à cinq minutes | 0,125 dollar | 0,625 dollar |
Ces chiffres sont des tarifs API, pas le prix d’un abonnement conversationnel. Durée du cache, traitement régional, fournisseur cloud et conditions applicables peuvent modifier la facture. Il faut estimer le chemin d’utilisation réel, sans mélanger plusieurs offres.
Exemple strictement arithmétique : un million de tokens d’entrée hors cache et 200 000 tokens de sortie, répartis sur des requêtes dans la tranche inférieure, coûtent 0,20 dollar pour ces deux postes. Dans la tranche supérieure, les mêmes volumes coûtent 1 dollar, avant services complémentaires, taxes et ajustements.
Une baisse de tarif n’est pas une économie garantie par tâche
L’annonce de lancement distingue le prix unitaire réduit et l’économie moyenne estimée par rapport à Haiku 4.5. Une réduction de 90 % sur certains tarifs ne signifie pas que chaque projet coûtera exactement 90 % de moins.
Le modèle peut produire davantage de tokens, employer un effort différent ou nécessiter plusieurs essais. Multiplier l’ancienne facture par une remise affichée est insuffisant. Il faut mesurer le travail réel, y compris les requêtes dépassant la limite de longueur.
Un essai utile conserve des exemples réels, les résultats attendus, la consommation et les besoins de révision. Si le petit modèle déclenche souvent un second appel à un modèle supérieur, une économie reste possible, mais elle se calcule sur toute la chaîne.
L’effort réglable doit être évalué
La documentation sur l’effort explique le contrôle disponible sur les modèles compatibles. L’objectif d’un service n’est pas de choisir systématiquement la valeur maximale, mais le niveau suffisant pour sa tâche.
Une classification simple ne bénéficie pas nécessairement du raisonnement requis par un cas ambigu. Séparez les exemples faciles des exemples difficiles. Une bonne moyenne peut masquer des erreurs sur les demandes dont les conséquences sont les plus coûteuses.
Avant de remplacer un modèle en production, consultez le guide de migration. La compatibilité des noms ne garantit pas celle des comportements. Vérifiez paramètres, résultats et régressions dans votre propre environnement.
Un sous-agent utile reçoit une mission limitée
Une architecture intéressante sépare les responsabilités. Un modèle principal coordonne une modification, tandis qu’un sous-agent reçoit une question bornée : rechercher une convention, synthétiser un fichier sélectionné ou préparer un classement vérifiable. Cette limite facilite le contrôle du résultat et du coût.
Notre guide des fonctions de Claude Code explique l’importance de la mémoire, du contexte et des limites des différents canaux. Un modèle moins cher ne corrige pas une mission mal définie ; il peut seulement multiplier les éléments à relire.
Ne déléguez pas implicitement autorisations, suppressions ou modifications de permissions. Le modèle peut accomplir une sous-tâche sémantique, tandis que le processus de contrôle conserve la responsabilité des actions sensibles. Un résumé exact n’est pas une autorisation d’agir.
Haiku et Sonnet : comparer le coût du résultat
La bonne question n’est pas « lequel gagne toujours ? », mais « lequel termine ce travail à un coût acceptable ? ». Une modification longue avec de nombreuses dépendances peut justifier un modèle supérieur. Un travail court, borné et vérifiable constitue un meilleur candidat pour Haiku.
Anthropic a également réduit le prix des lectures de cache de Sonnet 5.5. Une comparaison fondée uniquement sur le tarif d’entrée devient donc encore moins pertinente. Un agent réutilisant souvent son contexte n’a pas la même structure de coûts qu’une requête de classement isolée.
La méthode de notre comparaison des modèles d’IA reste valable : constituer des exemples représentatifs, mesurer erreurs, latence et achèvement réel. Un benchmark publié ne se transpose pas automatiquement à votre produit.
Les questions à poser avant l’adoption
- Combien de requêtes dépassent réellement 100 000 tokens ?
- Quels résultats peuvent être contrôlés automatiquement ?
- Combien coûte la correction d’une réponse erronée ?
- Quand faut-il transmettre le travail à Sonnet, Opus ou une personne ?
- Les conditions du fournisseur correspondent-elles aux tarifs comparés ?
L’identifiant sur la Claude Platform est claude-haiku-5-5. Pour les autres accès, vérifiez le catalogue et les conditions du service. La disponibilité d’un modèle ne garantit pas un usage illimité par tous les abonnements et toutes les interfaces.
Commencez par un déploiement assez limité pour être observé. Comparez un échantillon fixe avec le modèle précédent et examinez les échecs difficiles, pas seulement les moyennes. Une migration progressive permet de voir si des appels moins chers produisent aussi un travail terminé moins cher.
Claude Haiku 5.5 élargit les tâches pour lesquelles un petit modèle peut devenir économiquement intéressant. Le bénéfice est crédible lorsque la mission est claire, les erreurs observables et la transmission à un système supérieur prévue dès le départ.
