Aller au contenu
geekus
ActuModèles·7 min de lecture

Claude Haiku 5.5 : le petit modèle d'IA d'Anthropic

Haiku 5.5 d'Anthropic coûte en moyenne 75 % de moins que Haiku 4.5. Compte 0,10 dollar le million de tokens en entrée, sous 100 000 tokens. Les scores annoncés sont en effort maximal, pas celui par défaut.

next.ink/260659/chez-anthropic-haiku-5-5-prend-la-releve-des-petits-modeles-rapides/
Capture de la page de Claude Haiku 5.5
Sommaire11 parties

Claude Haiku 5.5 est le nouveau petit modèle d’IA d’Anthropic, présenté le 7 octobre comme le moins cher, le plus rapide et le plus capable de sa catégorie. Il vise les tâches répétitives à fort volume, comme les résumés, la classification ou l’assistance client. Les gains annoncés sont réels, mais plusieurs nuances, sur les prix comme sur les scores, méritent d’être connues avant de s’y fier.

En bref

  • Haiku 5.5 coûte en moyenne 75 % de moins que Haiku 4.5, selon Anthropic.
  • Tarif de base : 0,10 dollar le million de tokens en entrée, 0,50 dollar en sortie, sous 100 000 tokens.
  • Fenêtre de contexte d’un million de tokens et premier réglage d’effort pour un Haiku.
  • Les scores publiés sont en effort maximal, pas dans le mode Moyen par défaut.
  • Pour le code complexe, Anthropic recommande toujours Sonnet 5.5 ou Opus 5.5.

Ce qu’est Claude Haiku 5.5

Anthropic décline ses modèles Claude en trois familles : Haiku, la plus petite et la moins chère, Sonnet, intermédiaire, et Opus, la plus puissante. Haiku 5.5 succède à Haiku 4.5, sorti en octobre 2025. Aucune version 5 de Haiku n’avait été lancée entre les deux, et le modèle n’avait pas été mis à jour depuis près d’un an.

Anthropic le destine aux tâches à fort volume : résumés, compaction (condenser l’historique d’une longue conversation pour qu’un agent puisse continuer), requêtes dans une base de données, classification. Il est aussi conçu pour les usages où la rapidité compte, comme l’assistance client en direct et le pilotage d’un navigateur.

Ce qui change par rapport à Haiku 4.5

La fenêtre de contexte, c’est-à-dire la quantité de texte que le modèle peut traiter d’un coup, passe à un million de tokens en entrée et 128 000 en sortie. Haiku 4.5 offrait 200 000 et 64 000. Haiku 5.5 est aussi le premier Haiku doté d’un réglage d’effort, positionné sur Moyen par défaut, qui permet d’arbitrer entre coût et qualité des réponses.

Anthropic indique par ailleurs que les garde-fous de cybersécurité sont plus stricts que ceux de Haiku 4.5, mais moins que ceux de Sonnet 5.5. Ils autorisent davantage de tâches défensives et bloquent toujours les tests d’intrusion. Les organisations qui ont des besoins plus larges en biologie ou en cybersécurité peuvent candidater à des programmes de vérification.

Les tarifs de Haiku 5.5 en détail

Pour les requêtes de moins de 100 000 tokens, Haiku 5.5 coûte 0,10 dollar le million de tokens en entrée et 0,50 dollar en sortie, contre 1 et 5 dollars pour Haiku 4.5. Au-delà de 100 000 tokens, les prix sont multipliés par cinq, soit 0,50 et 2,50 dollars, ce qui reste inférieur à ceux de Haiku 4.5. Selon Anthropic, environ 90 % des requêtes adressées à Haiku 4.5 restaient sous ce seuil.

La baisse est donc conditionnelle. Haiku 5.5 utilise un nouveau tokenizer, l’outil qui découpe le texte en tokens, et consomme un peu plus de tokens pour le même travail. Anthropic parle d’une facture environ 75 % plus basse en moyenne, et non de 90 %. Selon Artificial Analysis, le modèle est aussi plus verbeux que son prédécesseur, tout en offrant un coût par tâche plus favorable.

Le tarif est identique à celui de GPT-6 Luna, le petit modèle d’OpenAI. La majoration de Luna intervient toutefois à 272 000 tokens, contre 100 000 pour Haiku 5.5.

Les performances annoncées et leur limite

Anthropic publie des gains importants : 39,2 % sur Terminal-Bench 4.0 (code en ligne de commande) contre 0 % pour Haiku 4.5, 72,4 % contre 15,7 % sur OSWorld 2.1 (usage d’un ordinateur), et 1 620 contre 735 sur GDPval-AA v2.1. Haiku 5.5 devance GPT-6 Luna sur chaque test où ce dernier figure, par exemple 39,2 % contre 16,4 % sur Terminal-Bench 4.0.

Le point à retenir : ces scores sont obtenus en effort maximal, pas dans le mode Moyen par défaut. Selon Next, le score Terminal-Bench 4.0 tombe à 20,3 % en Moyen. Frandroid note de son côté que ces chiffres viennent d’Anthropic et qu’aucune mesure indépendante n’était encore disponible à la date de son article.

L’écart avec Sonnet 5.5 reste net : 70,6 % contre 39,2 % sur Terminal-Bench 4.0. Anthropic le reconnaît lui-même : ces résultats servent de référence, et Haiku 5.5 convient mieux aux tâches étroites qui auraient été trop coûteuses avec les versions précédentes.

À quoi sert Haiku 5.5 concrètement

Anthropic cite plusieurs usages : résumer des textes en masse, classer des informations, interroger une base de données, répondre à des clients en temps réel. Haiku 5.5 peut aussi servir de sous-agent, c’est-à-dire d’assistant à qui un modèle plus puissant, Opus 5.5 ou Sonnet 5.5, confie les petites tâches d’un projet de code.

Des clients cités par Anthropic rapportent leurs essais :

Utiliser Claude Haiku 5.5 : disponibilité

Haiku 5.5 est disponible depuis le 7 octobre sur l’ensemble des plateformes, dont Amazon Web Services, Google Cloud et Microsoft Azure. Sur la Claude Platform, l’identifiant à utiliser est claude-haiku-5-5. Il tourne sur les serveurs d’Anthropic et s’interroge par l’API, il ne s’installe pas sur un appareil.

Frandroid indique que Haiku 4.5 passe dans la liste des anciens modèles, avec un maintien garanti jusqu’au 15 octobre 2026 et aucune date de retrait fixée. Anthropic publie un guide de migration.

Les autres annonces tarifaires d’Anthropic

Le prix des lectures en cache de Sonnet 5.5 est divisé par deux, de 0,20 à 0,10 dollar le million de tokens. Anthropic estime que Sonnet 5.5 revient ainsi environ 20 % moins cher sur la plupart des tâches d’agent.

Les abonnés Max et Team reçoivent en outre un crédit API mensuel : 100 dollars pour Max 5x, 200 dollars pour Max 20x et jusqu’à 500 dollars pour Team, à répartir entre les membres. Les kits de développement Python et TypeScript gagnent enfin une prise en charge, en bêta, de l’usage d’un ordinateur et d’un navigateur.

  • Asana : plus de 30 % de latence en moins sur les tâches de ses agents, par rapport au modèle utilisé aujourd’hui.
  • AlphaSense : un score de 0,84 contre 0,76 avec Haiku 4.5, sur 400 requêtes de test.
  • Box : 11 points de mieux que Haiku 4.5, pour environ la moitié du temps de réponse.

Quelques repères

  • Token : Un token est un fragment de mot, l’unité que les fournisseurs d’IA comptent pour mesurer les textes traités et facturer l’usage.
  • API : Une API est une interface qui permet à un programme de dialoguer avec un service, ici un modèle d’IA hébergé sur des serveurs distants.
  • Sous-agent : Un sous-agent est un assistant IA à qui un modèle principal délègue une partie d’une tâche, souvent plus simple ou plus répétitive.

Questions fréquentes

Combien coûte Claude Haiku 5.5 ?

Claude Haiku 5.5 coûte 0,10 dollar le million de tokens en entrée et 0,50 dollar en sortie pour les requêtes de moins de 100 000 tokens. Au-delà, les tarifs sont multipliés par cinq. Anthropic annonce en moyenne 75 % de coût en moins que Haiku 4.5.

Claude Haiku 5.5 est-il meilleur que GPT-6 Luna ?

Selon le tableau d’Anthropic, Claude Haiku 5.5 devance GPT-6 Luna sur tous les tests où ce dernier figure, au même prix de base. Ces chiffres viennent d’Anthropic et sont mesurés en effort maximal, sans mesure indépendante au moment de l’article de Frandroid.

À quoi sert Claude Haiku 5.5 ?

Claude Haiku 5.5 sert aux tâches à fort volume : résumés, classification, requêtes de bases de données, assistance client et pilotage de navigateur. Il peut aussi servir de sous-agent pour Opus 5.5 ou Sonnet 5.5. Pour le code complexe, Anthropic recommande ces deux derniers.

Où utiliser Claude Haiku 5.5 ?

Claude Haiku 5.5 est disponible via l’API d’Anthropic sous l’identifiant claude-haiku-5-5, ainsi que sur Amazon Web Services, Google Cloud et Microsoft Azure. Il ne s’installe pas en local.

À retenir

Claude Haiku 5.5 abaisse nettement le coût des tâches répétitives à fort volume, avec en moyenne 75 % de moins que Haiku 4.5. Ses scores les plus flatteurs sont mesurés en effort maximal, et Anthropic réserve toujours le code complexe à Sonnet 5.5 et Opus 5.5.

Sources

anthropicclaudehaikullmapisous-agent
Dans le même genre

Des fiches proches.

toute la famille
À lire aussi

Les dernières fiches.

tout l'annuaire

Le Carnet de Geekus · chaque vendredi

Les trouvailles de la semaine, dans ta boîte mail.

Un email, cinq minutes de lecture. En français, gratuit, sans publicité.

S'inscrire au Carnet →
  1. Le spécimen de la semaine, expliqué à fond
  2. L'actu IA en bref
  3. Les autres trouvailles et le mot de la semaine