Retour au fil

Claude Haiku 5.5 : le modèle le moins cher et le plus rapide d'Anthropic

Anthropic a lancé Claude Haiku 5.5 le 7 octobre : avec un prix d'entrée à 0,10 dollar par million de jetons, un réglage d'effort ajustable et des scores supérieurs à GPT-6 Luna, l'économie des petits modèles bascule.

Importé dans Nodesdaily : (UTC+03:00)
Voir sur YouTube — 6gfACqBAKfw
Options de lecture

La lecture vocale n’est pas disponible dans ce navigateur.

Loupe à concepts

Choisissez un terme technique de cette vue pour lire sa définition générale, un exemple pédagogique et son usage dans l’article.

Aucun terme de notre glossaire n’a été trouvé dans cette vue. Le glossaire ne couvre pas encore tous les termes.

Anthropic vit les semaines les plus décisives de son histoire : selon QZ.com, l'entreprise prévoit de lancer sa tournée d'investisseurs dans la semaine du 9 novembre pour une cotation avant Thanksgiving, avec une valorisation entre 1 800 et 2 000 milliards de dollars. Claude Haiku 5.5 est arrivé au milieu de ce tableau, le mercredi 7 octobre. Pour Anthropic , le calendrier n'a rien d'un hasard : face à OpenAI, la société veut que son modèle le plus petit et le plus rapide capte le travail quotidien des développeurs.

Le lancement complète la trilogie 5.5 : Opus 5.5 est sorti le 22 septembre, Sonnet 5.5 le 28 septembre. Comme l'a résumé Decrypt, Haiku 5.5 se présente comme le modèle le moins cher et le plus rapide jamais livré par l'entreprise. Le présentateur ne cache pas sa surprise de voir enfin cette mise à jour : Haiku 4.5 n'avait pas évolué depuis près d'un an et restait à la traîne.

Tarifs : une coupe franche avec un seuil à 100 000 jetons

Les tarifs sont agressifs : 0,10 dollar par million de jetons d'entrée et 0,50 dollar par million de jetons de sortie jusqu'à 100 000 jetons. Selon l'annonce d'Anthropic, cette grille se situe 90 % en dessous des 1 et 5 dollars de Haiku 4.5 ; au-delà de 100 000 jetons, la remise tombe à 50 % (0,50 et 2,50 dollars). Le chiffre moyen de l'entreprise place les coûts d'exploitation environ 75 % plus bas , car près de 90 % des requêtes de l'ancien modèle restaient sous le seuil. SimonWillison signale un détail subtil : le nouveau tokenizer découpe le même texte en environ 1,25 fois plus de jetons, si bien que la remise réelle est plus douce que la grille affichée.

Le prix s'aligne exactement sur GPT-6 Luna, le petit modèle d'OpenAI sorti le 22 septembre aux mêmes tarifs de 0,10 et 0,50 dollar. Sous 100 000 jetons, les deux modèles coûtent pareil ; au-dessus, le tableau change, car Luna maintient ses tarifs jusqu'à 272 000 jetons avant de passer à 0,20 et 0,75 dollar. Les lignes de résultats rapportées par Decrypt justifient la dépense : Haiku 5.5 devance Luna sur les six tests publiés. La conclusion de SimonWillison est nette : Haiku gagne sur les contextes courts, Luna sur les longs.

Résultats : un grand bond pour un petit modèle

Le tableau de l'annonce officielle montre l'ampleur du bond : sur OSWorld 2.1, qui mesure l'usage réel d'un ordinateur, Haiku 5.5 atteint 72,4 % contre 15,7 % pour Haiku 4.5 et 48,9 % pour Luna. Le test de programmation agentique Terminal-Bench 4.0 est encore plus parlant : 39,2 % contre 0,0 % , avec Luna à 16,4 %. Les scores de travail intellectuel affichent 1 620 contre 735 sur GDPval-AA (Luna à 1 437), 46,4 % contre 42,4 % sur FrontierCode et 46,4 % contre 6,4 % sur le test visuel Chartography (Luna à 29,1 %). La compilation complète de Technology Org montre que le seul rival solide écarté de la comparaison, Sonnet 5.5 (70,6 % sur Terminal-Bench par exemple), joue encore une ligue au-dessus.

Les chiffres des clients en accès anticipé confirment le tableau : selon SiliconAngle, Asana a vu la latence de son produit agentique chuter de plus de 30 % , avec une inférence jusqu'à 2,5 fois plus rapide par tour. HubSpot a enregistré 92,8 sur sa suite de tests CRM, son meilleur score à ce jour. Le rapport de Box est plus détaillé : 60 contre 49 sur l'évaluation du travail complexe, environ 27 % de jetons en moins et un temps divisé par deux, avec un écart montant à 19 points sur la rédaction de rapports chiffrés.

Effort réglable et points d'accès

Haiku 5.5 est le premier modèle Haiku à proposer un réglage d'effort : le développeur choisit un raisonnement faible, moyen, élevé ou maximal selon la tâche ; le raisonnement ne se désactive pas et le défaut est le niveau moyen. Les courbes publiées par Anthropic montrent la précision grimper avec le coût. L'expérience ludique de SimonWillison rend l'arbitrage concret : un pélican dessiné à effort faible prend 7 secondes pour 0,09 cent, contre 5 minutes 9 secondes et 3,38 cents au maximum.

L'accès est large : le modèle est disponible dans l'assistant Claude, dans Claude Code, via l'API et sur les nuages d'Amazon, Google et Microsoft, avec le nuage public américain en prime. SiliconAngle note deux remises supplémentaires : le prix de lecture du cache de Sonnet 5.5 est divisé par deux, de 0,20 à 0,10 dollar, soit environ 20 % de moins sur l'essentiel du travail agentique. Des crédits API mensuels adoucissent les abonnements : 100 dollars pour Max 5x, 200 pour Max 20x et jusqu'à 500 dollars mutualisés pour les équipes. Decrypt précise que les crédits correspondent au prix de l'abonnement et ne se reportent pas.

Tests en vidéo : des jeux au design

Les tests du présentateur vont au-delà des chiffres : le clone de Mac sommaire produit par Haiku 4.5 il y a 11 mois voisine le clone de Minecraft généré par Haiku 5.5, avec grottes et physique de l'eau. L'essai le plus extrême produit un squelette de jeu de zombies façon Call of Duty ; un salon isométrique convainc par ses textures et sa lumière. L'exemple communautaire marquant vient d'un utilisateur nommé Theo, qui a bâti un donjon à l'ambiance changeante en une seule heure. Le design animé impressionne le plus : une animation demandant 40 minutes aux modèles frontières sort de Haiku 5.5 en environ 15 minutes .

Le verdict du présentateur tient à l'axe prix-performance : le modèle coûte aussi peu que Luna mais le surclasse nettement, et il termine plus vite dans les duels face à Grok. Son comportement proche de Sonnet sur les tâches simples en fait un sous-agent naturel dans Claude Code : le grand modèle dessine le plan, le petit prend les sous-tâches répétitives. L'étiquette d'outil quotidien prend sens dans cette architecture — non un modèle sans limites, mais un équipier bon marché qui travaille sans relâche.

Visualization: nodesdaily AI
AtoutValeur
Prix0,10 dollar en entrée, 0,50 en sortie
OSWorld 2.172,4 %, devant Luna
Réglage d'effortPremier Haiku ajustable

Moments clés

  1. Ouverture : Anthropic vers la bourse
  2. Haiku 4.5 contre 5.5
  3. Prix et seuil des 100 000
  4. Comparaison avec Luna
  5. Résultats des tests
  6. Effort réglable
  7. Le jeu d'une heure de Theo

Commentaire de l’IA

"La course des petits modèles ne se joue plus seulement sur le prix ; la précision s'est invitée à la table. Haiku 5.5 ressemble au premier modèle bon marché sans excuses, même s'il faut voir la facture des contextes longs avant de trancher."

Évaluation de l’IA

L'objection la plus forte se tient dans l'ombre de la vitesse : l'équipe de Decrypt note que le modèle a répondu à une simple question de logique presque instantanément — et faux. La confiance aveugle coûte cher, surtout face aux clients. L'enthousiasme du présentateur mérite aussi une décote : les tests portent sur des tâches choisies, à des réglages choisis, et toutes les charges ne reproduiront pas le tableau.

Les limites sont clairement tracées : au-delà de 100 000 jetons, l'avantage prix passe à Luna (SimonWillison), Anthropic lui-même oriente la programmation agentique complexe vers Sonnet et Opus (SiliconAngle), et les tests d'intrusion comme les techniques offensives restent bloqués. Haiku 5.5 n'est donc pas le modèle de tous les travaux, mais celui des tâches étroites, répétitives et sensibles à la vitesse.

Le mobile de l'entreprise mérite un regard : l'objectif de cotation entre 1 800 et 2 000 milliards de dollars rapporté par QZ.com voisine un chiffre d'affaires 2025 de 4,6 milliards et une perte nette proche de 42 milliards (surtout comptable). Casser les prix à ce point ressemble à une manœuvre pour élargir la base de développeurs avant l'introduction en bourse. Les témoignages clients partagés par Anthropic sont aussi des exemples choisis ; sans vérification indépendante, il est tôt pour prendre le tableau au pied de la lettre.

Le message pratique est net : les équipes au fort volume de résumés, de classements, de requêtes de bases et de support en direct peuvent lancer un petit essai et mesurer le coût directement. Pour les architectures d'agents, la recette est fixée : le grand modèle planifie, Haiku répète. Les crédits API mensuels des formules Max et Équipe rendent le ticket d'essai encore moins cher.

Sources

8 liens ; aucun autre article publié ne les cite. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.

claude haiku · anthropic · intelligence artificielle · llm · tarifs api

Suivre le sujet

Avant cet article

Un court ordre de lecture des articles antérieurs reliés à cet événement par un éditeur.

Preuves et sources

Consultez les passages sources, leurs versions et leur origine.

LIRE AVEC LES SOURCES

Comprendre cet article.

Vérification du compte…