Deux laboratoires majeurs ont annoncé leurs modèles le même mardi, portant à quatre le compte des grandes sorties de la première moitié de semaine. SpaceX AI a avancé sa propre annonce pour éviter l'ombre des autres, si bien que le calendrier lui-même est devenu un terrain de concurrence. La première question n'était pas la valeur isolée des modèles, mais leur place dans les flux de travail.
L'histoire de la lignée Opus éclaire ce lancement. La version 4.6 avait conquis les utilisateurs, les 4.7 et 4.8 passaient pour des pas mineurs, et Opus 5 n'avait jamais séduit. Puis les familles Mythos et Fable ont occupé la scène, laissant Opus dans l'ombre pendant une longue période.
Opus 5.5 : le tableau officiel
L'annonce officielle porte la date du 22 septembre 2026 : Opus 5.5 égale Fable 5.1 sur la plupart des tâches pour un coût inférieur de 40 pour cent à Opus 5 sur les charges typiques. L'entrée coûte 4 dollars par million de jetons, la sortie 20 ; la lecture de cache a chuté de 60 pour cent à 0,20 dollar. La génération sort plus de 30 pour cent plus vite, et les plafonds de cinq heures montent sur les offres Pro et Max.
Côté sécurité, le modèle inaugure l'ère post-appel à la cadence et a passé un examen externe chez Frontier Design et METR, avec le meilleur score d'alignement jamais mesuré par Anthropic. La biologie et la cybersécurité portent des garde-fous façon Fable, avec un programme de vérification ouvert aux organismes validés. L'équipe de Sam Bowman juge le modèle plus sûr que ses prédécesseurs et estime que sa sortie réduit le risque de désalignement.
Le tableau des scores chiffre l'affirmation : Terminal-Bench 4.0 donne Opus 5.5 à 66,4 pour cent, devant Fable 5.1 à 55,8, Opus 5 à 52,3 et GPT-6 Astra à 57,9. FrontierCode affiche 54,4, CursorBench 57,8, GDPval-AA 1846 (Fable 5.1 à 1735, Opus 5 à 1708, Astra à 1542), HLE outillé 67,7, OSWorld 81,8, Chartography 89,0, AutomationBench 40,0. La recherche agentique scientifique atteint 58,7 et double le 29,0 d'Opus 5 ; Astra mène à 64,6 mais pour un coût par tâche environ cinq fois supérieur.
Le suivi indépendant raconte la même histoire : l'indice Artificial Analysis note Opus 5.5 à 58, contre 53 pour Fable 5.1 et Astra. La synthèse RoboNuggets mesure Opus 5.5 sept points au-dessus d'Opus 5. Le versant Sol se lit autrement, avec GPT-6 Sol proche de 5.6 parce qu'OpenAI visait le coût plutôt que la capacité. Les détails Opus-devant-Fable et Astra-au-sommet reposent chacun sur un terrain de test unique, ce qui mérite mémoire.
Sol et Luna : le front des coûts
OpenAI présente Sol et Luna comme les avancées d'Astra en forme rapide et économique, avec 50 pour cent de remise face aux tarifs promo GPT-5.6. Les identifiants gpt-6-sol et gpt-6-luna sont ouverts sur ChatGPT Work et Codex pour tous les niveaux payants, de Plus à Edu. Luna touche aussi les utilisateurs Free et Go sur l'application de bureau en essai. Sam Altman martèle l'objectif du meilleur modèle par tranche de prix et la logique du prix par tâche.
La baisse des prix change la forme d'usage : des plafonds relevés et des coûts abaissés poussent les équipes à solliciter les modèles plus souvent et plus longtemps. Sur Codex, des allowances qui durent plus que sur Claude Code créent un avantage pratique pour OpenAI au quotidien. Quand les agents de code prennent des missions longues, le coût d'usage continu devient décisif ; Fable et Claude conviennent aux longues courses sans supervision, les modèles GPT aux boucles courtes.
Les verdicts de la communauté se partagent : Sol gagne l'analogie du téléphone de génération S, avec l'essentiel d'Astra près d'un cinquième du prix. L'équipe Every choisit Sol pour la lecture et l'écriture quotidiennes, Opus 5.5 pour le code et le visuel ambitieux. Des plumes annoncent le retour de Claude, Jeffrey Emanuel rapporte des bogues qui résistaient depuis des semaines à Fable et Astra, et Chubby juge que chercher un vainqueur unique pose la mauvaise question.
Premières preuves d'usage
La mesure Box sous Aaron Levy est concrète : 63 pour cent de jetons en moins , 42 pour cent de verbiage en moins, 30 pour cent de vitesse en plus face à Opus 5. Les tâches financières gagnent 39 pour cent de précision, l'analyse des coûts cloud 65 ; les produits grand public ajoutent 17 pour cent, le diagnostic clinique 15. Optiver égale la qualité en moitié de tours pour 40 à 50 pour cent de coût en moins, Kiro passe 40 pour cent d'appels en moins sur moitié de jetons. Un audit de 200 000 lignes s'est fermé en moins de trois heures là où Opus 5 dépassait vingt heures. Le portage HAProxy a pris 9,5 heures contre 12 pour 51 pour cent de coût en moins, et une migration de 680 000 lignes s'est bouclée dans la journée.
La vitrine créative a rempli les flux sociaux : Alex Albert génère de l'animation en pâte à modeler sur une consigne, Chase Lin bâtit un récif corallien interactif, une scène du Golden Gate sort du seul code du modèle. Une vue de Market Street se rend en texture 1906 dans Blender, Jake Eaton partage des tableaux faits de 7 500 lignes de pixels. Tarek fait redessiner son site personnel avec son dossier de présentation, et l'auteur du Daily Brief juge la revue de son propre site par Opus 5.5 claire et actionnable.
Le front de l'écriture ouvre sa propre page de victoire : l'équipe Every parle du texte le plus lisible jamais vu, et la suppression des tirets longs devient symbolique. Les faits clés remontent en tête, les longues sessions restent suivables, la boucle de retour devient plaisante. Makayla Wrigley marie la persona adorée de 4.6 au goût de niveau Fable, l'équipe Macallan s'excuse pour l'ancien modèle et désigne le nouveau. Dans la comparaison d'Eric Tech, la sortie d'Opus 5 paraît longue et emmêlée quand 5.5 revient courte et suivable.
Duel en trois minutes et économie de l'effort
RoboNuggets a soumis la même maquette de page d'accueil avec des références de design identiques aux deux modèles. Sol rend une page propre et professionnelle, avec un flux animé bien rangé. Le camp Opus remporte la manche esthétique avec des animations en points, une application interactive à essayer, des cartes d'information et des graphiques plus lisibles. Le verdict de l'auteur est net : Opus pour le goût d'interface, Sol quand le professionnalisme sobre suffit.
Eric Tech expose l'économie de l'effort : Opus 5.5 à effort moyen rejoint Fable à effort élevé. Le leadership du code agentique à faible effort revient à Opus, les flux d'affaires restent à Astra. Les scores de connaissance du monde réel montent avec la valeur ; l'auteur lie le duel Sol à un sondage des spectateurs et classe la clarification de la communication parmi les plus grandes avancées.
Classe d'animation et carnet d'ingénieur
Andy Lo produit une animation pédagogique dessinée à la main sur une consigne : le rayonnement de Hawking en récit, une catapulte en physique interactive aux réglages modifiables. Le squelette de la consigne tient un bloc de style, une palette, un cadre de théâtre de marionnettes, une narratrice, des transitions papier et un plan en sept scènes horodatées. La narration robotique se corrige via Fish Audio, avec Claude Code qui rend un audio séparé par scène.
Duncan Rogoff réduit le manuel d'ingénieur à trois règles : confier la tâche entière, définir le terminé, dire quand s'arrêter pour demander. Supprimer les formules de réflexion prudente économise jetons et contexte, et le curseur d'effort couvre les besoins de vitesse. Les suivis tapés pendant l'exécution coûtent moins cher qu'attendre puis relire tout le contexte. Le fichier CLAUDE.md reçoit des règles de poursuite et d'arrêt, des gardes d'actions destructrices, des découpes en sous-agents et une liste tasks.md.
Les avertissements généraux de goût échouent côté design ; les motifs bannis comme les fonds crème se listent un par un. Des choix concrets comme les accents italiques de titres, les étiquettes de sections numérotées et les boutons en pilule stoppent la glissade vers l'esthétique IA par défaut. La règle est simple : écrire l'exclu en précis, pas en vague.
La section des limites appartient au compte rendu : les disciplines biologie et cyber façon Fable verrouillent en pratique certains dossiers juridiques et de sciences de la vie. Les équipes en attente de vérification regrettent de ne plus pouvoir se replier sur Opus quand Fable refuse. Le sur-refus touche peu de monde, mais là où il frappe, le modèle devient inutilisable.
Scores Terminal-Bench 4.0
- Opus 5.566,4%
- GPT-6 Astra57,9%
- Fable 5.155,8%
- Opus 552,3%
| Sujet | Résumé |
|---|---|
| Opus 5.5 | Puissance Fable, coût réduit de 40 pour cent |
| Sol et Luna | Moitié prix, pensés pour le quotidien |
| Choix | Sol au quotidien, Opus pour l'ambition |
| Modèle | Terminal-Bench | GDPval-AA |
|---|---|---|
| Opus 5.5 | 66,4% | 1846 |
| Fable 5.1 | 55,8% | 1735 |
| Opus 5 | 52,3% | 1708 |
| GPT-6 Astra | 57,9% | 1542 |
Moments clés
Commentaire de l’IA
"Deux laboratoires de premier plan ont publié le même mardi, alors j'ai relu cinq analyses distinctes à la lumière des annonces officielles et des scores indépendants. Je garde ici ma voix éditoriale : sans emphase, avec les chiffres et les premiers usages réellement constatés."
Évaluation de l’IA
La version la plus solide du récit des coûts est la suivante : à performance égale, le coût recule d'environ 47 pour cent par trimestre depuis 2023, plus vite que le séquençage ADN par quatre, le calcul par six et les batteries par dix-huit. La remarque de Aaron Levy sur Jevons tient donc debout, car des plafonds relevés et des prix abaissés élargissent vraiment le périmètre confié aux agents.
Les limites pèsent tout autant : l'enthousiasme repose souvent sur des mesures isolées, et les nouvelles garde-fous bloquent déjà certains usages professionnels, avec davantage de refus côté juridique et une gestion du temps critiquée. Astra garde la tête en science agentique, donc l'avantage d'Opus reste réel mais partiel.
L'attribution des sources compte pour la confiance : prix et scores phares viennent des annonces Anthropic et OpenAI avec des synthèses secondaires, l'ancrage indépendant vient de l'indice Artificial Analysis, et la vague d'enthousiasme vient des premiers utilisateurs. Le duel Sol promis n'a pas encore eu lieu, donc la confirmation indépendante manque côté Sol.
Ma lecture pratique se partage en deux : Sol et Luna gagnent la lecture, l'écriture et le code léger par leur prix, tandis qu'Opus 5.5 prend le code agentique long et les projets visuels ambitieux. Les équipes ancrées dans Codex restent en place quand les scores se touchent, donc le choix dépend du flux de travail autant que de la supériorité brute.
Sources
10 liens ; 3 d’entre eux sont aussi cités par 11 autres articles. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.
- @youtube.com YouTube — AI Daily Brief : Opus 5.5, Sol et Luna
- @youtube.com YouTube — RoboNuggets : Sol et Opus 5.5 en 3 minutes
- @youtube.com YouTube — Andy Lo : animation pédagogique avec Opus 5.5
- @youtube.com YouTube — Eric Tech : test de code Opus 5.5
- @youtube.com YouTube — Duncan Rogoff : guide ingénieur Opus 5.5
- @anthropic.com https://www.anthropic.com/claude-opus-5-5
Également cité par : The superintelligence race: Musk and Huang on energy, orbital compute and safe agents · Claude Opus 5.5: From Idea to Finished Work in a Single Session · Before Buying the $12,000 Mac Studio, Rent a Test for $2 an Hour · The AI Week That Packed World Models, Open Weights and Data Centers Into Orbit · OpenAI's "o" Assistant, Claude Sonnet 5.5 and MiniMax M3.1: Three Model Bets Before DevDay · The AI Price War: Opus 5.5, GPT-6 Sol and the Quiet Bottleneck of the Agent Era · Decide First, Generate Later: The Jev Plus Opus 5.5 Playbook · The Market Is Underestimating This Massive AI Demand Shift · I Tested Opus 5.5 on 24 Coding Tasks: Fable-Level Quality in Half the Time and Cost · Claude Opus 5.5 in the Wild: One-Hour Award Site, 3D Space Voyage and a Single Dashboard
- @platform.claude.com https://platform.claude.com/docs/en/models/opus-5-5/overview
Également cité par : Claude Opus 5.5: From Idea to Finished Work in a Single Session · I Tested Opus 5.5 on 24 Coding Tasks: Fable-Level Quality in Half the Time and Cost · Claude Opus 5.5 in the Wild: One-Hour Award Site, 3D Space Voyage and a Single Dashboard
- @labellerr.com https://www.labellerr.com/blog/claude-opus-5-5-vs-opus-5/
- @openai.com https://openai.com/index/introducing-gpt-6-sol-and-luna/
Également cité par : Space Bunny Alpha: Inside OpenRouter's Free Anonymous AI Experiment · The AI Week That Packed World Models, Open Weights and Data Centers Into Orbit · The AI Price War: Opus 5.5, GPT-6 Sol and the Quiet Bottleneck of the Agent Era · The Market Is Underestimating This Massive AI Demand Shift
- @community.openai.com https://community.openai.com/t/announcing-gpt-6-sol-and-gpt-6-luna-in-the-api-codex-and-chatgpt/1399925
opus 5.5 · gpt-6 sol · gpt-6 luna · modèles ia · agents de code · tarifs des modèles