Les semaines d'actualité IA sont rarement aussi denses : Anthropic a ouvert avec un petit modèle plein d'allant, OpenAI a servi une nouveauté presque chaque jour, xAI a redéfini son assistant, Google a joué la carte entreprise et Mistral a tiré depuis l'Europe sa plus grosse cartouche ouverte. L'animateur ne se contente pas d'énumérer ; il suit la veine commune. Cette veine, ce sont les agents qui débordent de la fenêtre de dialogue pour prendre en main tout l'ordinateur. Guerre des prix, réponses visuelles, notes hors ligne et poids ouverts ressemblent aux couloirs d'une même course.
Haiku 5.5 : rapide, pas cher, sans prétention
Claude Haiku 5.5 arrive comme le benjamin de la famille, conçu pour les corvées rapides à gros volume. Résumés, compactions, requêtes de bases de données, classification et rôle de sous-agent sur les tâches de code : voilà son terrain. La grille tarifaire rend l'argument concret : environ 10 centimes le million de jetons d'entrée jusqu'à 100 000, puis 50 centimes ; la sortie démarre à 50 centimes pour grimper à 2,50 $. Ce tableau est confirmé par la page d'annonce d'Anthropic, qui signale un coût d'exploitation moyen en recul d'environ trois quarts par rapport à la génération Haiku précédente. Les abonnés mensuels garderont de toute façon les grands modèles ; la vraie scène d'Haiku, c'est le côté API au compteur.
Les mesures sont honnêtes : Haiku 5.5 reste derrière Sonnet 5.5 sur le travail de connaissance, 1620 et 1578 contre 1840 et 1824, et atteint 72,4 % en usage d'ordinateur face à 83,9 %. Le code agentique s'établit à 39,2 %, l'examen de culture générale corsé à 45,9 % sans outils. Le détail curieux, c'est l'appétit : le modèle brûle le deuxième plus gros volume de jetons par tâche, donc l'économie vient du prix unitaire, pas de la frugalité. Sur le mini-classement de l'animateur, il navigue au milieu du peloton, cité aux côtés de l'entrée GPT-6 Luna d'OpenAI. Pour les développeurs qui font tourner des tâches simples via l'assistant de code, le duo vitesse-prix suffit pourtant comme justification.
Tableaux de bord, explications animées et grief
La semaine d'Anthropic ne se résume pas au modèle : tableaux de bord en direct et explications animées ont rejoint les annonces. Le côté tableau se branche sur BigQuery, Databricks, Snowflake et Salesforce pour bâtir des vues toujours fraîches, disponibles sur de nombreux forfaits payants. Le côté explications animées n'a ouvert qu'en bêta sur les forfaits équipe et entreprise. L'animateur y exprime un grief sincère : abonné à 200 $ par mois au forfait supérieur avec promesse d'accès anticipé, il digère mal que la nouveauté parte d'abord vers des forfaits d'équipe moins chers. Comme il le note, le fond n'est pas neuf ; l'animation en JavaScript et les cadres prêts à l'emploi construisaient déjà des tableaux. La nouveauté, ce sont des étapes d'installation en moins, tout étant ramené à l'intérieur du modèle.
Le segment sponsorisé de la semaine montre une équipe de préparation à trois robots bâtie sur Hyper Agent : des rôles de recherche, de conception de questions et de production qui transforment un nom d'invité en conducteur d'émission de 30 minutes. Cela reste un argumentaire produit, mais le motif enseigné voyage bien : ne donner à chaque agent que les outils exigés par son poste, demander un plan avant l'exécution et garder toute l'équipe sur le même jeu d'instructions. Dans une semaine noyée d'agents, cette note de discipline vaut autant que les annonces elles-mêmes.
GPT-6 et l'interface visuelle
Le titre OpenAI, c'est GPT-6 qui descend vers les 1,2 milliard d'utilisateurs hebdomadaires du dialogue avec Intelligent UI à bord. La nouvelle couche répond par des schémas de vélo éclatés, des guides de garde-robe et des parcours à cocher plutôt que par de la prose plate ; le modèle marie lui-même texte, visuels et pièces interactives selon la question. La page d'annonce d'OpenAI le rend tangible avec un exemple de bicyclette : cadre, roues, transmission, freins et cockpit expliqués comme cinq systèmes liés que le lecteur explore au toucher. Dans l'essai de l'animateur, l'ancien modèle répondait en texte plat quand le nouveau servait images et puces. Ajoutez la nouvelle d'octobre des variantes Astra et Soul 50 % plus rapides, et la semaine OpenAI se lit comme la vitesse main dans la main avec le visuel.
Les gouttes quotidiennes ne s'arrêtent pas là : la révision automatique s'ouvre gratis à tout utilisateur connecté, le flux d'approbation devient un mode qui ne dérange qu'en cas de vrai souci, et la tarification développeur passe de cinq paliers à trois avec des limites assouplies en haut. La variante Soul gagne un mode ultrarapide : le standard facture 2 $ le million de jetons d'entrée et 10 $ la sortie, tandis que le mode huit fois plus véloce coûte environ six fois plus cher et exige le forfait à 500 $. La redirection devient instantanée aussi : une image de chien à moitié générée pivote en loup d'un toucher. Pour un monteur pressé, le mode ultrarapide qui se promène à l'écran semble tentant, portefeuille mis à part.
Le module de réunions et l'interface de décisions forment les deux poids lourds discrets de la semaine. Le module, parallèle net de Granola, écoute micro et audio système puis verse comptes rendus, résumés et prochaines étapes dans la mémoire du dialogue ; les notes peuvent rester privées ou partagées. L' API Decisions rend des verdicts au lieu de prose : prédicats avec probabilités, choix parmi des options fixées et scores sur des échelles ordonnées, en prenant texte et images ensemble pour les tâches d'aiguillage, de modération et de notation. Le dossier TopFive cloue la tarification : 10 centimes le million de jetons d'entrée, sortie gratuite, réponses annoncées dix fois plus vives que l'interface classique, disponibilité générale dans quelques semaines. Aucune place pour elle dans la fenêtre de dialogue ; c'est l'ouvrier silencieux de l'arrière-boutique développeur.
Grokbot et le flux X
L'assistant de xAI, Grokbot , a vécu le virage le plus stratégique de la semaine : au lieu de son modèle par défaut, il choisira le meilleur moteur dorsal par tâche, avec Opus 5.5, Midjourney et Suno cités. Reste à savoir si les modèles OpenAI rejoindront le panier ; vu la brouille des patrons, la question flotte. Le dossier TechRepublic confirme le mouvement et décrit le produit comme une couche d'orchestration plutôt qu'une coquille de modèle. La seconde nouveauté, c'est le câblage profond à X : veille, lecture et repérage de tendances intégrés, des alertes de viralité aux idées de billets tirées de votre niche. Dans l'essai de l'animateur, le robot a passé au crible ses 75 derniers billets, trouvé ses meilleures et pires entrées IA et signalé 10 h-13 h Pacifique comme sa fenêtre dorée. Face aux rivaux à dialogue unique, un toit de robots spécialistes en tri de courriel, recherche et orchestration place Grokbot dans un endroit distinct.
Poids ouverts : Le Chonk et Beam
La nouvelle ouverte de la semaine est venue de France : Mistral Large 4 , surnommé Le Chonk, s'ouvre en préversion comme un modèle de 1 000 milliards de paramètres dont 52 milliards actifs, multimodal natif. L'annonce Mistral indique un entraînement sur 3 800 unités Grace Blackwell dans ses propres centres européens, une tête des modèles ouverts sur les charges d'entreprise comme la sécurité, la finance et le droit, et des devants sur des rivaux fermés en localisation visuelle. Les poids tombent en fin de mois ; d'ici là, chefs cyber et partenaires vérifiés le testent sur le terrain. Sur le banc de l'animateur, une réponse de 9 675 jetons a pris deux minutes et demie pour atterrir au milieu du peloton, dans la même ligue que les chinois Kimi K3 et GLM. La seconde histoire ouverte vient de l'américain Reflection Beam à 501 milliards de paramètres, un peu en retrait de rivaux semblables en premiers tests et pas encore public. Les deux partagent une phrase : des poids ouverts géants, trop gros pour les machines personnelles, qui font de l'œil aux institutions voulant leurs propres serveurs.
Google, Hark, Muse et notes de politique
Google a fermé sa semaine sur trois fronts : le bâtisseur de jeux Playground s'ouvre aux majeurs américains avec des titres prêts inclus ; une appli de notes hors ligne prend les réunions en minutes sans rien expédier vers aucun nuage ; et un agent Gemini d'entreprise promet l'orchestration depuis tout système via Workspace, Microsoft 365 et Slack, avec une variante Argon chuchotée toute proche. La détection a grandi aussi : le dossier TheVerge écrit que les vérifications de filigrane et C2PA glissent vers les surfaces de recherche et Chrome, pour que Lens et l'entourage circulaire demandent à un panneau unique d'où vient une image.
Hark Pro , issu de la nouvelle société du fondateur de Figure Robotics, s'est lancé comme un robot qui manie l'ordinateur, avec un accueil à panneaux, des suggestions proactives et un discours de confidentialité, gratuit au départ et visant un matériel 2027 selon le dossier TechCrunch. Meta a porté son robot Muse vers les cartes de bricolage : le dossier ChipDispatch écrit que des kits pour ESP32 et Raspberry Pi livrent des recettes comme un pense-bête à encre électronique, un bâton pour grand écran et une version tactile de poche. Deux petites notes pour fermer : les règles d'usage d'Anthropic gagnent un bannissement de la cruauté soutenue et sans objet envers les modèles, cadré sur les extrêmes ; et la prévision d'un économiste Nobel, 5 % seulement du travail humain vers les machines en dix ans, détonne avec l'ambiance de la salle.
Une phrase résume toute la semaine : tout le monde sprinte vers le même bouquet de compétences, et la différence glisse du produit lui-même vers l'écosystème d'appartenance. Comme le dit l'animateur, une fois que Muse, Dots, Grokbot et les robots Google font les mêmes tâches, choisir devient une affaire de fidélité ; un Muse qui ne coûte rien renforce son jeu. La leçon pratique en trois volets : les tâches répétitives en masse appartiennent aux modèles rapides et pas chers via l'API, l'apprentissage et la découverte méritent les grands modèles à réponses visuelles, et la première question d'agent devrait porter sur l'autorisation de données, pas sur la capacité. Dans une saison de prix mouvants et d'accès anticipés verrouillés, tenir ces trois volets séparés reste la seule stratégie solide. Les gouttes de la semaine prochaine redessineront la carte ; au moins les lignes d'aujourd'hui sont nettes.
| Sujet | Essentiel |
|---|---|
| Prix Haiku 5.5 | Un quart du coût Sonnet, assez fort pour l'API |
| API Decisions | Notation et aiguillage sans texte, sortie gratuite |
| Poids Le Chonk | 1 000 milliards ouverts bientôt, visée institutions |
Moments clés
Commentaire de l’IA
"Aucun modèle isolé ne fait la vraie histoire de la semaine ; tous les laboratoires ont viré dans la même direction au même moment. Tandis que les prix chutent et que les capacités convergent, la question du lecteur change : quel modèle est le plus fort compte moins que l'entreprise à qui confier ses données. Ce tour d'horizon en offre une carte de départ solide."
Évaluation de l’IA
Le plus fort contre-argument vise les tableaux de score : la plupart des chiffres sortent des bancs choisis par chaque laboratoire, tandis que le mini-classement de l'animateur est le banc d'une seule personne avec un seul juge. Les promesses de plus vite et moins cher réclament des répétitions indépendantes ; l'interface de décisions à sortie gratuite et les vitesses huit fois supérieures ne devraient pas entrer dans les budgets sans échantillon. Les agents gratuits portent leur propre question de prix : les comptes rendus versés en mémoire et les veilles X agrandissent l'enjeu du lieu où dorment les données. L'aiguillage vers des modèles rivaux tend aussi les contrats de confidentialité ; les utilisateurs sauront-ils vraiment quel serveur d'entreprise a reçu leur demande ? Rien n'est réglé.
La liste des manques est longue : noms de forfaits et prix bougent chaque semaine, et Beam, Argon comme l'outil de mouvement des forfaits d'équipe attendent des yeux indépendants. Le segment sponsorisé enseigne un vrai motif mais n'est pas un examen neutre ; limites et coûts restent tus. La prévision à 5 % de l'économiste Nobel ne rencontre aucun adversaire dans le tour ; le camp de la transformation totale ne prend jamais la parole. La nouvelle règle de politique manque d'exemples travaillés ; quel comportement tombe sous le bannissement restera interprétatif jusqu'au premier cas réel.
Le siège de l'animateur se lit aussi : abonné à 200 $ par mois au forfait supérieur, son grief d'accès anticipé porte un pincement personnel qui colore son regard sur les marques. Déclarer sa sympathie Grokbot rapporte des points d'honnêteté, mais combiné à une semaine d'enterrement des produits rivaux, c'est au lecteur d'apporter la balance. Utiliser son propre mini-classement comme arbitre, c'est la double casquette : narrateur et juge à la fois. Ces intérêts ne falsifient pas les faits ; ils accroissent le besoin de vérifier chaque affirmation à sa source primaire.
Le conseil au lecteur est net en trois couches : déverser le travail répétitif en masse sur les modèles pas chers et les interfaces de décisions allège le budget ; consacrer les grands modèles visuels à l'apprentissage et à la découverte fait gagner du temps ; et faire de l'autorisation de données la première question d'agent. Tout outil demandant l'accès aux réunions et à la boîte aux lettres, gratuit ou non, devrait dire où il garde ce qu'il entend. Les poids ouverts promettent l'indépendance des institutions, mais la facture de cartes et d'électricité n'est pas un jeu de petite équipe ; chiffrez le coût total avant de franchir la porte.
Sources
9 liens ; 3 d’entre eux sont aussi cités par 8 autres articles. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.
- @www.youtube.com YouTube — Matt Wolfe
- @www.anthropic.com Anthropic — Claude Haiku 5.5
Également cité par : Same Sticker, Different Bill: Haiku 5.5 vs Luna in 12 Runs · The Week in AI Products: Open Agents, Chip Financing, and the Interface Race · Grokbot Courts Rival Models While ChatGPT Goes Visual: AI's Loudest Seven Days · Haiku 5.5: Anthropic finally fixes its small-model problem · Haiku 5.5 Redraws Cost Efficiency for Small Models · Claude Haiku 5.5: Anthropic's Cheapest and Fastest Model Reshapes the Small-Model Race
- @openai.com OpenAI — GPT-6 and Intelligent UI
Également cité par : The Week in AI Products: Open Agents, Chip Financing, and the Interface Race · Grokbot Courts Rival Models While ChatGPT Goes Visual: AI's Loudest Seven Days · Markets Under Credit Strain: The Bull Rests as AI Spending Accelerates
- @topfive.ai TopFive — Decisions API
- @www.techrepublic.com TechRepublic — Grok Bot
- @mistral.ai Mistral — Large 4
Également cité par : 722 Math Manuscripts From an Unnamed Model: Research Goes Parallel
- @www.theverge.com TheVerge — SynthID
- @techcrunch.com TechCrunch — Hark Pro
- @chipdispatch.com ChipDispatch — Muse SDK
intelligence artificielle · claude · gpt-6 · agents · poids ouverts · google