Cette semaine, l'agenda de l'IA s'est résumé à une question : les grands laboratoires abandonnent-ils la course à l'intelligence brute pour celle de l'expérience produit ? Le récapitulatif hebdomadaire de 24 minutes répond sur trois fronts à la fois. L'agent ouvert Hermès a franchi le seuil de 1,5 Md $ par la force de sa communauté, des paquets de dette de 50 Md $ et 40 Md $ ont été montés pour les accélérateurs, et les robots conversationnels ont entamé leurs premiers essais au-delà du texte avec des interfaces génératives . La thèse de l'animateur est nette : chacun de ces produits vitrine un basculement plus large qui oriente l'IA.
Un agent ouvert au seuil du milliard
Les chiffres ouvrent le bal : l'agent Hermès atteint 22 millions d'installations et pèse environ 2,5 % de la consommation mondiale de jetons. TechFundingNews rapporte une série B de 90 M $, un total de 158 M $ levés et le franchissement du niveau de 1,5 Md $, avec Robot Ventures en chef de file et des soutiens stratégiques dont un grand fabricant d'accélérateurs. La trajectoire de 36 M $ de revenus annuels vers un objectif de 100 M $ en fin d'année proclame le passage du projet communautaire à la ligue des entreprises. Ce récit s'appuie sur TechFundingNews et se lit avec les chiffres du Wall Street Journal cités dans l'émission.
Le modèle d'affaires prouve que l'ouverture paie : chacun peut brancher son propre modèle ou passer aux formules hébergées de 20 $ à 200 $ par mois. Publié sous licence MIT en février 2026, l'agent garde une mémoire entre les sessions, navigue sur le web, exécute des fichiers sources, assume des tâches planifiées et écrit des aptitudes réutilisables en travaillant. Le message du fondateur oscille entre célébration et manifeste d' écosystème ouvert : le coût de copie du logiciel s'est effondré, le verrouillage ne paie plus. La liste des principes non négociables répète la philosophie : fais tourner des modèles plus malins ou moins chers dans ton agent, assigne un modèle par tâche, change de modèle en pleine conversation, décide où vivent tes données et ce qui s'oublie, fais même tourner ton agent sur une machine coupée d'internet.
Données Ramp : les modèles de décision entrent en scène
Que ces bascules dépassent la vitrine, les données Ramp le prouvent. La plateforme de cartes et de facturation classe chaque mois les fournisseurs que ses clients technophiles achètent pour la première fois ; là où la pointe dépense, tout le monde suit souvent. Ce mois-ci, Typesafe AI, créateur d'un modèle de décision, se détache : le modèle Jev arrive premier en croissance relative à la taille et deuxième en gain de part d'usage, avec un point entier gagné en un mois. Parmi les laboratoires frontières, Anthropic, OpenAI et SpaceX se rangent côte à côte dans le top cinq. Cette lecture vient de Ramp, avec la réserve nécessaire sur l'échantillon technophile ; le classement reflète la pointe, pas tout le marché des entreprises.
La pression monte dans le financement des puces
La direction de l'argent raconte la même histoire. Oracle discute avec Apollo et Goldman Sachs pour ses achats de puces, semblant se tourner vers les marchés privés sous pression de notation. SeekingAlpha rapporte que Broadcom monte un paquet de dette de plus de 50 Md $ pour des puces sur mesure codéveloppées avec OpenAI ; Apollo et Blackstone figurent parmi les prêteurs possibles, et les designs Jalapeño et Serrano du programme Nexus visent 10 gigawatts de capacité d'accélérateurs fin 2029. Ce récit vient de SeekingAlpha et confirme l'objectif de clôture avant fin d'année. CNBC rapporte que SpaceX cherche 40 Md $ de dette pour un achat auprès du premier fabricant d'accélérateurs, Nvidia ; dans les discussions menées par Apollo, le matériel lui-même sert de garantie, et le marché price sur l'hypothèse d'une valeur conservée sept ans. Ce récit vient de CNBC et signale l'accès difficile des laboratoires frontières à l'emprunt bien noté.
Un endettement de cette ampleur attire les critiques à Wall Street. Les couvertures de défaut sur SpaceX pricent 15 % de probabilité de défaut fin 2031 ; certains prêteurs ont quitté la table devant une note de deux pages aux photos spatiales, tandis que Pimco continue d'étudier le dossier. Dans le montage Broadcom, les financiers achètent les baies puis les relouent cinq ans, le géant des puces garantissant les loyers. Le cœur de l'affaire est un décalage de calendrier : le matériel se paie aujourd'hui, les revenus de calcul s'étalent sur des années.
Paliers Mythos et débat cyber
Côté Anthropic, l'annonce la plus structurelle est l'élargissement du programme de vérification cyber. Les modèles grand public gardent des garde-fous conservateurs, car les mêmes capacités servent la défense et l'attaque : un double usage. Le nouveau programme fusionne Glasswing et le CVP sous un même toit en trois paliers : l'accès défense couvre la réponse aux incidents, la rétro-ingénierie de maliciels et l'examen de vulnérabilités ; l'accès équipe rouge ouvre les tests d'intrusion autorisés ; l'accès spécialisé, sur approbation gouvernementale, réserve aux institutions testant des systèmes à haut risque — contrôles de vol, réseaux d'énergie, plomberie financière — avec une conservation des données obligatoire à ce seul palier. Le programme donne accès aux plus puissants modèles d'IA sur les trois paliers, dont Opus 5.5, Sonnet 5.5 et Mythos 5.1. Ce récit vient de SecurityWeek et précise les conditions et le contrôle.
Deux visions extrêmes s'affrontent sur le risque d'un modèle de classe Mythos. Le chercheur ouvert Nathan Lambert soutient qu'une diffusion accidentelle laisserait le monde à peu près en place : une accélération plutôt qu'une rupture. Au pôle opposé, le banquier Jamie Dimon affirme des risques cyber décuplés. L'animateur garde ses distances avec l'emphase de la seconde thèse : la rhétorique de la peur devrait céder aux mesures suivies — comptes d'incidents, délais de correction. La distinction accélération-rupture est ici l'idée clé : une même capacité produit un risque différent selon le palier d'accès.
Vite, pas cher, un modèle par tâche
Elon Musk a planté son drapeau côté Grokbot : SpaceX utilisera désormais, pour chaque tâche, le modèle dorsal le plus performant, avec Claude Opus 5.5, Midjourney et Suno dans la liste. La plupart des requêtes iront à une version ultrarapide de Grok 4.8, au nom du tandem vitesse-intelligence. TheNextWeb y voit un acteur à deux étages, laboratoire et routeur : avec un modèle maison de pointe, nul ne vous bouscule, et l'on capte encore la marge d'inférence des rivaux. Ce récit vient de TheNextWeb et répond pratiquement au débat du harnais qui dure depuis janvier : la compétition se déplace du modèle vers le harnais .
Anthropic jouera aussi le bas de gamme avec Haiku 5.5 : son petit modèle le moins cher, le plus rapide et le plus capable. Selon Anthropic, l'entrée coûte 0,10 $ le million de jetons et la sortie 0,50 $, le coût moyen tombant au quart de la génération précédente, avec 80 % de remise sous 100 000 jetons. Ce récit vient d'Anthropic. Selon TechnologyOrg, le tableau est frappant : 72,4 % sur OSWorld 2.1 contre 48,9 % pour GPT-6 Luna, 39,2 points sur Terminal-Bench 4.0, et 1620 comme 1578 points sur les mesures de travail cognitif devant son rival. Ce récit vient de TechnologyOrg et confirme le calcul de 21 contre 12 centimes par tâche.
La vraie cible de Haiku 5.5, ce sont les charges de sous-agents : résumés, compactions, requêtes de bases et classifications, rapides et répétitives. Côté IA, la courbe des coûts fléchit et les usages sensibles à la vitesse — assistance en direct, usage navigateur — deviennent rentables ; on ne parle plus coût par modèle mais coût par tâche . La division par deux du prix des lectures de cache de Sonnet 5.5 participe du même calcul.
Deux annonces coup sur coup côté OpenAI. D'abord un nouveau GPT-6 pour 1,2 Md d'utilisateurs hebdomadaires : l'intelligence du palier gratuit se renouvelle. Le vrai titre, c'est l'Intelligent UI : ChatGPT compose désormais avec du visuel interactif, pas du seul texte ; schéma d'assemblage de vélo, taxonomie de tuiles de Mahjong, calculateur de retraite figurent parmi les mini outils générés en place dans la conversation. Selon OpenAI, l'équipe a passé des mois sur une bibliothèque de composants diffusables et un compilateur qui rend l'interface pendant la génération ; les premières impressions rapportées par TheVerge y voient un changement bienvenu après les murs de texte. Ce récit vient d'OpenAI. Ce récit vient de TheVerge et confirme que le jugement du modèle — quand interfacer, quand rester textuel — est le dur du sujet.
Sur les trois fronts, la direction se précise : l'ouverture devient modèle d'affaires, le financement des accélérateurs tend les marchés du crédit, et la différenciation glisse de l'intelligence brute vers l'expérience produit. Les laboratoires soignent l'interface pour la première fois ; quand l'intelligence est partout, la présentation et le coût tranchent. Particuliers comme acheteurs entreprises y gagnent, mais calendriers de dette et paliers cyber méritent surveillance : le pricage 2031 et la conservation obligatoire sont les deux ancres de l'optimisme.
| Bascule | Résultat saillant |
|---|---|
| Agents ouverts | Hermès 22M installs, 2,5 % des jetons |
| Argent des puces | Paquets de 50 Md $ et 40 Md $ |
| Course interface | GPT-6 + Haiku 5.5, centimes par tâche |
Moments clés
Commentaire de l’IA
"À mes yeux, la vraie nouvelle n'est pas un produit isolé : pour la première fois, les laboratoires prennent le design d'expérience au sérieux ; quand l'intelligence est partout, la présentation et le coût tranchent."
Évaluation de l’IA
Le contre-argument le plus fort vient du financement : les paquets gagés sur le matériel reposent sur sept ans de valeur conservée, et si l'hypothèse casse, les engagements du garant tremblent. Le pricage de 15 % au comptant peut être emphase ou alerte avancée ; lever 40 Md $ sur deux pages force le test de sérieux. Côté cyber, des garde-fous assouplis élargissent la surface de fuite malgré le filtrage ; même si la thèse d'accélération de Lambert se vérifie, le coût du compteur d'incidents reste aux équipes de défense.
Les manques comptent aussi. Le classement Ramp reflète la pointe ; la poussée d'un mois de Jev — adoption durable ou vague d'essais — reste inconnue. Aucun audit indépendant des paliers Mythos n'est publié ; le décuplement de Dimon repose sur l'émotion, pas la mesure. Les scores Haiku viennent du fabricant et d'un tiers ; le coût par tâche en charges réelles varie selon le mélange des requêtes.
La posture de l'animateur mérite note : un tempo quotidien récompense la vitesse et punit la prudence. Aucun contenu sponsorisé, mais chaque titre choisi lit optimiste pour le consommateur ; regrouper dettes et cyber sous leurs rubriques préserve l'équilibre. Le récit convainc dans la mesure où il éprouve les annonces contre données et mesures tierces.
Le praticable pour le lecteur tient en trois points. D'abord, choisir par tâche : le rapide et petit à la classe Haiku, le raisonnement lourd à la classe Opus. Ensuite, budgéter par tâche, non par jeton ; l'écart entre 12 centimes et seize fois plus se cumule en fin de mois. Enfin, essayer l'interface : schémas et mini outils en place captent un contexte que les longs textes ratent.
Sources
11 liens ; 4 d’entre eux sont aussi cités par 6 autres articles. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.
- @youtube.com YouTube — AI Daily Brief
- @techfundingnews.com TechFundingNews — Nous $90M Series B
- @seekingalpha.com SeekingAlpha — Broadcom $50B OpenAI chips
- @cnbc.com CNBC — SpaceX $40B Nvidia GPUs
- @securityweek.com SecurityWeek — 3-tier cyber verification
- @anthropic.com Anthropic — Claude Haiku 5.5 launch
Également cité par : Same Sticker, Different Bill: Haiku 5.5 vs Luna in 12 Runs · Grokbot Courts Rival Models While ChatGPT Goes Visual: AI's Loudest Seven Days · Haiku 5.5: Anthropic finally fixes its small-model problem · Haiku 5.5 Redraws Cost Efficiency for Small Models · Claude Haiku 5.5: Anthropic's Cheapest and Fastest Model Reshapes the Small-Model Race
- @technology.org TechnologyOrg — Haiku 5.5 price benchmarks
Également cité par : Haiku 5.5: Anthropic finally fixes its small-model problem · Claude Haiku 5.5: Anthropic's Cheapest and Fastest Model Reshapes the Small-Model Race
- @openai.com OpenAI — GPT-6 for everyone
Également cité par : Grokbot Courts Rival Models While ChatGPT Goes Visual: AI's Loudest Seven Days · Markets Under Credit Strain: The Bull Rests as AI Spending Accelerates
- @theverge.com TheVerge — Intelligent UI first look
- @thenextweb.com TheNextWeb — Grok Bot multi-model
Également cité par : Grokbot Courts Rival Models While ChatGPT Goes Visual: AI's Loudest Seven Days
- @ramp.com Ramp — top SaaS vendors data
intelligence artificielle · agents ouverts · financement puces · claude haiku · gpt-6