L'intelligence artificielle ne connaît pas de jour calme. À trois jours de la conférence des développeurs d'OpenAI, une fuite importante circulait déjà : la société pourrait révéler un assistant fonctionnant en permanence. Le nom tient en une lettre : « o » . Cette fuite n'était qu'une des trois grandes histoires de la semaine ; Anthropic apportait de son côté une annonce de prix et d'efficacité, et le laboratoire chinois MiniMax une préversion de modèle.
Le produit derrière une seule lettre
D'après TestingCatalog, « o » est apparu sur l'écran de mise à niveau de l'abonnement ChatGPT Pro à 100 dollars comme un avantage listé : « o, your always-on assistant » . La même équipe a repéré « o » comme nom d'affichage et le suffixe « -o » dans la configuration de l'application, et y voit un indice que l'assistant gérera le courrier électronique. Déduire une capacité à partir de deux champs de configuration relève de l'interprétation, pas de la confirmation. L'indice le plus solide se cache dans la marque. Le compte @o sur X est actuellement suspendu et pourrait être réservé pour le lancement, même si un nom d'un seul caractère peut être suspendu pour mille raisons. wccftech.com indique qu'OpenAI veut positionner le produit face à l'agent Muse de Meta, et cnbc.com rappelle que les analystes de JPMorgan ont jugé que Muse pourrait devenir l'application grand public la plus utilisée après ChatGPT, ce qui explique l'urgence d'OpenAI.
Le nom de code interne est la partie la plus confuse. Un compte assure que « aeon » désigne l'implémentation existante d'agents personnalisés pour les comptes ChatGPT Workspace, avec « o » comme version grand public posée par-dessus. runtimewire.com écrit l'inverse : « o » fonctionnerait sur une variante de GPT-6 Astra baptisée aeon, réglée pour les tâches longues. Trois récits, aucune source primaire, et aucun ne tranche.
Quand la vitesse devient une fonctionnalité
Les initiatives de vitesse d'OpenAI sont mieux documentées que la fuite. testingcatalog.com rapporte un sélecteur à trois niveaux repéré dans l'aire de jeu de l'API : standard, rapide et ultra-rapide. openai.com confirme le virage, et developers.openai.com documente que le traitement prioritaire a été renommé « Fast mode » le 30 juillet 2026, avec des réponses jusqu'à 2,5 fois plus rapides. L'aperçu Ultrafast d'openai.com, propulsé par Cerebras, atteint jusqu'à 750 jetons de sortie par seconde. Cette vitesse a un prix dans l'échelle des abonnements. decrypt.co rapporte que le code du site de ChatGPT contient une formule « Pro Max » à 500 dollars qui semble acheter du traitement plus rapide plutôt que davantage d'usage, tandis que testingcatalog.com décrit cette formule comme « Fastest Work and Codex », probablement sur Cerebras. cerebras.ai confirme son côté de l'histoire, en précisant que le mode Ultrafast a été ouvert à une sélection de clients sans compromis sur la qualité. L'annonce de partenariat d'openai.com donne l'échelle : 750 mégawatts de calcul à faible latence ajoutés à la plateforme.
La vitesse n'est plus une fonctionnalité mais un palier de prix. Le passage de 100 à 500 dollars, tel que testingcatalog.com le présente, montre ce que les utilisateurs paient désormais : pas un volume de travail hebdomadaire, mais une tolérance à la latence . L'interprétation du présentateur va dans ce sens, estimant qu'OpenAI a nettement accru ses investissements d'infrastructure et que celle-ci pourrait être un grand axe de la DevDay.
Anthropic sur le front du rapport performance-prix
Les chiffres d'Anthropic sont vérifiables. Dans son annonce d'Opus 5.5 du 22 septembre, anthropic.com indique que le modèle atteint le niveau de Fable 5.1, coûte 40 % de moins à faire tourner qu'Opus 5 et génère plus de 30 % plus vite. Le tableau tarifaire d'anthropic.com précise : 4 dollars le million de jetons en entrée, 20 dollars en sortie, 0,20 dollar pour la lecture en cache. techcrunch.com souligne que la sortie n'a eu lieu que deux mois après Opus 5, livré le 24 juillet.
Le même billet d'anthropic.com indique que Claude Sonnet 5.5 et Haiku 5.5 suivront « dans les prochaines semaines », sans date ferme. Les fuites relayées par start-up-fortune affirment que les partenaires ont atteint un point de contrôle plus récent et visent une fenêtre fin septembre ou 1er octobre, tandis que start-up-fortune souligne qu'Anthropic n'a rien annoncé au-delà du 22 septembre. Le tarif de la rumeur est solide : le billet sur Sonnet 5 d'anthropic.com a fixé à 2 dollars l'entrée et 10 dollars la sortie par million de jetons, définitivement. L'affirmation du présentateur, selon laquelle le modèle bat GPT-6 sur tous les plans, repose sur ses propres tests et non sur l'annonce d'Anthropic.
MiniMax M3.1 et l'équilibre vitesse-efficacité
La troisième histoire porte le calendrier le plus frappant de la vidéo : le présentateur a repéré la fuite dans une demande de fusion GitHub, a commencé à monter la vidéo autour d'elle, et la préversion de M3.1 Flash a été annoncée alors que l'enregistrement touchait à sa fin. orcarouter.ai rapporte que MiniMax a laissé une note d'architecture datée du 22 septembre et un point de contrôle de 250 Go sur Hugging Face que seuls les partenaires d'inférence peuvent ouvrir, des observateurs de modèles annonçant M3.1 pour la semaine à venir.
Sur la qualité des sorties, le présentateur montre deux essais. Le premier produit une image en pixel art, où le modèle rapide ajoute les détails d'atmosphère que les modèles plus capables négligent souvent. Le second demande un dessin au trait à partir d'une consigne courte, où le modèle le plus puissant renvoie une sortie si déformée qu'elle ne peut pas être rendue, tandis que le modèle rapide construit une scène lisible et cohérente. Le présentateur présente cela moins comme un verdict que comme un signal compétitif, sans prétendre que ce modèle est le meilleur. Un autre modèle rapide est évoqué : une préversion gratuite avec une fenêtre de contexte d'un million de jetons, disponible sous deux semaines dans un client de programmation. Cette affirmation prépare les démonstrations d'agents de programmation qui clôturent la vidéo, où des agents transforment un jeu en clone fonctionnel.
Agents de longue durée : où est la limite
Le projet de clôture montre jusqu'où va la promesse énoncée : 100 000 lignes de code de jeu, 26 000 lignes de tests, 1 000 tests automatisés, 775 fichiers et environ 25 heures de travail d'agent ininterrompu. Par-dessus, des centaines d'images et plus d'une centaine de fichiers audio ont été générées par le code, avec un guide intégré au jeu. anthropic.com documente un saut comparable d'échelle en programmation agentique, rapportant qu'un testeur précoce a achevé une migration de 680 000 lignes en moins d'une journée. La compilation de ces chiffres par favtutor.com résume l'idée : la programmation agentique n'est plus une petite démonstration mais un mode de production qui compresse des semaines de travail d'ingénierie en quelques jours. En regard, goldiebench.com souligne que le secteur a commencé à bâtir sa propre mesure, en lançant des builds uniques et en les testant réellement en jeu plutôt qu'en se fiant aux captures d'écran. Le secteur audite désormais ses propres affirmations, ce qui signifie que moins d'entre elles passeront sans examen.
La grande picture de la semaine est un verrouillage mutuel entre infrastructure et architecture d'agents. OpenAI élargit ses paliers de vitesse, Anthropic promet cette même vitesse moins cher, et MiniMax emballe la vitesse à un prix encore plus bas. Les trois désignent la même chose : ce que l'on promet aux utilisateurs n'est plus l'intelligence du modèle, mais la rapidité avec laquelle le travail s'achève. La DevDay du 29 septembre sera la première occasion de mesurer ces promesses.
Moments clés
Commentaire de l’IA
"Les fuites restent des preuves fragiles, mais le calendrier parle de lui-même : la promesse d'un assistant persistant chez OpenAI, la poussée sur le rapport performance-prix chez Anthropic et la voie rapide chez MiniMax tombent tous les mêmes jours. La vraie question n'est pas ce que sont ces produits, mais lequel peut absorber la demande d'infrastructure qui se cache derrière. Tous les trois butent sur le même goulot : produire vite suppose d'empiler des couches matérielles plus coûteuses."
Évaluation de l’IA
La meilleure objection appartient aux fuites elles-mêmes. La preuve la plus solide pour « o » reste une capture d'écran d'abonnement portant « your always-on assistant » et un fragment de configuration de deux champs ; TestingCatalog précise que des affirmations comme 63 langues ou des puces précises n'apparaissent dans aucune source primaire. Tirer une capacité de courrier de deux clés JSON est un raisonnement, pas une preuve.
Ce qui manque est structurel, pas fortuit. Évaluer un assistant persistant exige précisément ce que le fragment divulgué ne contient pas : quelles applications il touche, quelles permissions il détient, où il s'exécute et qui répond lorsqu'il se trompe. Les paliers de vitesse souffrent du même vide : 750 jetons par seconde est un chiffre mesurable, mais le coût matériel qu'il implique n'est jamais explicité.
L'intérêt du présentateur est sa propre transparence. Des formulations comme « meilleur que GPT-6 » ou « j'ai intercepté un commit divulgué » laisseraient des trous si elles étaient présentées comme des faits, et la vidéo rend visible sur quels tests elles reposent et combien elles sont subjectives. Séparer ces affirmations des informations vérifiées rend le reste de l'analyse utilisable.
L'enseignement pratique pour le lecteur tient à l'attente. Brancher l'un de ces produits divulgués dans un flux de travail payant avant la DevDay serait un pari. Deux options de vitesse sont pourtant réelles dès aujourd'hui : le mode rapide d'Anthropic offre jusqu'à 2,5 fois la vitesse de sortie sur sa plateforme, avec une prime tarifaire publiée. C'est le seul point mesurable cette semaine, à budget égal.
Sources
11 liens ; 4 d’entre eux sont aussi cités par 11 autres articles. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.
- @youtube YouTube — AI haber kanalı
- @testingcatalog.com TestingCatalog — "o" sızıntısı
Également cité par : The Single Letter on the Pricing Page: OpenAI's 'Always-On' Assistant Claim
- @anthropic.com Anthropic — Claude Opus 5.5
Également cité par : The superintelligence race: Musk and Huang on energy, orbital compute and safe agents · Claude Opus 5.5: From Idea to Finished Work in a Single Session · Before Buying the $12,000 Mac Studio, Rent a Test for $2 an Hour · The AI Week That Packed World Models, Open Weights and Data Centers Into Orbit · The AI Price War: Opus 5.5, GPT-6 Sol and the Quiet Bottleneck of the Agent Era · Four Launches in One Day: the Opus 5.5 Comeback and the GPT-6 Sol and Luna Price Break · Decide First, Generate Later: The Jev Plus Opus 5.5 Playbook · The Market Is Underestimating This Massive AI Demand Shift · I Tested Opus 5.5 on 24 Coding Tasks: Fable-Level Quality in Half the Time and Cost · Claude Opus 5.5 in the Wild: One-Hour Award Site, 3D Space Voyage and a Single Dashboard
- @openai.com OpenAI — Ultrafast modu
Également cité par : The Single Letter on the Pricing Page: OpenAI's 'Always-On' Assistant Claim
- @decrypt.co Decrypt — Pro Max kademesi
- @techcrunch.com TechCrunch — Opus 5.5 sürümü
Également cité par : Claude Opus 5.5: From Idea to Finished Work in a Single Session · I Tested Opus 5.5 on 24 Coding Tasks: Fable-Level Quality in Half the Time and Cost
- @cerebras.ai Cerebras — Ultrafast altyapısı
- @orcarouter.ai OrcaRouter — MiniMax M3.1 sızıntısı
- @favtutor.com Favtutor — Opus 5.5 örnekleri
- @cnbc.com CNBC — JPMorgan'un Muse değerlendirmesi
- @anthropic.com Anthropic — Claude Sonnet 5 fiyatı
openai · devday 2026 · claude sonnet 5.5 · minimax m3.1 · agents ia · cerebras