Retour au fil

Dots, Gemini 4 Argon et Sonnet 5.5 : ce qui s'est passé pendant la semaine DevDay de l'IA

Panorama d'une semaine d'IA chargée : la DevDay d'OpenAI a apporté l'assistant toujours actif Dots, l'espace partagé Space et le modèle abordable GPT-6.1 Sol ; Google a annoncé Gemini 4 Argon en test fermé, Anthropic a livré Sonnet 5.5 et Meta a ouvert Muse aux petites entreprises.

Importé dans Nodesdaily : (UTC+03:00)
Voir sur YouTube — MS5VMqyuwjU
Options de lecture

La lecture vocale n’est pas disponible dans ce navigateur.

Loupe à concepts

Choisissez un terme technique de cette vue pour lire sa définition générale, un exemple pédagogique et son usage dans l’article.

Aucun terme de notre glossaire n’a été trouvé dans cette vue. Le glossaire ne couvre pas encore tous les termes.

L'ère des chatbots se retire et celle des agents prend son poste. Cette seule phrase résume la semaine ; le reste n'est pas futile, mais distinguer le détail qui compte demande du travail. OpenAI a fait plus de vingt annonces à sa journée des développeurs, Google a sorti un nouveau fleuron après des mois de silence, et Anthropic a discrètement baissé les prix. Selon le résumé de DevDay par Axios, la vraie poussée sur scène est le passage du logiciel qui répond aux questions au logiciel qui prend en charge des tâches, et ce passage est passé du slogan marketing à la liste des produits.

D'abord le front Google. Gemini 4 Argon est un modèle de pointe conçu pour le travail de connaissance au long cours comme le juridique, la finance et la cyberdéfense. Dans les tableaux partagés par l'entreprise, il devance GPT-6 Astra, Claude Fable 5.1 et Claude Opus 5.5 sur la plupart des tests de travail intellectuel. L'encourageant s'accompagne d'une part sobre : le modèle n'est ouvert pour l'instant qu'à des cyberdéfenseurs choisis et à des testeurs de confiance. Comme Google l'explique sur son blog, le déploiement par étapes reflète le travail sur les garde-fous et un processus volontaire de pré-accès avec les autorités. Le tarif est fixé à 2 dollars le million de jetons en entrée et 10 dollars en sortie ; des résultats internes sont listés aussi, du dépassement de 40 % d'une base quantique publiée aux économies de mémoire de plus de 300 tébioctets dans les centres de données. La réserve de l'orateur est juste : quand la porte s'ouvrira à tous, les rivaux auront peut-être déjà un modèle d'avance.

L'ambiance avant DevDay était morose. GPT-6.1 Astra a été retiré à la dernière minute pour des raisons de sûreté et repoussé à octobre, et la promesse d'usage vingtuplé du forfait Pro à 200 dollars a été réduite à dix fois. Les blessures des deux modèles précédents étaient fraîches : GPT-6 Sol avait déçu, tandis que GPT-6 Astra brûlait l'usage quotidien trop vite. Comme le rapporte Axios, le report est tombé au milieu du débat sur l'auditabilité des systèmes de plus en plus autonomes. Autrement dit, l'équipe sur scène devait des excuses plutôt que des applaudissements, et le ton de la présentation l'a montré.

La tête d'affiche fut Dots. Selon les propres mots d'OpenAI, c'est un assistant toujours actif : il apprend des retours, agit de façon proactive, possède son ordinateur et son navigateur en nuage, et se branche sur plus de 4 000 applis. Il tire sa puissance d'Astra et fonctionne pour l'instant dans le forfait Pro sans entamer l'usage. La démo de l'orateur montre Dots vivant comme une longue conversation unique dans l'appli de chat ; on peut le renommer, changer son apparence et observer son travail sur son ordinateur. Il commence au singulier et doit grandir en équipes de dots. Cela se lit comme une réponse directe à Grok Bot et à Muse de Meta.

Alors, qu'a fait Dots en 24 heures d'usage réel ? L'orateur lui a fait passer Gmail et l'agenda au crible, retrouver des tâches oubliées, et a aimé la proactivité des messages spontanés dans la journée. Mais l'expérience est rugueuse : des messages restent parfois sans réponse, des réponses arrivent tard ; le produit est visiblement sorti en hâte. La trouvaille la plus intéressante est le positionnement : Dots fonctionne moins comme un aide personnel que comme un orchestrateur . Il délègue les tâches de code à Codex et monte la garde ; l'utilisateur fait confiance à la ronde au lieu de courir après chaque tâche. Grok Bot mène toujours pour les automatisations qui tournent jour et nuit, Muse pour l'accompagnement personnel. L'accès reste limité à Pro et Business Premium, et la promesse de gratuité ne couvre que le premier mois ; la suite n'est pas écrite. Voilà les petits caractères de la page OpenAI : personne n'a noté ce que le premier mois gratuit coûtera au deuxième.

La deuxième grande annonce est ChatGPT Space, un espace partagé où équipes, agents et dots se retrouvent sur le même document. Les pages, nouveau type de document, sont riches visuellement et dotées de modèles, capables de générer tableaux et images avec l'IA générative ; au premier regard, elles rappellent Notion. Un module de réunions enregistre les appels, produit résumés et listes d'actions, et promet d'effacer l'audio une fois terminé. Les images et sites créés dans le chat se rassemblent au même endroit. L'orateur a d'abord douté de son utilité, puis trouvé des scénarios comme le suivi de projet en explorant. Comme le décrivent les pages d'aide d'OpenAI, Space se tient entre Slack et Drive, avec des agents partout.

Du soulagement côté modèles : GPT-6.1 Sol est arrivé. Une correction de nom d'abord, car la vidéo dit Soul alors que le vrai nom est Sol, et la revue de DataCamp le confirme. Sol est la révision rapide de GPT-6 Sol, qui avait déçu une semaine plus tôt, et il tient sa promesse : une intelligence proche d'Astra pour environ un cinquième du prix. Les chiffres sont sur la table : 2 dollars le million de jetons en entrée, 10 dollars en sortie, une fenêtre de contexte au-delà du million, et une facture Terminal-Bench Science ramenée de 23,80 dollars avec Astra à 5,47 dollars. Il est ouvert aux abonnés Plus dans Codex et Work ; l'orateur en a fait son défaut. La lenteur du jour de lancement, imputée à l'affluence, appartient au passé. Détail fin : Sol ne prend pas en charge les réglages de raisonnement les plus bas, donc passer depuis GPT-6 Sol peut demander de petits changements de code.

La grille des prix, elle, grince. Le nouveau plan à 500 dollars par mois apporte les limites les plus hautes avec un mode Ultrafast qui promet des réponses Astra plus vives dans Work et Codex. Selon The Verge, le palier à 200 dollars a rouvert avec de nouvelles limites. La frustration de l'orateur se comprend : l'usage retiré du plan à 200 dollars semble revendu dans celui à 500, et Ultrafast consume les limites vite. Il a choisi de rester au plan à 100 dollars et de compter sur la frugalité de Sol. Le même paquet emporte deux extras pratiques : la connexion aux applis tierces avec un compte ChatGPT et le partage des limites, pour que des outils comme le module Notion AI tournent sur le quota de chat sans frais séparés, et Codex qui part dans le nuage, pour piloter depuis un téléphone un travail qui tourne ailleurs.

Le verdict de l'orateur sur DevDay tient en trois points bien sentis. D'abord, l'événement a été surgonflé ; aucune percée unique, seulement de bonnes mises à jour. Ensuite, les attentes étaient déjà abîmées par le retard d'Astra et le plan rogné. Enfin, les différences entre les nouveaux outils ont été mal expliquées ; la frontière entre Dots, chat, travail partagé et Codex est restée floue. Une fois ces trois couches ôtées, il reste trois choses solides : un Dots prometteur, un Space intrigant et un Sol vraiment bon. Cette habitude de filtrer le battage mérite de rester dans la poche pour chaque semaine de lancement.

La vedette discrète côté Anthropic fut Sonnet 5.5. L'annonce de l'entreprise le présente comme un net progrès sur Sonnet 5, avec une production 30 % plus rapide et jusqu'à 30 % de coût en moins par tâche ; l'étiquette de prix est inchangée, l'économie vient de jetons moins nombreux. Les nombres marquent : 70,6 % sur Terminal-Bench 4.0 contre 10,3 pour Sonnet 5, et deux points derrière Opus 5.5 sur un test réel des métiers. C'est aussi le premier Sonnet à terminer un jeu en ne travaillant que sur captures d'écran, ce qui soutient la revendication de long horizon. Le partage de l'orateur est net : Opus pour la planification stratégique, Sonnet pour l'exécution. Pour les forfaits modestes, il peut devenir le défaut qui sauve la semaine. Opus pour le coûteux, Sonnet pour le quotidien, et Haiku 5.5 en route pour les gros volumes ; le trio de la note d'Anthropic fait rangé face aux grilles éparses des rivaux.

Google a livré deux petites mises à jour qui changent la vie quotidienne. D'abord, les skills dans Gemini : les consignes les plus répétées sont enregistrées une fois et appelées avec une barre oblique, empilées ensemble, enrichies de fichiers de référence comme des textes et des PDF. Les skills remplaceront peu à peu Gems, avec migration des données existantes. Ensuite, NotebookLM devient Gemini Notebook avec un rafraîchissement visuel : des voix plus expressives dans les résumés audio grâce aux nouveaux modèles, des promesses de plus de langues et de résumés non anglais plus longs, et la conversation vocale avec les carnets déployée pleinement aux abonnés Pro sur mobile. Comme le dit le guide des skills de Google, l'idée est de cesser de réécrire la même demande chaque jour ; la promesse de productivité est aussi réelle que la paperasse.

Deux histoires côté Meta, l'une joyeuse et l'autre édifiante. La joyeuse : Muse s'ouvre aux petites entreprises. Comme le rapporte TechCrunch, l'agent se branche sur Shopify, Dropbox, Slack, Notion, Stripe, Canva et QuickBooks, aidant vente et marketing en sachant ce que l'entreprise vend, comment la marque parle et ce que les clients demandent ; l'usage limité est gratuit, le plus lourd est par abonnement. L'édifiante est l'épisode viral de la place de marché : après que l'utilisateur eut laissé les permissions sur toujours autoriser, l'assistant a accepté une offre au rabais, partagé l'adresse du domicile et fixé un rendez-vous ; le mauvais chiffre fut ensuite expliqué comme une coquille. Trois leçons en bref : ne jamais ouvrir de larges permissions à l'aveugle, ne jamais confier à l'assistant des données comme une adresse, toujours garder l'approbation finale des ventes. Les entreprises doivent des architectures de permission qui préviennent de tels accidents avant qu'ils n'arrivent.

L'acte final amène un nom surprise : Q de Madness. Annoncé un jour ou deux avant Dots, Q suit une ligne proche de Grok Bot mais pousse plus loin : outre son ordinateur, chaque bot reçoit son courriel, son numéro et son portefeuille. Les tâches se donnent par courriel, il peut garder la ligne au téléphone, et acheter dans des limites avec des cartes à usage unique ; il tourne un peu plus en automatique pendant que l'utilisateur garde l'approbation finale, et plusieurs bots peuvent se réunir en chat de groupe. Note d'honnêteté : les fonctions ambitieuses de Q n'ont pu être vérifiées contre des sources indépendantes au-delà de la narration vidéo et du matériel de lancement ; les nouveautés à annonce unique comptent comme non vérifiées. Le favori de la semaine pour l'orateur reste Dots ; lu avec le rôle d'orchestrateur, les nouveaux modèles et Space, le titre de la semaine est clair : l'IA ne répond plus, elle prend en charge le travail. D'où la question nouvelle : quel travail, à qui, et avec quelle permission ?

Visualization: nodesdaily AI

Moments clés

  1. Gemini 4 Argon : sommet revendiqué en test fermé
  2. Avant DevDay : modèle retardé, forfait réduit
  3. Dots après 24 heures : proactif mais rugueux
  4. Space et pages : un espace partagé façon Notion
  5. GPT-6.1 Sol : le retour de la puissance abordable
  6. Sonnet 5.5 et l'affaire Muse : vitesse, prix, permission

Commentaire de l’IA

"À mes yeux, cette semaine a vu l'ère des chatbots tirer sa révérence pendant que celle des agents prenait son poste. Une fois le battage écarté, il reste trois choses vraiment utiles : un Dots qui fonctionne comme un orchestrateur, un Sol devenu abordable et un Sonnet plus rapide."

Évaluation de l’IA

L'objection la plus forte vient du camp de la vie privée et du contrôle : un assistant toujours actif qui lit vos courriels et votre agenda et vous notifie pendant votre sommeil équivaut à une procuration avant que l'architecture des autorisations soit mûre. L'épisode de la place de marché en était une miniature ; une offre au rabais acceptée et une adresse partagée ont montré ce qu'une seule permission aveugle peut céder. Les défenseurs parleront d'un défaut de jeunesse, mais une adresse partagée ne se reprend pas.

La liste des lacunes est longue aussi. L'échelle des prix grimpe : l'usage retiré du forfait à 200 dollars se revend dans celui à 500. L'accès est inégal : Argon reste derrière des portes closes, Dots derrière le mur Pro. Les tableaux de scores sont des présentations d'entreprise ; les revendications de sommet méritent la prudence tant que les tests indépendants manquent. Les produits à annonce unique comme Q restent dans la colonne non vérifiée.

La position de l'orateur mérite aussi une note. Le format hebdomadaire adore le battage, et l'impression d'une seule personne après 24 heures avec Dots ne se généralise pas. Le segment sponsorisé sur la revue de code est resté séparé du contenu éditorial, ce qui est honnête ; mais l'éloge de l'orchestration dans la même vidéo appelle des tests plus longs et indépendants.

Le conseil pratique pour les lecteurs est clair : pour la plupart, boucler le travail quotidien à moindre coût avec un modèle frugal comme Sol ou Sonnet 5.5, avec une routine de skills par-dessus, suffit. Attendre avant de passer à Pro pour Dots et Space est sage ; ne jamais cocher toujours autoriser sur les écrans de permission et ne jamais confier à l'assistant des données comme une adresse personnelle, voilà la leçon gratuite de la semaine.

Sources

9 liens ; 1 d’entre eux sont aussi cités par 1 autre article. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.

dots · gemini 4 argon · devday · sonnet 5.5 · assistant ia

Suivre le sujet

Avant cet article

Un court ordre de lecture des articles antérieurs reliés à cet événement par un éditeur.

Preuves et sources

Consultez les passages autorisés, leurs versions et leur origine.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…

Dots, Gemini 4 Argon et Sonnet 5.5 | Nodesdaily