Les agents IA ont désormais leur propre numéro de téléphone, e-mail, portefeuille et ordinateur, et ce n'est pas une expérience de pensée ; c'est un produit livré avec Manus 2.0 le 28 septembre, après la marche vers l'indépendance. La thèse du fondateur Xiao Hong est franche : Manus fut dès le début une plateforme publique, comme vendre des ordinateurs ; on achète un ordinateur pour travailler, mais sans vidéo ni jeux il reste ennuyeux. La nouvelle architecture s'appelle Cascade ; les projets démarrent légers, les talents experts ne chargent que lorsque le travail l'exige, et le brief, la page, la vidéo et l'automatisation restent dans un projet connecté. Dans le test unique partagé, l'usage de jetons chute de 23,2 pour cent , la durée de 28,2 pour cent et le coût de 32 pour cent ; c'est une mesure, pas des moyennes, et cette réserve compte. Ce récit architectural correspond aux notes officielles de Manus 2.0 sur manus.im, et le chiffre de coût figure au même pourcentage comme record à test unique dans le rapport Cascade de tokenpost.com.
Studio : table de montage et atelier de jeux
L'application de bureau Manus Studio est un espace partagé où humains et IA se retrouvent sur les mêmes fichiers ; documents, tableurs, fichiers PDF, présentations, sites web, logiciels, vidéos et jeux vivent sous un toit, et chaque projet ne charge que les outils voulus, si bien que l'ensemble reste rapide et sobre.
La première nouveauté vidéo met fin au supplice de régénérer tout un film pour un petit changement : Manus livre le travail comme une bande d'éléments séparés portant vidéo, image, texte, sous-titres, animation et audio ; dans une courte publicité diffusée demain, une chanson plus chaude et un plan produit personnel s'ajoutent, l'animation se déplace, l'export part, ou le fichier repart pour que Manus finisse les retouches. La liste des formats couvre la publicité produit de 30 à 60 secondes, le contenu synthétique, le contenu utilisateur, le graphique de données animé, le tutoriel, le vlog et l'animation, sans aucun savoir-faire de montage.
Le mode Alchemy va un pas plus loin ; il part d'une idée, Manus prend le fauteuil de directeur créatif, fond génération vidéo et génération de code dans un même creuset, et promet un bond dans les idées, le contrôle visuel, le mouvement et le rythme. L'affirmation de Xiao Hong est audacieuse : le film de lancement de l'application Q n'a pas été fait avec un modèle vidéo, mais écrit en code dans le studio puis rendu en film.
L'aile jeux vise le jeu rêvé lui-même plutôt qu'une bonne copie repeinte à l'IA ; modèles d'image, de vidéo et de code travaillent ensemble, et le mode ultra-max se doit d'être saisissant, fluide et réel. Un gabarit jouable fait tester l'idée dès la première session, le panneau d'édition regarde le jeu pendant qu'il tourne, gère les ressources, et le mouvement, les graphismes et les scènes changent à la main ; passer les cheveux d'un villageois du brun à l'argent est aussi simple que changer ces cheveux. La publication se fait en site web, chacun joue via un lien, et le nœud multijoueur qui tue d'ordinaire ces projets se réduit à configurer et acheter un ordinateur cloud, car le serveur doit rester debout après la fermeture du portable. Les jeux de course, compétitifs et 3D sont pris en charge, et ce que les amis découvrent en jouant nourrit la version suivante. Une note étrange : le centre d'aide parle d'une machine virtuelle Ubuntu toujours allumée tandis que Xiao Hong évoque la location de copies Linux, Mac et Windows ; soit la fonction arrive, soit la documentation traîne.
Automatisation déclenchée et application Q
L'automatisation dépasse les tâches planifiées ; un nouvel e-mail, un changement de performance publicitaire, un événement de calendrier, un message Slack ou une mise à jour Notion dans un service connecté déclenche le flux avec une seule instruction disant quoi surveiller et quoi faire. L'usage d'ordinateur à distance suit la même logique : depuis un taxi, demander que la dernière mise à jour du dossier d'exécution du PC de maison soit trouvée et envoyée, ou un fichier converti en PDF tout en regardant le bureau au téléphone, suffit. En session connectée et autorisée, le système travaille dans son propre espace visible avec seuls fichiers, navigateur et applications approuvés ; l'application se teste pendant que son propriétaire travaille, ou continue en son absence, et le contrôle reste à l'utilisateur. Le détail préféré de Xiao Hong est que le calcul cloud ne dispute jamais le curseur local, et que bientôt une seule personne pourra piloter un cluster géant pour des expériences de maths et de sciences par pure curiosité.
Le modèle économique bascule avec lui : Manus vend désormais du calcul, des environnements logiciels et du temps de disponibilité plutôt que des tâches ; aucun outil n'est invoqué, et le client possède un ordinateur piloté par logiciel. L'application Q est cette idée rendue personnelle ; une application autonome sur téléphone et bureau, sur la même infrastructure, se met au travail sur une liste de tâches donnée. Chaque agent détient son e-mail, son téléphone, son portefeuille et son ordinateur ; il envoie des messages, paie dans le budget fixé, termine le travail sur sa propre machine, répond aux appels et laisse un résumé. Plusieurs agents se partagent le travail dans un chat de groupe : l'un cherche des lieux pour un lancement à New York, l'un resserre la liste, l'un rédige la présentation, et l'utilisateur tranche. Au restaurant, scanner le QR code fait passer la commande ou garder une place dans la file. L'application est en accès anticipé sur invitation sur web, bureau et mobile, iOS suivra après revue du magasin ; le code MEETCUE est gratuit pour une première vague limitée, premiers arrivés premiers servis, et chacun reçoit des codes supplémentaires à partager. Ce récit d'identité et d'entreprise se vérifie indépendamment dans le reportage Manus 2.0 de thenextweb.com, qui donne aussi la base de Singapour et le contexte de Pékin faisant annuler l'accord Manus de 2 milliards de dollars de Meta.
Rivaux : Muse et Instinct
Le calendrier n'est pas un hasard, la rivalité chauffe : Meta a sorti l'application Muse le 8 septembre sur sa propre machine virtuelle cloud ; via l'application ou WhatsApp elle prend en charge e-mails, réservations et paiements, et elle aurait percé en Amérique du Nord en portant les actions, un cadre de lancement cohérent avec le reportage de septembre de reuters.com. Instinct saute carrément les nouvelles interfaces ; un message ou un appel branche l'e-mail, les messages, l'écran, la voix et la localisation. Fin août, on parlait d'un tour d'environ 250 millions de dollars à 2,5 milliards de valorisation, et le tour de septembre l'a porté au-delà de 10 milliards ; ce bond de valorisation est nettement confirmé par le reportage du tour de septembre de techcrunch.com. Côté chinois, Xiao Hong dit que l'écosystème ouvert à l'étranger facilite une expérience marquante, qu'une version locale se prépare et que des partenariats sont souhaités ; il conclut sur l'idée qu'un parcours promis à une note de bas de page pourrait devenir un chapitre entier, plus une annonce d'embauche.
Le compagnon de jeu de Tencent : Goose Dimension
Sur le front chinois, Tencent mène un test interne secret ; le compagnon de jeu IA est Goose Dimension, aperçu en exclusivité par le site Doujia, portant l'image de l'oie du surnom chinois de l'entreprise. Le produit tourne autour de personnages numériques humains : chat vocal, reconnaissance d'écran en temps réel et compagnie en jeu réunis ; des personnages masculins et féminins se choisissent selon la personnalité, la gamme féminine cite Gaius, Shen, Lubai et Xiaxia, et la Xiaxia testée se présente comme bavarde, jamais renfermée, experte autoproclamée de rang bronze. L'interface tient une rubrique moments qui met le visuel en fond d'écran, un mode animal de bureau qui pose le personnage en dessin animé ou fixe, et un menu talents ; en bas une zone de texte, un bouton téléphone orange, un micro, deux compteurs de ressources en haut et un bouton de retour au choix. On peut discuter ou ouvrir le module compagnon de jeu en bas à gauche avec des jeux en ligne populaires et recevoir des réponses vocales en temps réel en plein match. Tout est gratuit pendant le test, mais la fenêtre d'énergie trahit le plan : le chat texte brûle de l'énergie par tour, la compagnie et les appels vocaux par minute, la génération d'images par image, et l'énergie s'achète avec des pièces étoiles, minimum 10 par échange ; les soldes restent inactifs, mais c'est probablement le modèle de lancement. La stratégie se lit bien car le jeu social est le cœur de Tencent et le marché des compagnons humains payants est un chaos : plateformes extérieures douteuses, coût du travail élevé, personnel difficile à gérer, dialogue improvisé et prix incohérents ; d'ailleurs beaucoup de joueurs ne veulent aucun coaching, juste quelqu'un à qui parler passé minuit sans amis en ligne, et la blague de niveau moyen des personnages le dit : de la compagnie, pas du service, où le paiement à l'usage bat l'abonnement. Les juges seront la stabilité de la reconnaissance, le plaisir de la conversation et la chute de la répétition sur les longues sessions ; ce récit de test fermé figure dans le reportage de septembre de technode.com avec référence au questionnaire officiel, et l'analyse d'insideai.news souligne la date et le prix inconnus plus la barre de latence.
Sonnet 5.5 : vitesse et prix
Anthropic a sorti le Sonnet 5.5 de milieu de gamme le 28 septembre, présenté comme aide quotidienne au code et aux documents de bureau. Sonnet 5 n'était arrivé qu'environ 3 mois plus tôt sur une thèse d'agents moins chers ; cette fois l'accent est à la vitesse : 30 pour cent plus rapide, bien moins de jetons, et jusqu'à 30 pour cent de coût en moins par tâche, à 2 dollars le million de jetons d'entrée et 10 en sortie. Au Terminal Bench 4.0 et au test de code agentique il prend 70,6 pour cent quand Sonnet 5 reste à 10,3 pour cent , le modèle amiral Opus 5.5 lit 66,4 pour cent à effort maximal pour le double du prix au jeton ; selon TechCrunch, l'avantage de Sonnet est de lancer de nombreux agents sans heurter de plafond de coûts. Le test GDP Eval AA à 44 métiers imprime 1844 contre 1846 et 1449, mais Anthropic dit qu'Opus reste nettement plus fort sur les tâches ouvertes exigeant un raisonnement soutenu ; Sonnet est plus étroit au total mais plus souple. Ce cadre de prix et de vitesse reprend les chiffres de l'annonce officielle d'anthropic.com, et le tableau des scores s'appuie sur les mesures indépendantes du reportage de lancement de decrypt.co, qui porte aussi Artificial Analysis à 63,6 contre 59,6 avec GPT-6 Astra à 59,1 plus l'avertissement que le modèle brûle le plus de jetons par tâche parmi les testés.
La sécurité est une nouvelle page pour Sonnet : avec un niveau cyber réglé sur Opus 5, il devient le premier Sonnet à porter des garanties cyber de classe Fable et Opus, les requêtes cyber à haut risque entrent en routage serré, et les garanties biologiques ne bougent pas. C'est le premier Sonnet doté de classifieurs bloquant l'extraction du raisonnement, et le système de pensée enregistrée lie le raisonnement au compte qui l'a produit ; cela ne semble pas exagéré, puisque des chercheurs ont décodé en août 315 320 blocs de pensée issus de 6 708 traces d'agents publiques et récupéré 62 clés API, 33 mots de passe et 7 clés privées. L'Europe regarde de près aussi : l'article 55 de la loi sur l'IA impose aux fournisseurs de modèles généralistes à risque systémique de protéger le modèle et l'infrastructure physique, de mener des tests adverses et de notifier les incidents graves sans retard ; les obligations s'appliquent depuis août 2025, la Commission a reçu le pouvoir d'amende en août dernier, et ce cadre reprend les intitulés du dossier de l'article 55 sur ai-act-law.eu. The Next Web a tout de même relevé deux accrocs : Anthropic allège la revue de conformité en affirmant qu'aucune nouvelle frontière de capacité n'est franchie, tandis que la même annonce décrit un bond cyber exigeant des garanties de classe frontière ; côté prix, l'entreprise dit que 10 dollars égale Sonnet 5, mais le site avait écrit en juin qu'il s'agissait de tarifs promotionnels jusqu'au 31 août avec Sonnet 5 passant à 15 dollars ensuite, donc soit la hausse n'est jamais venue, soit la comparaison reprend le tarif promotionnel. Un nouveau Haiku arrive dans les semaines qui viennent sans date ; le tour de la semaine compte aussi les gammes Sol et Luna d'OpenAI, milieu et budget, plus le modèle censé animer une future fonction de lunettes connectées de Meta.
| Sujet | Résumé |
|---|---|
| Manus 2.0 | Une identité par agent : e-mail, téléphone, portefeuille, ordinateur |
| Sonnet 5.5 | Score au sommet à moitié prix et vitesse en hausse de 30 % |
| Goose Dimension | Un test fermé qui regarde l'écran et répond à voix haute |
| Modèle | Entrée / sortie | Score | Note vitesse |
|---|---|---|---|
| Sonnet 5.5 | 2 / 10 $ par 1M | 70,6 % | 30 %+ plus rapide |
| Opus 5.5 | 4 / 20 $ par 1M | 66,4 % | Effort maximal |
| Sonnet 5 | 2 / 10 $ par 1M | 10,3 % | Génération précédente |
Moments clés
Commentaire de l’IA
"Les trois nouvelles de la semaine se rejoignent en une phrase : l'avantage n'est plus au modèle géant, mais au travailleur moins cher et plus autonome. Un modèle intermédiaire qui triomphe à moitié prix suffit à briser les habitudes."
Évaluation de l’IA
Les pourcentages d'un test unique, le film de lancement soi-disant écrit en code et la couronne à moitié prix viennent tous de présentations d'entreprise, sans vérification indépendante dans le tour. La comparaison de prix puise au même dossier : 10 dollars semble identique à Sonnet 5, tandis que le détail du tarif promotionnel brouille la comparaison. Le lecteur gardera chaque chiffre brillant comme une affirmation.
La liste des manques est longue : côté Goose, stabilité de la reconnaissance, plaisir de la conversation et répétition en sessions longues restent sans réponse ; côté Manus, la machine virtuelle Ubuntu toujours allumée contredit le discours de location Linux, Mac et Windows ; le tarif énergétique n'est qu'une hypothèse tant que les soldes restent inactifs. Côté Sonnet, l'avertissement du test indépendant sur la gloutonnerie en jetons dit que l'étiquette bon marché ne règle pas seule la facture par tâche.
La position du narrateur mérite une note : le format du tour enchaîne les annonces d'entreprise, le segment sponsorisé a été coupé, mais la sélection regarde encore à travers le verre de la semaine de lancement. Les lignes de marché, comme l'action Meta portée par Muse, sont des corrélations en une phrase ; aucune causalité n'est établie. Chaque phrase de marché ici est un contexte, pas une preuve.
L'enseignement pratique est clair : faire tourner beaucoup d'agents sur un modèle intermédiaire réduit le coût par tâche en mesurant, pas en calcul de salle de réunion ; côté accès anticipé, le code MEETCUE va aux premiers arrivés. Le lecteur comparera la facture de sa propre charge de travail plutôt que des pourcentages à test unique, et demandera à qui il confie ses données dans les produits sur invitation.
Sources
11 liens ; 2 d’entre eux sont aussi cités par 8 autres articles. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.
- @youtube.com YouTube — AI news roundup
- @manus.im Manus — Introducing Manus 2.0
- @tokenpost.com TokenPost — Manus 2.0 Cascade report
- @thenextweb.com The Next Web — Manus 2.0 and Cue
- @reuters.com Reuters — Meta Muse launch
Également cité par : Meta Muse in 26 real uses: running digital life through one assistant · The Single Letter on the Pricing Page: OpenAI's 'Always-On' Assistant Claim · How Far Can Nasdaq Euphoria Run? Narrow Rally, Meta's Muse and Cheap Chips · Zuckerberg's Muse Bet: A Personal Superintelligence That Works 7/24 for Everyone · Muse Launch Sent Meta Shares Up 6%: A $763 Fair-Value Case and Why It Stays a Buy · From GPT-6 Astra to the Fruit Fly Brain: A Week of AI Showing Its Range · Meta Muse: What the Personal AI Agent Actually Does
- @techcrunch.com TechCrunch — Instinct funding
- @technode.com TechNode — Tencent game companion test
- @insideai.news Inside AI — Goose Dimension analysis
- @anthropic.com Anthropic — Sonnet 5.5 announcement
Également cité par : Dots, Gemini 4 Argon and Sonnet 5.5: What Happened in AI's DevDay Week
- @decrypt.co Decrypt — Sonnet 5.5 benchmarks
- @ai-act-law.eu AI Act Law — Article 55 obligations
agents ia · modèles intermédiaires · manus · anthropic · tencent · automatisation