La vidéo s'ouvre sur une question simple : sans payer aucun abonnement ni acheter aucun forfait, jusqu'où un agent IA gratuit peut-il nous emmener ? Pour y répondre, le harnais d'agent open source et indépendant des modèles OpenCode a été testé avec 11 modèles différents (gratuits, payants via API et exécutés localement) à l'aide de prompts identiques.
OpenCode est un harnais d'agent indépendant des modèles qui fonctionne dans le terminal, sur le bureau ou dans un IDE (VS Code, Cursor, Zed, Windsurf). Il offre une détection d'erreurs basée sur LSP, des sessions multiples pour des agents en parallèle, des liens de session partageables et des intégrations avec GitHub, Google et ChatGPT. Plus de 75 fournisseurs de modèles sont pris en charge. L'offre gratuite inclut le modèle 'Ox Alpha free' avec un quota de 200 requêtes toutes les 5 heures.
Vous pouvez ajouter vos propres clés API pour tester des modèles payants. OpenAI GPT-5.6, Claude Opus 5 et Gemini 3.7 Flash ont été utilisés via leurs API. Cela démontre comment OpenCode permet de changer de modèle tout en conservant le même harnais, déplaçant la dépense de la consommation de modèles vers l'investissement dans le harnais.
Pour l'exécution locale, LM Studio Bionic a été utilisé pour télécharger Qwen 3.8 B. Sur un Mac M5 Max avec 128 Go de mémoire unifiée, le modèle a fonctionné entièrement en RAM ; sur Windows, un GPU avec 24 Go ou plus de VRAM est nécessaire. Le modèle local a été intégré à OpenCode comme 'fournisseur personnalisé'. Le modèle n'a jamais quitté l'ordinateur et aucun frais de token n'a été encouru.
Les tests ont été réalisés en quatre étapes : horloge analogique, grille de cartes d'événements avec recherche/filtre, ajout d'un tri aux cartes existantes, et une scène 3D pilotée par le défilement utilisant la bibliothèque 3GS.
Résultats : les 11 modèles ont produit une horloge fonctionnelle (seules des différences esthétiques). 10/11 ont rendu la grille de cartes avec succès. Les 11 ont ajouté le tri sans casser les fonctionnalités existantes. 8/11 ont rendu la scène 3D ; trois modèles ont échoué. Les modèles gratuits sont fonctionnellement au niveau des payants.
Lorsque des fichiers de compétences ont été ajoutés, la sortie du même modèle a changé de façon spectaculaire. Qwen 3.8 B a gagné des transitions animées, une palette de couleurs améliorée, une meilleure typographie et des effets au survol. Les fichiers de compétences permettent de guider le comportement de l'agent sans changer de modèle.
LM Studio Bionic sert le modèle localement via API et peut être étendu à des téléphones ou d'autres ordinateurs. Tarifs (septembre 2026) : MiniMax M3 à 0,30 $/1,20 $ par million de tokens ; GLM-5.3-Flash à 0,075 $/0,25 $ ; Abacus AI Agent à 20 $/mois. Dans les flux de travail agentiques, le coût des tokens est une faible fraction ; la dépense dominante est le harnais et la gestion des données.
En 2026, un agent IA gratuit est réalisable — OpenCode plus un modèle local donne zéro abonnement, zéro frais de token, et des données qui ne quittent jamais votre appareil. La vraie valeur réside dans le fait de savoir ce que l'on veut et de l'exprimer dans des fichiers texte simples.
Commentaire de l’IA
""La vraie valeur ne réside pas dans le modèle mais dans le harnais (OpenCode). Les fichiers de compétences permettent de guider le comportement de l'agent. Avec des modèles locaux, on évite les frais de tokens et on garde les données privées. La vraie valeur consiste à savoir ce que l'on veut et à l'écrire dans des fichiers texte simples.""
Sources
7 liens ; 2 d’entre eux sont aussi cités par 2 autres articles. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.
- @youtube https://www.youtube.com/watch?v=X8FLNELtieM
- @fastino https://fastino.ai/blog/the-complete-guide-to-opencode-open-source-ai-coding-agents
- @kdnuggets https://www.kdnuggets.com/2026/08/abacus/honest-abacus-ai-review
- @aihubmix https://aihubmix.com/blog/glm-5-3-flash-pricing-compared-openrouter-z-ai-and-aihubmix
Également cité par : All Roads Lead Back to GLM: GLM-5.3 and the Flash Tier That Stuck
- @developer https://developer.puter.com/tutorials/minimax-api-pricing
Également cité par : I Swapped Claude Code's Engine for MiniMax M3: Full Power for $20 a Month
- @lmstudio https://lmstudio.ai
- @localai https://localai.io
programmation · opencode · modèles · locaux · vraie · puissance · nodesdaily