Retour au fil

Un agent qui arrête de tout recalculer : créer des compétences IA qui fonctionnent vraiment sur Hermes

Le guide de 15 minutes de Parker Prompts montre comment faire en sorte qu'un agent Hermes livre le même travail de façon constante grâce à des dossiers de compétences persistants : l'identité via soul.md, un hébergement 24/7 chez Hostinger et une génération de compétences gratuite avec Ordain.host pour des flux hebdomadaires répétables.

Importé dans Nodesdaily : (UTC+03:00)
Voir sur YouTube — roHLWMmDBsc
Options de lecture

La lecture vocale n’est pas disponible dans ce navigateur.

Loupe à concepts

Choisissez un terme technique de cette vue pour lire sa définition générale, un exemple pédagogique et son usage dans l’article.

Aucun terme de notre glossaire n’a été trouvé dans cette vue. Le glossaire ne couvre pas encore tous les termes.

Le récit s'ouvre sur une idée simple : un agent qui fonctionne vraiment a besoin de trois piliers — une structure solide, un serveur pour le maintenir en vie, et des compétences qui automatisent le travail. Le point de douleur est immédiat : écrire ces fichiers à la main est lent et fastidieux, et c'est là que la plupart des gens bloquent. De ce manque naît la promesse d'un générateur gratuit, avec l'affirmation que quiconque regarde jusqu'à la fin aura une compétence opérationnelle gratuitement sur son propre agent.

Pourquoi un agent sans compétences dérive à chaque exécution

Sans compétences, un agent construit son approche from scratch à chaque requête, et le coût se voit dans la répétabilité. Exécutez le même prompt deux fois : le premier résultat revient avec une source à côté de chaque ligne et une matrice de décision en bas ; le second revient plus court, sans citations et avec des faits différents. La méthode utilisée lors de la première exécution meurt à la fin de la session, une nouvelle méthode est inventée la fois suivante, et il n'existe aucune référence pour aligner les deux. Passer à un modèle plus grand ne répare rien, car la source de la variance n'a jamais été la taille du modèle mais l'absence de référence.

Cette faiblesse est tolérable pour des questions ponctuelles où vous pouvez lire et redemander, mais elle s'effondre dès que vous voulez le même travail chaque semaine sans supervision. Une compétence résout cela en devenant la référence que l'agent peut ouvrir et suivre. Physiquement, c'est un dossier sur la machine de l'agent, un par compétence, contenant un fichier SKILL.md qui commence par une courte description d'applicabilité puis les étapes ; des fichiers de code optionnels, des dossiers de référence et des modèles se trouvent à côté pour les travaux qui demandent plus que du texte, tandis qu'une compétence simple se résume souvent à ce fichier unique.

Un agent n'en lit rien tant qu'un travail ne correspond pas à la description, si bien qu'une bibliothèque de compétences reste inerte à un coût quasi nul jusqu'à son appel, ce qui rend raisonnable de les ajouter une par une sans interférence ni plafond à atteindre. La démo tourne sur Hermes, un agent open source de Nous Research cité dans la vidéo à environ 236 000 étoiles GitHub — nos vérifications montrent 240k+ et un rapport de TechCrunch évoquant des discussions pour lever à une valorisation de 1,5 milliard de dollars — sous licence MIT, donc ce que vous construisez reste exécutable même si l'éditeur disparaît, avec la précision que Hermes peut aussi rédiger lui-même des compétences à partir de travaux qu'il a déjà bien réalisés.

Les deux fichiers fondamentaux : identité et compétence

Avant de confier un vrai travail, la vidéo indique que deux fichiers fondamentaux doivent être en place, le premier étant l'identité. Sur Hermes, c'est soul.md, l'identité principale injectée comme premier bloc du prompt système à chaque exécution. L'installation mène à /opt/data/soul.md dans la démo, tandis que la documentation officielle situe l'emplacement canonique à ~/.hermes/SOUL.md (ou $HERMES_HOME/SOUL.md) ; Hermes crée un fichier de démarrage au premier lancement et retombe sur une valeur par défaut intégrée si le fichier est absent ou vide. Tout ce qui se trouve dans ce fichier façonne le ton, l'autonomie et le comportement de refus ; la procédure dit à l'agent comment faire le travail, l'identité lui dit comment se comporter en permanence, de sorte que deux agents sur la même compétence mais avec des identités différentes rendent des résultats différents.

Écrire des pages de règles à partir d'un fichier vide arrêterait la plupart des gens, c'est pourquoi la vidéo présente Ordain à ordain.host : entrez un e-mail, recevez un code à usage unique et commencez à construire. Le site propose deux constructeurs, l'identité d'abord car une compétence a besoin d'un agent hôte. En haut, vous choisissez la plateforme — Hermes contre OpenClaw ici — puis un nom, puis cochez des cases pour ce que l'agent gère ; le narrateur coche messages et e-mails, recherche, résumés, rappels et planification tout en laissant désactivés création de contenu, réponses clients, codage, aide et assistant général, notant que des cases supplémentaires diluent la concentration. La personnalité offre professionnel, amical, direct, chaleureux et enjoué — direct est choisi — et l'autonomie va de tout-demander-avant à gérer-les-petites-choses-demander-pour-les-grosses jusqu'à fonce-et-rend-compte-après, le réglage intermédiaire étant préféré. La zone de texte libre en bas est présentée comme l'endroit qui mérite le plus de temps : demander l'anglais britannique, la réponse d'abord avec le raisonnement en dessous, pas de remplissage par listes pour atteindre un chiffre rond et une déclaration explicite d'incertitude en cas de doute — des prompts vagues font des agents vagues, les vertus génériques comme « utile » n'apprennent rien de nouveau, et cliquer sur générer remplit le volet droit d'une page d'instructions dans la voix propre de l'agent, prête à télécharger en txt.

Pourquoi un serveur n'est pas optionnel et comment il est provisionné

Même avec une identité soignée, il n'y a pas d'agent sans une machine qui reste allumée ; quand la machine s'endort, l'agent disparaît, et cela compte doublement pour les compétences dont la valeur culmine pendant votre sommeil — la compétence de recherche parcourt seule une pile de pages à 06h00, impossible sur un ordinateur portable fermé. L'hôte utilisé est le KVM2 de Hostinger avec deux cœurs virtuels, 8 Go de RAM et 100 Go de NVMe plus un déploiement Docker en un clic pour Hermes ; le lien vous amène à la page de déploiement avec le coupon de Parker déjà appliqué et une durée de 12 mois suggérée. Après le paiement, le projet apparaît sous Docker Manager aux côtés de Traefik pour la mise en réseau, le nom se termine par quatre caractères aléatoires, le terminal web en haut à droite s'ouvre et deux commandes sont collées — l'une entre dans le conteneur, l'autre lance hermes setup avec la configuration complète, OpenRouter et un plafond d'environ 25 $. Telegram est ensuite connecté, le txt de l'âme et le prompt de copie d'Ordain sont collés l'un après l'autre, l'agent écrit son propre soul.md dans le bon dossier et un /reset démarre la nouvelle session où le fichier est enfin lu, une étape que les gens sautent si bien que les changements ne s'appliquent jamais dans la session où ils ont été faits.

La case qui fait ou défait une compétence

Qu'une compétence fonctionne tient à une seule case dans le second constructeur : que doit-elle faire. Tapez une ligne maigre comme « recherche des sujets et donne-moi un résumé » et vous obtenez un fichier qui dit à peu près cela, laissant l'agent continuer à faire les mêmes choix qu'avant, désormais avec un fichier qui les reflète. La version qui fonctionne nomme les sources par lesquelles commencer et l'ordre dans lequel les parcourir, énonce ce que le brief final doit contenir et précise quoi faire quand les sources se contredisent ou quand rien n'est trouvé ; cette dernière clause empêche l'agent de combler un vide avec un chiffre plausible. Une case d'exigences en dessous verrouille les garanties inter-exécutions — dans l'exemple, chaque affirmation porte un lien et rien de non consulté n'est inclus.

Cliquer à nouveau sur générer produit une compétence correctement formée pour la plateforme choisie. Le haut est un front matter avec le nom, une description d'applicabilité d'une ligne et des tags ; cette ligne fait plus de travail qu'il n'y paraît car c'est la seule partie que l'agent lit pour décider s'il ouvre le reste, donc une description vague signifie que la compétence n'est jamais ouverte, même pour le travail pour lequel elle a été conçue. Le corps déroule ensuite quand l'utiliser, la procédure étape par étape, les pièges et comment vérifier l'exhaustivité à la fin. La section des pièges capture des erreurs déjà observées en conditions réelles et les supprime à l'avenir, tandis que la clause de vérification — souvent omise — explique pourquoi une compétence bien rédigée peut encore rendre un travail mal formaté. La livraison est bidirectionnelle : téléversez le txt dans Telegram et collez le prompt de copie pour que l'agent écrive lui-même le dossier sous hermes/skills, ou déposez directement le zip téléchargé et la compétence passe en ligne instantanément ; étant un ensemble de texte, les modifications se résument à ouvrir, changer une ligne et remplacer.

La confiance se gagne d'abord sur une tâche à réponse connue. Dans la démo, l'agent a accompli le travail correctement mais a formaté comme il voulait, ignorant le modèle du fichier ; les étapes étaient trop lâches, ce n'est pas le modèle qui était en faute, et l'ajout d'une ligne imposant le format imprimé exact a corrigé la seconde exécution — c'est ainsi que la section des pièges grandit. Le même travail de recherche qu'à l'ouverture est ensuite donné mot pour mot ; l'agent correspond à la description, ouvre la procédure et priorise la documentation officielle et les journaux de modifications avant tout fil de forum. Le brief rendu s'ouvre sur un résumé d'une ligne, puis chaque changement des 90 derniers jours avec un lien à côté de chaque chiffre, les désaccords écrits avec les deux parties conservées et rien d'abandonné, et une liste finale de ce qui n'a pas pu être confirmé, chaque entrée indiquant où l'agent a cherché plutôt que d'inventer.

Exécutez le même travail à nouveau et les titres et l'ordre reviennent, sources et sections identiques, seuls les constats diffèrent ; rien n'a été touché entre les exécutions et c'est cette seconde exécution qu'il faut observer, car la première ne prouve que le travail peut être fait une fois — ce qui était déjà le cas avant toute compétence. La dernière étape est la planification : demandez-lui de s'exécuter chaque jour de semaine à 06h00 et d'envoyer le brief sur Telegram, et il câble cela lui-même. Le conseil de départ de la vidéo est de construire quatre compétences avant tout le reste — recherche pour le retour le plus rapide sur la répétition, boîte de réception qui rédige dans votre voix pour que vous éditiez plutôt que composiez, contenu qui rend un script dans votre structure hebdomadaire au lieu de celle supposée par un modèle, et prospection qui trouve des candidats et rédige l'accroche que vous ne trouvez jamais le temps d'écrire. L'heuristique pour en choisir davantage est pratique : tout ce que vous avez fait de la même manière plus de trois fois s'encode bien en compétence, tout ce dont le chemin diverge selon ce que vous trouvez dans les dix premières minutes non, et le forcer rend l'agent pire ; vous pouvez en empiler beaucoup car seules les descriptions correspondantes sont ouvertes, donc la bibliothèque peut croître sans ralentir les exécutions, déplaçant silencieusement votre façon de travailler de la mémoire vers les fichiers jusqu'à ce que l'agent ne soit plus un onglet que vous visitez mais une routine qui a tourné pendant votre sommeil, raison pour laquelle l'exécution mains libres de la démo et le pitch final du KVM2 de Hostinger avec le code Parker sont présentés comme une seule boucle.

Visualization: nodesdaily AI

Commentaire de l’IA

""Mon avis, c'est que la valeur ne réside pas dans le sponsoring mais dans la correction du problème de constance : passer à un modèle plus grand ne résout pas la répétition, c'est fixer le travail dans un fichier qui le fait. Pour la recherche hebdomadaire surtout, un résultat qui cite ses sources, fait apparaître les désaccords et liste ce qui n'a pas pu être vérifié semble plus fiable qu'une réponse plus longue mais intracable.""

Évaluation de l’IA

L'argument le plus fort en faveur de cette approche tient même à son maximum : la constance récompense la mémoire de processus, pas l'intelligence du modèle. Exécuter la même compétence pendant des mois garde le squelette stable malgré les fluctuations de prix, le renouvellement des sources ou les changements de modèle, ce qui est précisément ce dont les briefings hebdomadaires et les flux auditables ont besoin. La preuve la plus simple de la vidéo est l'exécution consécutive sur une entrée identique où seuls les constats bougent tandis que les titres et l'ordre restent fixes. Si votre travail exige une grille comparative, des chiffres sourcés et un traitement visible des désaccords, verrouiller le flux dans un fichier réduit la variance de façon plus fiable que de forcer le prompt à chaque fois.

Les limites sont tout aussi nettes et sous-estimées dans la démo. Tout travail ne doit pas devenir une compétence ; un travail qui bifurque selon ce que vous trouvez dans les dix premières minutes résiste à une procédure fixe et l'envelopper quand même rend l'agent pire. L'âme et la compétence peuvent aussi entrer en collision — quand les instructions d'identité se fondent dans les étapes pratiques, deux agents avec des âmes différentes sur la même compétence divergeront, créant des incohérences de voix de marque ou d'appétit au risque. Un agent entraîné à émettre not-found plutôt que de deviner produira aussi des briefs maigres si les sources sont rares ; sans que vous ajoutiez de couverture, le vide reste vide au lieu d'être utilement comblé. Les générateurs gratuits comme Ordain sont pratiques mais leurs modèles ne sont pas identiques à l'octet entre OpenClaw, Hermes et Claude ; les clés de front matter et les conventions de chemin peuvent empêcher silencieusement une compétence de s'ouvrir un jour.

La vérification exige sa propre hygiène. Les affirmations phares autour de Hermes — environ 236k étoiles et une levée de 1,5 milliard de dollars en discussion — se vérifient face aux compteurs GitHub au-dessus de 240k et au reportage de TechCrunch, mais les promesses opérationnelles comme le KVM2 de Hostinger en un clic et le plafond de 25 $ varient selon la région, la promotion et le cycle de facturation. La directive de la compétence de recherche de consulter la documentation officielle et les journaux de modifications avant les forums est directionnellement correcte et réduit effectivement les hallucinations, mais une matrice plus une liste de citations ne remplace pas le jugement de domaine sur les cas limites. Déposer l'identité et les fichiers contenant des secrets via le chat Telegram est rapide mais laisse des éléments sensibles dans l'historique du chat, donc traitez ces canaux avec l'hygiène standard des secrets.

En pratique, la vidéo est un bon modèle de départ pour les particuliers et un levier de standardisation pour les petites équipes. Les utilisateurs occasionnels qui posent des questions ponctuelles trouveront la surcharge d'une compétence excessive ; les professionnels qui ont besoin du même rapport chaque semaine, de brouillons de boîte de réception dans leur voix, d'un échafaudage de contenu fixe ou d'accroches de prospection constantes verront un retour rapide. Ma règle de travail est de faire passer chaque nouvelle compétence par un test de formatage à réponse connue, d'ajouter un échec réel observé aux pièges, d'exécuter le travail manuellement une fois de plus, puis de le planifier ; suivez les dépenses serveur et modèle parallèlement au temps gagné et commencez par la tâche la plus répétée avant de faire croître la bibliothèque.

Sources

7 liens ; 2 d’entre eux sont aussi cités par 4 autres articles. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.

agent hermes · fichiers de compétences · ordain · soul md · hostinger · agent ia · automatisation

Suivre le sujet

Avant cet article

Un court ordre de lecture des articles antérieurs reliés à cet événement par un éditeur.

Preuves et sources

Consultez les passages autorisés, leurs versions et leur origine.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…

Un agent qui arrête de tout recalculer | Nodesdaily