Outillage d’agents
Un agent échoue rarement en se trompant. Il échoue en affirmant : qu’un test passe sans l’avoir lancé, qu’un bug est corrigé sans l’avoir reproduit, qu’un jalon est atteint parce que les cases sont cochées.
La plupart de ces skills sont des machines à exiger des preuves. Elles sont publiques, sous licence MIT — la méthode se lit, elle ne se raconte pas.
Le dépôt sur GitHubÉcrites de zéro
Chacune est née d’un problème rencontré en production.
verify
- Le problème
- Un agent annonce « c’est corrige » apres avoir lu le code. Lire n’est pas executer.
- Ce qu’elle fait
- Impose la sequence diff → lint → typecheck → tests → build → comportement reel, et distingue explicitement executé, inspecté et supposé.
- Ce qu’elle a changé
- A mis au jour une negociation de contenu morte depuis l’origine : le code compilait, le composant s’executait, la fonctionnalite n’avait jamais marche. Aucune relecture ne l’aurait vue.
debug
- Le problème
- Un rapport de bug nomme un symptome. Le reflexe est de patcher la ou ca fait mal.
- Ce qu’elle fait
- Reproduire, ecrire un test qui echoue, corriger la cause, verifier que les appelants voisins ne sont pas restes casses.
- Ce qu’elle a changé
- Un garde-fou dans la fonction partagee est un diff plus court qu’un garde-fou dans chaque appelant — et il corrige les cas que le ticket ne nommait pas.
doctor
- Le problème
- Hooks morts, connecteurs deconnectes, skills en double. Rien ne le signale : l’agent fonctionne, moins bien.
- Ce qu’elle fait
- Audite version, modele, hooks, connecteurs, plugins, cout du contexte, doublons et elements casses.
learn-error
- Le problème
- Les bases de « lecons apprises » se remplissent d’hypotheses non verifiees, qui deviennent du folklore.
- Ce qu’elle fait
- N’enregistre une lecon qu’apres reproduction du bug ET preuve de la correction par un test. Consigne date, projet, commit, cause, correctif.
- Ce qu’elle a changé
- Une base ou chaque entree porte sa preuve — donc consultable sans se demander si c’est vrai.
architecture-review
- Le problème
- Une revue d’architecture derive vers le style si elle n’a pas de grille.
- Ce qu’elle fait
- Revoit frontieres, couplage, flux de donnees, modes de defaillance, securite et arbitrages de montee en charge.
setup-project
- Le problème
- Cabler un depot neuf ecrase souvent l’outillage deja en place.
- Ce qu’elle fait
- Detecte la stack, met en place configuration, hooks de pre-commit, commande qualite et CI — en fusionnant avec l’existant, jamais en le remplacant.
advance-milestone
- Le problème
- Cocher des taches n’est pas atteindre un objectif.
- Ce qu’elle fait
- Ne passe au jalon suivant qu’apres avoir prouve que le precedent a livre ses resultats.
verify-milestone
- Le problème
- Un jalon peut etre « termine » sans que le resultat promis existe.
- Ce qu’elle fait
- Part de l’objectif et verifie en marche arriere que chaque resultat promis existe dans le code et passe.
auditing-websites
- Le problème
- Un audit de site part dans tous les sens s’il n’a pas d’axes et de criteres de sortie.
- Ce qu’elle fait
- Audite sur cinq axes — design/UX, code, SEO, GEO, CRO — en croisant un audit externe outille et une lecture du depot.
Adaptées
Trois skills dérivées de la méthodologie APEX — Analyze, Plan, Execute, eXamine. La méthode n’est pas de moi ; l’adaptation, oui.
apex-doc
- Le problème
- Un rapport ecrit d’un trait melange analyse, plan et redaction, et se corrige mal.
- Ce qu’elle fait
- Applique la methodologie APEX — Analyze, Plan, Execute, eXamine — aux rapports, audits, memos et propositions.
apex-decision
- Le problème
- Un comparatif d’options n’est pas une decision : il renvoie le choix a celui qui a pose la question.
- Ce qu’elle fait
- Applique APEX aux arbitrages, et produit une recommandation argumentee plutot qu’un tableau.
apex-brief
- Le problème
- Preparer une reunion demande de rassembler ce qui est disperse entre historique, e-mails et taches.
- Ce qu’elle fait
- Applique APEX au briefing de reunion, en croisant plusieurs sources et en datant chaque fait.