AgentsFace B · article à quatre mains avec Jules Thomas · 6 min de lecture

À l'établi avec deux agents IA : pourquoi le contrôle humain reste indispensable

Illustration de l'article : deux agents IA qui se relisent, et un contrôle humain

Jules Thomas, architecte IA et agents (L'Atelier Algorithmique), et nous avons laissé nos agents IA se relire l'un l'autre. Il raconte la rencontre chez lui, dans « Les humains vérifient, les IA travaillent ». Voici la même histoire vue de notre côté, puis les trois semaines qui ont suivi : cinq erreurs de notre agent, pourquoi elles sont passées, et le contrôle que nous avons adopté pour chacune.

Tout a commencé par un défaut

Jules raconte la rencontre ; voici ce qui s'est passé de notre côté. Notre histoire à nous commence par nos défauts, et c'est son agent qui les a trouvés.

Le 6 août, une semaine après nos premiers échanges, Jules nous envoie un audit de markentiq.com, fait à sa demande par son agent, Phrasti. Le défaut technique relevé était réel : notre site chargeait des polices Google avant que le visiteur ait accepté quoi que ce soit. Nous l'avons corrigé le jour même. Cet audit est devenu l'exemple complet de sa méthode, Auditer un site avec un assistant outillé, publiée chez nous en usage libre le 26 août.

Début septembre, c'est notre tour. Dans le dossier que nous préparons sur son site, latelieralgorithmique.com, nous écrivons qu'aucun site ne renvoie vers le sien. C'est faux : notre page de méthode le fait depuis huit jours, avec un lien suivi. L'outil de mesure ne l'avait pas encore vu, et nous avions pris son zéro pour un constat.

Nous l'avons trouvé en comptant, avant de demander un lien à Jules, tout ce que notre site lui donnait déjà : notre propre lien était dans le compte. Nous lui avons signalé l'erreur dans le courriel qui lui remettait le dossier, avec la phrase qu'il cite : un zéro rendu par un outil est une absence de mesure, pas une mesure d'absence.

Ce que nous faisons depuis. Un zéro rendu par un outil n'entre plus dans un livrable sans une vérification sur la source elle-même : la page servie, le lien en ligne. Et avant de demander quelque chose, nous comptons ce que nous donnons déjà.

Deux agents au travail

L'agent de Jules s'appelle Phrasti. Le nôtre s'appelle MarkestrIA. Il produit des dossiers de positionnement selon notre Pack Positioning & Business Story, avec une grille où chaque affirmation porte son niveau de preuve : vérifiée, recoupée ou simplement déclarée.

MarkestrIA a étudié l'image publique de L'Atelier Algorithmique, positionnement et concurrence compris, et a rendu à Jules quatre-vingt-dix-sept pages en trois documents. Puis un relevé de sa visibilité dans les réponses des IA. Phrasti a relu notre dossier et nous a rendu la liste de ce qui y était inexact.

Le point le plus utile de cette liste était dans une annexe : une phrase restée d'une version précédente, qui contredisait le corps du dossier. Phrasti avait raison, et nos propres contrôles ne l'avaient pas vue. Ce que nous faisons depuis : quand un fait change, une passe relit tout le document contre ce fait, annexes comprises.

Où s'arrête le travail d'un agent IA

Jules écrit que les agents ont lu, compté, comparé, et qu'ils se sont aussi trompés. Nous sommes d'accord avec lui, des deux côtés.

Il écrit aussi ce qu'ils n'ont pas fait : arbitrer. Écrire à un inconnu que son offre a un problème, aucun agent ne l'a fait de lui-même. Chez nous, c'est une règle : nos agents rédigent, un humain relit et envoie. Nous l'expliquons dans Agent IA marketing : retirez le bouton envoyer.

Le récit de Jules s'arrête à la remise du dossier, début septembre. Les trois semaines qui ont suivi sont celles dont nous avons le plus appris.

Les trois semaines d'après

Les quarante pages. Notre courriel du 3 septembre annonçait un document de « quarante pages ». Il en comptait quarante-trois, et personne n'avait recompté. Jules nous a cités fidèlement, et notre approximation est passée telle quelle dans son premier jet. Contrôle adopté : tout chiffre qui peut se recompter est recompté par un script au moment d'écrire, jamais repris d'un message précédent.

Le fichier envoyé. La liste de Phrasti, exacte sur tous les points, portait sur une version de notre dossier sans les vingt-deux lignes ajoutées après la remise : nous avions modifié un fichier déjà livré. Contrôle adopté : un fichier livré ne se modifie plus. Toute correction crée une nouvelle version, envoyée avec l'empreinte numérique de chaque fichier (une signature qui change dès qu'un caractère change), que le destinataire peut comparer.

Le nom. MarkestrIA nous signale que le nom de Jules varie d'une page à l'autre de son site. Nous avons failli le lui écrire. Les trente-cinq mentions de son site disent toutes « Jules Thomas ». MarkestrIA n'avait pas ouvert le site : il avait relu une de nos notes de travail, vieille de trois semaines et antérieure à une mise à jour de Jules, et il l'avait prise pour le site d'aujourd'hui. Contrôle adopté : un constat sur un site se fait sur la page servie, et la phrase dit quand elle a été ouverte. Une note ou un résumé ne suffit jamais.

Les liens. En préparant ce texte, MarkestrIA affirme que notre site ne renvoie nulle part vers Jules. Six de nos pages le font, avec sept liens. Il avait lu une page et conclu pour tout le site. Contrôle adopté : une absence ne s'affirme qu'après avoir ouvert toutes les pages du site en ligne, avec un script qui suit le plan du site, jamais sur un échantillon.

Les frictions. Le même jour, dans le courriel qui accompagne le dossier, MarkestrIA écrit que la méthode fait valider les points de friction « de A à E ». Le dossier de Jules en compte quatre, de A à D. Le « E » venait du modèle général du pack. Contrôle adopté : avant l'envoi, tout ce que le courriel affirme du document est vérifié dans le document lui-même, pas dans son modèle.

Une seule cause pour les cinq. Aucune n'est inventée : chaque fois, la bonne information existait, on pouvait l'ouvrir, et elle disait autre chose. L'agent ne l'a pas ouverte parce qu'il avait sous la main une note qui avait vieilli, ou un modèle général qui ne décrivait pas ce cas. Une invention se trahit souvent : la phrase devient vague, le ton prudent. Une note périmée se lit exactement comme une observation du jour : précise, datée, assurée. C'est pour cela qu'une relecture ne la voit pas.

Ce qui les attrape : le harness de l'agent. Le harness (le harnais, en français) désigne l'ensemble des règles, des contrôles et des outils placés autour d'un agent IA pour vérifier ce qu'il affirme avant que cela sorte. Les cinq erreurs ont été trouvées par un humain qui a demandé à voir la source. Les cinq contrôles adoptés font désormais partie de notre harness, pour que cette vérification ne dépende plus de la vigilance d'une personne. Elle part d'une question simple : ne demandez pas à un agent « es-tu sûr ? », il répondra oui ; demandez-lui « quelle page as-tu ouverte, et quand ? ».

Pourquoi ça a marché

Nous en voyons trois raisons, et voici ce que chacune a permis.

Nous avons échangé des faits avant des compliments, et l'un de nos premiers faits était notre propre erreur. Un fait se vérifie : Jules pouvait ouvrir notre page et constater que le lien existait. C'est ce qui a permis de se faire confiance sans se connaître.

Chacun a annoncé son périmètre. Notre dossier s'ouvre sur ce qu'il ne couvre pas, les retours de Phrasti se terminent sur ce qu'il n'a pas pu contrôler. Annoncer ses limites dit à l'autre où son propre contrôle doit commencer. Personne n'a pris un silence pour une validation.

Nous avons donné sans rien attendre en retour. Une méthode en usage libre d'un côté, un dossier complet de l'autre. Personne n'a envoyé de devis, et c'est ce qui a permis de dire les défauts sans détour.

Ce que vous pouvez en tirer, si vous travaillez avec un agent IA

Trois gestes, du moins coûteux au plus exigeant.

  1. Avant d'accepter un constat de votre agent, exigez la source et la date. S'il répond par une note ou un résumé, le constat reste à faire.
  2. Faites recompter par un script tout chiffre qui peut l'être, au moment d'écrire.
  3. Faites relire le travail d'un agent par un autre agent, qui n'a pas ses notes. Un agent qui se relit lui-même consulte les notes qui l'ont trompé, et se donne raison.

Cette histoire a deux faces. Jules Thomas raconte la sienne sur L'Atelier Algorithmique, dans « Les humains vérifient, les IA travaillent ». Celle-ci est la nôtre, et chacun a relu l'autre avant publication. Le travail d'août sur sa méthode est raconté dans l'épisode 9 de notre journal.

Cette page vous a servi ? Partagez-la sur LinkedIn. Pour retrouver nos publications dans vos résultats Google, ajoutez MarkenTIQ à vos sources préférées.

Julien Fauvel, pour MarkenTIQ · 24 septembre 2026

Échanger · la newsletter

Recevez les prochains articles et les annonces.

Laissez votre email : vous recevez les nouveaux articles et les annonces des prochains packs et méthodes, rien d'autre.

En vous inscrivant, vous recevez la newsletter MarkenTIQ : articles, packs de méthode, retours de terrain. Désinscription en un clic. Données traitées via Brevo.