Pourquoi je contribue aux agents IA en tant qu’ergonome
De la psychologie cognitive aux interfaces complexes, au travail à La Réunion et aux contributions Hermes et Treg : le parcours derrière mes revues humain–agent.
Le 12 septembre, Teknium m’a proposé de revoir une nouvelle fonctionnalité d’Hermes Agent. Bot Screen permettrait d’ouvrir le bureau d’un agent, d’en prendre le contrôle pour accomplir une étape comme une connexion, puis de lui rendre la main. J’ai analysé l’interaction, documenté cinq problèmes et deux remarques de conception, puis publié ma revue sur GitHub. Teknium a reproduit les cinq problèmes et documenté leurs corrections. La fonctionnalité a été fusionnée le 23 septembre.
Cette invitation comptait pour moi. Elle reliait ma contribution à la partie de l’ergonomie que je voulais initialement pratiquer : comprendre ce qui se passe entre une personne et un système capable d’agir.
Ce travail est documenté publiquement. Il mérite aussi un peu de contexte. Une contribution à un agent IA peut sembler un détour inattendu pour un ergonome. Dans mon cas, elle fait se rejoindre plusieurs parties de mon parcours.
Apprendre à regarder l’activité
Ma formation m’a conduit de la psychologie cognitive à l’ergonomie. Je m’intéressais à la manière dont une personne comprend une situation, décide quoi faire, utilise une interface et récupère lorsque les événements cessent de suivre le cours attendu. Le travail sur des interfaces complexes chez Human Design Group et Amadeus a ensuite donné un cadre pratique à ces questions.
Une interface présente une certaine lecture du système. La personne s’appuie dessus pour décider d’agir, d’attendre, de vérifier ou de demander de l’aide. Cette relation devient particulièrement importante lorsque le processus continue alors que son attention est ailleurs.
L’ergonomie me donne une manière de l’examiner. Je pars de l’activité à accomplir, des informations disponibles et des exigences que le système impose à la personne. Un signal ambigu peut modifier une décision. Un état manquant peut obliger quelqu’un à mémoriser ce que le produit a oublié. Une procédure de récupération peut devenir un travail supplémentaire.
Ces questions étaient déjà présentes dans ma formation. Les agents leur donnent une forme particulièrement concrète : un logiciel peut désormais enchaîner des actions, rencontrer une difficulté et demander à une personne d’intervenir au milieu du parcours.
Travailler depuis La Réunion
Je suis devenu ergonome indépendant en 2020 et me suis installé à La Réunion en 2022. Mon activité s’est développée à partir des besoins des organisations et des entrepreneurs : comprendre les situations de travail, former, accompagner l’introduction de l’IA et configurer des agents pour des tâches quotidiennes.
Ce contexte façonne les questions que j’adresse à un produit. Une personne a déjà ses outils, ses responsabilités, ses interruptions et ses habitudes. Elle peut savoir expliquer son besoin sans connaître le fonctionnement des outils ou de la mémoire d’un agent. Lorsqu’elle délègue, le système doit soutenir une activité qui se poursuit au-delà de la fenêtre de conversation.
J’utilise et j’opère aussi des agents moi-même. Cette implication pratique rend des difficultés visibles, mais elle ne transforme pas chaque expérience en résultat généralisable. Un événement inattendu constitue un point de départ. Il reste à identifier le mécanisme, à établir ce qui s’est passé et à déterminer jusqu’où la conclusion tient.
Le passage utile consiste à transformer une difficulté particulière en quelque chose qu’une autre équipe peut examiner : un scénario, une reproduction, une exigence d’interaction ou une proposition de correction.
Suivre le problème jusque dans le produit
Certaines de ces contributions ont porté sur le code. En avril, mon travail sur le fournisseur xAI natif a été repris dans la PR Hermes #7372, avec conservation de l’attribution. En mai, une contribution sur la transmission de l’effort de raisonnement demandé a été intégrée dans la PR #22807.
Un réglage proposé à l’utilisateur mais silencieusement ignoré crée un écart entre ce que la personne pense avoir demandé et ce que le système fait réellement. Le résoudre suppose de suivre la demande dans l’intégration, au-delà de l’interface où le choix a été effectué.
En septembre, j’ai proposé une correction des lectures effectuées sous une identité cliente fixée dans Treg. Le mainteneur a revu la proposition, complété les chemins manquants et fusionné la PR. Cette contribution concernait les historiques, résultats et objets asynchrones qu’une connexion pouvait relire. Son périmètre est documenté dans la revue.
J’utilise des agents IA dans ce travail technique, notamment pour l’implémentation et les vérifications. Je reste responsable du problème que je signale et des affirmations que je formule sur le résultat. L’attribution compte aussi dans l’autre sens : les corrections et les essais du mainteneur restent son travail.
Le fil conducteur est l’effort pour qu’un usage prévu tienne à travers le système. Parfois, la contribution utile est un correctif. Parfois, c’est une question qui modifie les exigences d’une fonctionnalité.
L’invitation à revoir Bot Screen
Bot Screen a donné une forme précise à cette seconde contribution. La fonctionnalité proposait une action humaine claire : prendre le contrôle du bureau de l’agent. J’ai examiné ce que cela impliquait pour les autres chemins par lesquels l’agent pouvait encore agir, pour les observations déjà en cours et pour l’état présenté à la personne.
La revue a identifié cinq problèmes : des outils navigateur pouvaient contourner le contrôle humain ; une capture pouvait traverser un cycle complet de prise et de restitution du contrôle ; une coupure involontaire pouvait rendre la main ; une ancienne image pouvait rester présentée comme actuelle ; enfin, les événements d’un hôte pouvaient affecter l’état de contrôle affiché pour un autre.
La réponse publique de Teknium confirme la reproduction des signalements et décrit leur traitement. Mon apport était la revue et les sondes de régression assistées par IA. Les correctifs et les vérifications en environnement réel rapportées sont ceux du mainteneur. Je détaille les mécanismes dans Quand « Prendre le contrôle » ne donne pas la main.
Ce qui compte pour moi dans cet épisode, c’est le passage d’une question d’interaction à un changement qu’une équipe peut examiner. Le sens de « vous avez le contrôle » avait des conséquences sur l’accès aux outils, la gestion des connexions et ce que l’interface donnait à comprendre.
Rendre ce travail lisible
Mes articles explorent des questions voisines : ce qui arrive lorsqu’un agent annonce trop tôt qu’un travail est terminé, la manière de transformer un échec complexe en cas d’évaluation utile, ou la supervision qu’un produit laisse à la charge de la mémoire humaine. Les traces brutes ne sont pas des évaluations et The user’s head is not the runtime, en anglais, font partie de ce travail.
Les contributions donnent une forme supplémentaire à ces questions. Un lecteur peut examiner le problème soulevé, la réponse et le changement obtenu. Il peut aussi voir où s’arrête une conclusion. Cela permet de comprendre plus facilement ce que je peux apporter à une équipe.
Je souhaite poursuivre ce travail : des revues ciblées de fonctionnalités et de parcours où des personnes délèguent, surveillent, interviennent ou récupèrent une situation. Un point de départ utile est une question produit précise et une équipe prête à l’examiner ensemble.
Si cela correspond à ce que vous développez, proposez-moi une fonctionnalité à revoir. Mon travail d’ergonome relie désormais les organisations qui utilisent les agents aux équipes qui les construisent. Je veux garder cette relation assez proche pour qu’une difficulté d’usage puisse devenir une meilleure décision de conception.