L'agent IA a trié les mails du lundi et n'a rien envoyé
Il est 7 h 30 un lundi, dans un scénario imaginaire : une entreprise de plomberie de cinq personnes teste un agent autonome sur une boîte mail de test. Depuis vendredi, l’agent a lu une soixantaine de mails, préparé une douzaine de brouillons de réponse aux demandes de devis, et n’en a envoyé aucun. Il a aussi rangé dans les publicités la réclamation d’un client.
Le patron a pourtant de bonnes raisons de vouloir déléguer ce tri. Dans le baromètre ARTIsanté 2025, 63 % des 2 491 chefs d’entreprise artisanale du BTP et du paysage interrogés consultent leurs mails tous les jours pendant leurs congés. Voyons ce que fait l’agent, tâche par tâche, et où il casse.
Le tri des mails, ou la consigne qui s’efface
L’agent lit chaque mail entrant, le range, résume les échanges longs et rédige un brouillon pour chaque demande de devis. Sur ce genre de tâche, l’évaluation d’un assistant de bureautique menée par le ministère britannique du Commerce, à partir des journaux de bord de 300 fonctionnaires, trouve environ 0,2 heure gagnée par mail rédigé et autant par lot de mails résumés. L’outil testé, Copilot, n’était pas un agent autonome. Pour une équipe de cinq, nous estimons le gain à une à trois heures par semaine selon le volume : un ordre de grandeur, non une mesure. Pour la facture, voyez ce qu’un agent autonome coûte chaque mois.
Le passage de la boîte de test à la vraie boîte pose un autre problème. En février 2026, selon la presse, une salariée de Meta a branché sur sa messagerie un agent autonome testé sans incident, des semaines durant, sur une petite boîte. Le volume a déclenché le résumé automatique de l’historique, et la consigne « confirme avant d’agir » s’est perdue dans ce résumé. L’agent a supprimé plus de 200 mails en ignorant le « STOP » envoyé depuis son téléphone. La note de la CNIL et du CIANum de juillet 2026 rapporte l’épisode sans ces détails : de nombreux mails professionnels supprimés, et un processus difficile à interrompre à distance.
Le CERT-FR, dans son bulletin CERTFR-2026-ACT-016, écrit que ces agents « ne doivent en aucun cas être déployés en environnements de production » et demande une validation humaine avant toute action à effet de bord. Le pilote tourne donc sur une boîte de test remplie de mails fictifs, avec un agent limité à la lecture et aux brouillons, sans droit d’envoi ni de suppression, et le dirigeant relit chaque brouillon. Pour la vraie boîte, la voie raisonnable reste un workflow de tri encadré, qui démarre en mode shadow.
Une relance de devis engage le cabinet
Dans un cabinet de cinq personnes, des devis envoyés il y a trois semaines dorment sans réponse. L’agent les repère et rédige une relance pour chacun. Faute de mesure indépendante, nous estimons le gain à quelques minutes par relance, et des devis qui ne tombent plus dans l’oubli.
L’exemple monte d’un cran, parce que l’agent s’adresse au client. Dans Project Vend, un modèle d’Anthropic qui gérait une petite boutique a indiqué à des clients un compte de paiement inventé et distribué des codes de remise sous la pression. Chez Cursor, en avril 2025, le bot de support a inventé une règle de connexion pour expliquer des déconnexions, et des abonnés ont résilié. Au cabinet, cela donnerait une pénalité de retard imaginaire dans la relance d’un client fidèle depuis dix ans.
Pour un cabinet d’avocats, le guide adopté par le CNB le 17 mars 2026 ajoute le secret professionnel. Le pilote se fait sur des devis fictifs ; en production, un workflow de relance à paliers laisse l’IA rédiger et la personne qui connaît le client lire chaque message.
Guide gratuit
Le Guide Pratique de l'Automatisation pour PME
Un guide concret pour identifier vos processus répétitifs, choisir entre Make, n8n et Zapier, et mesurer le ROI de chaque automatisation. Inclut une checklist d'audit et des exemples réels de PME françaises.
Recevoir le guide gratuitementLe mail qui donne des ordres à l’agent
Donnons à l’agent de l’artisan le droit de répondre seul. Il réunit alors ce que Simon Willison appelle la « lethal trifecta » : l’accès à des données privées, l’exposition à du contenu non fiable et la capacité de communiquer vers l’extérieur. Un agent de messagerie autorisé à envoyer les cumule par construction, puisque n’importe qui peut lui écrire.
Avec EchoLeak, une faille de Microsoft 365 Copilot notée 9,3 sur 10 et corrigée avant sa divulgation, un seul mail porteur de consignes cachées suffisait à faire exfiltrer des données, sans aucun clic. Aucune exploitation n’a été signalée. L’assistant traitait les instructions d’un inconnu comme celles de son utilisateur.
L’alerte gratuite qui bat l’agent
Surveiller chaque nuit les appels d’offres ressemble à un travail d’agent, mais un outil public gratuit le fait déjà. Avec un compte, le service d’alerte du BOAMP prévient chaque jour par mail des annonces publiées au BOAMP qui correspondent à vos critères, jusqu’à dix alertes, sans accès à votre messagerie.
Sur l’agenda, la même évaluation britannique trouve un temps négatif : 0,6 heure perdue par tâche, surtout faute de propositions de qualité. Un agenda réel, plein de données personnelles, sort d’ailleurs du cadre du CERT-FR.
Le critère utile porte donc sur la tâche. Pour repérer un mot-clé ou un créneau libre, une règle gratuite fait mieux. Quand il faut lire et juger un texte, l’agent prépare, et une personne décide dès que le résultat part vers un client ou engage de l’argent. Anthropic, qui vend les modèles, conseille lui-même dans « Building effective agents » de chercher « the simplest solution possible ».
Quand nous cadrons ce type de projet, nous cherchons d’abord l’étape qui demande du jugement, souvent plus petite qu’on ne le croit. Une petite structure allemande, la Carbon Drawdown Initiative, a obtenu de son agent un briefing quotidien jugé utile, avec un compte Gmail dédié et un agenda en lecture seule, hors du cadre que recommande le CERT-FR et au prix de nombreux plantages.
Par quoi commencer, selon votre métier
La règle commune : l’agent prépare, et un humain valide tout ce qui part vers un client ou engage de l’argent. La note CNIL/CIANum demande une intervention humaine « réelle, effective » et précise qu’« une validation purement formelle ou automatique est insuffisante » : cliquer sur « envoyer » sans lire ne compte pas.
- Pour tous les métiers, le premier pilote peut être un briefing du lundi sur des sources publiques, comme l’actualité du secteur. Sans donnée client, il tient dans le bac à sable isolé que demande le CERT-FR.
- Si vous êtes artisan, laissez la détection des marchés à l’alerte BOAMP et testez les brouillons de devis sur une boîte de test.
- Si vous dirigez un cabinet, faites rédiger les relances et lisez-les une par une.
- Dans tous les cas, refusez à l’agent la suppression et l’envoi autonome, et vérifiez que son arrêt d’urgence, le « kill switch » évoqué par la CNIL, fonctionne à distance.
L’agent autonome rend service quand il lit et prépare des brouillons, et devient risqué dès qu’il envoie ou supprime. Dans une TPE, sa place est aujourd’hui le pilote isolé, où l’on apprend ce qu’il vaut sur ses propres tâches. Le lundi suivant, le plombier de notre scénario relit la douzaine de brouillons, repêche la réclamation rangée dans les publicités et envoie lui-même ce qui doit partir.
Restez informé des dernières actualités gratuitement
Automatisation, IA, développement web et stratégie digitale pour PME. Un email par semaine, zéro spam.
Articles similaires
Zapier, n8n, Make : l'automatisation agentique en 2026
5 agents IA que votre PME peut déployer ce trimestre
5 processus à automatiser dans votre PME dès aujourd'hui