Agents IA en entreprise

Superviser un agent IA en production : quoi contrôler, qui valide, à quel rythme

En bref

Superviser un agent IA en production, c’est contrôler cinq choses : ses droits, ses sorties, ses journaux, ses coûts et sa dérive. Une personne désignée valide avant exécution ce qui engage l’entreprise ; des contrôles automatiques vérifient le reste à chaque exécution. L’AI Act n’impose ce contrôle humain qu’aux systèmes à haut risque, à partir du 2 décembre 2027.

Ce qu’imposent l’AI Act et le RGPD, et à qui

L’AI Act ne crée pas de règle propre aux agents. La note de la CNIL et du Conseil de l’IA et du numérique (CIANum) du 20 juillet 2026 le rappelle : le règlement s’applique aux systèmes d’IA agentique, sans prévoir de règles spécifiques pour eux. Ce qui décide de vos obligations, c’est l’usage que vous faites de l’agent.

Pour un système à haut risque, deux articles organisent la supervision. L’article 14 oblige le fournisseur à concevoir le système pour qu’une personne puisse le surveiller pendant son utilisation : comprendre ses capacités et ses limites, rester consciente du biais d’automatisation, interpréter ses sorties, décider de ne pas les suivre, et l’interrompre par un bouton d’arrêt. L’article 26 oblige le déployeur, c’est-à-dire l’entreprise qui l’utilise, à confier ce contrôle à des personnes qui ont la compétence, la formation et l’autorité nécessaires, à surveiller le fonctionnement du système, à en suspendre l’usage et prévenir le fournisseur et l’autorité de surveillance du marché s’il présente un risque, et à garder ses journaux au moins six mois.

Pour un agent courant, rien de tel. L’AI Act vous demande de prendre des mesures pour la maîtrise de l’IA de vos équipes (article 4) depuis le 2 février 2025, et la transparence (article 50) depuis le 2 août 2026, quand l’agent échange avec des personnes ou génère du contenu. Le RGPD, lui, s’applique dans tous les cas : une décision fondée exclusivement sur un traitement automatisé, qui produit des effets juridiques sur une personne ou l’affecte de manière significative, reste interdite sauf exceptions (article 22). La CNIL et le CIANum précisent qu’une validation purement formelle ou automatique ne suffit pas : l’intervention humaine doit pouvoir changer la décision.

Agent courant

Trier, préparer, rédiger, qualifier

Obligation

Système à haut risque

Recruter, évaluer un salarié, accorder un crédit

Aucun article dédiéContrôle humain exigé par l’AI ActArticles 14 et 26 : des personnes compétentes, formées, avec l’autorité de refuser et d’arrêter
Contrôles réguliers recommandés par la CNIL, selon la sensibilité des usagesSurveillance du fonctionnementObligatoire : suspendre l’usage et prévenir le fournisseur et l’autorité en cas de risque
Durée à justifier au regard du RGPDJournauxAu moins six mois pour ceux que vous contrôlez
Maîtrise de l’IA depuis le 2 février 2025 ; transparence depuis le 2 août 2026Depuis quandÀ partir du 2 décembre 2027 (annexe III)
S’applique si l’agent décide seul d’un effet juridique sur une personneRGPD, article 22S’applique de la même façon

Agent courant · Votre cas si

L’agent prépare le travail et une personne valide ce qui engage l’entreprise.

Système à haut risque · Votre cas si

La sortie de l’agent sert à trier des candidats, évaluer des salariés ou accorder un crédit.

D’après les articles 4, 14, 26 et 50 du règlement (UE) 2024/1689 modifié, l’article 22 du RGPD et les questions-réponses de la CNIL du 18 juillet 2024, synthèse Agentic Conseil.

Hors haut risque, rien ne vous oblige à suivre l’article 14. Sa liste reste la grille la plus claire pour décider de ce qu’une personne doit pouvoir faire face à un agent : comprendre, interpréter, refuser une sortie, arrêter.

Les dates qui comptent pour la supervision

Le règlement (UE) 2026/1744, en vigueur depuis le 27 juillet 2026, a reporté les obligations des systèmes à haut risque. Certains sites affichent encore le 2 août 2026 pour le haut risque : c’est l’ancienne date, remplacée par le 2 décembre 2027 pour l’annexe III. Le calendrier complet et votre rôle de déployeur sont détaillés sur la page AI Act : ce qui s’applique à votre PME.

  1. En vigueur

    Maîtrise de l’IA (article 4)

    Vous êtes concerné si : vos équipes utilisent ou supervisent un agent

  2. En vigueur

    Transparence (article 50)

    Vous êtes concerné si : l’agent échange avec vos clients ou génère du contenu

  3. Aujourd’hui

    Aujourd’hui · 5 octobre 2026

  4. Prochaine échéance · dans 14 mois

    Haut risque de l’annexe III : contrôle humain (articles 14 et 26), journaux gardés au moins six mois

    Vous êtes concerné si : l’agent trie des candidats, évalue des salariés ou accorde un crédit

  5. Dans 22 mois

    Haut risque intégré à un produit réglementé

    Vous êtes concerné si : vous fabriquez un produit soumis à marquage CE

Dates du règlement (UE) 2024/1689 modifié par le règlement (UE) 2026/1744, état au 5 octobre 2026.

Les cinq contrôles d’un agent en production

Superviser ne se résume pas à relire. La supervision se prépare avant la mise en ligne (des tests), tourne à chaque exécution (des contrôles automatiques), remonte à une personne pour les cas sensibles (une revue humaine) et laisse une trace (des journaux). Cinq points la structurent.

Grille Agentic Conseil, tirée de notre infrastructure en production et de la note CNIL et CIANum du 20 juillet 2026.
ContrôleCe qu’on vérifieCommentQuand
DroitsL’agent n’accède qu’aux données et aux outils de sa tâcheUne liste d’accès par agent, écrite au cadrageÀ chaque nouvel outil branché
SortiesCe qu’il produit est exact, conforme et reste dans son rôleTests sur des cas réels, contrôle automatique, relecture humaine des cas sensiblesAvant la mise en ligne, puis à chaque exécution
JournauxOn peut reconstituer qui a fait quoi, quand, avec quel résultatUn registre de chaque action, analysé automatiquement, avec alerte en cas d’échecÀ chaque action ; analyse chaque jour
CoûtsLa dépense reste sous le plafond fixéUn plafond mensuel de dépenses d’API, une alerte avant de l’atteindre, un petit modèle pour les tâches simplesEn continu
DériveL’agent se comporte comme au jour de sa mise en serviceLes mêmes cas de test rejoués, la version du modèle suivieÀ chaque changement de modèle ou de consigne

Droits. Sur notre infrastructure, douze agents spécialisés ont chacun des outils limités à leur tâche : le relecteur ne peut pas modifier le code, la vigie ne peut rien corriger. La note CNIL et CIANum va dans le même sens : seules les données strictement nécessaires à la tâche devraient être accessibles à l’agent, dans un environnement cloisonné.

Sorties. Un premier contrôle peut être automatique : sur notre chaîne de contenus, un agent évaluateur note chaque texte sur 100 et bloque ceux qui n’atteignent pas 70, et un agent conformité oppose un veto que seule une personne peut lever. Le contrôle automatique filtre ; il ne remplace pas la personne pour ce qui engage l’entreprise. La CNIL le rappelle : un modèle peut produire des résultats inexacts qui paraissent plausibles.

Coûts. Sur notre infrastructure, un message simple est trié par un petit modèle plutôt que par le cycle complet, bien plus coûteux. Orienter chaque tâche vers le bon modèle est donc un contrôle à part entière. Le budget d’API y est plafonné chaque mois, avec une alerte avant d’atteindre le plafond.

Dérive. Un agent peut changer sans que vous touchiez à rien : le fournisseur fait évoluer ou retire un modèle. Sur notre vigie de visibilité, la mesure ChatGPT est interrompue depuis août 2026, l’éditeur ayant déprécié le modèle utilisé ; la part de voix dans les IA repose depuis sur Gemini seul. La note CNIL et CIANum recommande des tests de robustesse avant le déploiement et tout au long de celui-ci : rejouer les mêmes cas de test à chaque changement de modèle en est la forme la plus simple.

Qui valide quoi : classer les actions par niveau de risque

La note CNIL et CIANum propose de classer les actions possibles de l’agent sur chaque service par niveau de risque (accès à des données, modification ou suppression, envoi de données hors du système, nature des données : financières, de santé) et de réserver la validation humaine avant exécution aux plus critiques. Tout faire valider produit l’effet inverse : l’article 14 demande justement que la personne reste consciente du biais d’automatisation, la tendance à se fier par défaut à la sortie d’un système.

  1. Critique

    Validée avant exécution

    Achat, mise en ligne, envoi hors de vos outils, suppression, données financières ou de santé : l’agent prépare, une personne désignée décide.

  2. Modification

    Contrôlée, puis relue par échantillon

    Écrire dans le CRM, classer un document, mettre à jour une fiche : un contrôle automatique à chaque écriture, une relecture humaine d’un échantillon.

  3. Lecture

    Journalisée

    Lire un e-mail, chercher une information, résumer : pas de validation, une trace dans le registre, sur les seules données ouvertes à l’agent.

Niveaux d’action tirés de la note CNIL et CIANum du 20 juillet 2026 (partie IV) ; règles de validation : méthode Agentic Conseil.

Sur notre infrastructure, la ligne est écrite : achats, mises en ligne et actions destructives attendent une validation humaine. La personne qui valide doit pouvoir refuser. La CNIL et le CIANum rappellent, après l’arrêt SCHUFA de la Cour de justice de l’Union du 7 décembre 2023, que l’intervention humaine doit être « réelle, effective et exercer une influence sur la décision finale ».

Au-dessus de cette personne, un référent. Pour les usages sensibles, la CNIL recommande un comité ou un référent qui donne un avis formel avant le déploiement ou toute nouvelle utilisation, et qu’on informe régulièrement, par exemple lors d’un bilan annuel. Dans une PME, ce rôle peut revenir au délégué à la protection des données s’il existe, que la CNIL cite pour cette gouvernance, ou au dirigeant.

Le circuit de supervision, de l’action au bilan

Trois acteurs se relaient à chaque exécution, et un quatrième regarde l’ensemble : chaque semaine au départ, puis à un rythme ajusté au volume et à la sensibilité des actions.

L’agent
Contrôles automatiques
La personne désignée
1

L’agent

Lit la demande, prépare l’action et l’inscrit au registre : qui, quoi, résultat, coût.

2

Contrôles automatiques

Vérifient chaque sortie, bloquent ce qui sort des règles, alertent sur un échec ou un dépassement de budget.

3

La personne désignée

Valide avant exécution ce qui engage l’entreprise ; peut refuser, corriger ou arrêter l’agent.

Le référent
Le référent · Chaque semaineRelit rapports, alertes et actions refusées, puis ajuste les règles de l’agent. Donne un avis avant toute nouvelle utilisation et dresse un bilan une fois par an.
Circuit recommandé par Agentic Conseil, d’après la note CNIL et CIANum du 20 juillet 2026 et les questions-réponses de la CNIL du 18 juillet 2024 (question 8).

Les journaux : tout tracer, sans tout garder

Le journal est l’outil central de la supervision, et le point où elle rencontre le RGPD. Il doit permettre de reconstituer chaque tâche : la note CNIL et CIANum cite les données personnelles mobilisées, les agents intervenus, les services tiers sollicités, les échanges réalisés et leur chronologie. Mais un journal qui recopie chaque e-mail client devient lui-même un fichier de données personnelles à protéger.

La recommandation de la CNIL sur la journalisation, adoptée le 14 octobre 2021, donne la méthode : enregistrer l’auteur, l’horodatage, la nature de l’opération et la référence des données concernées, sans dupliquer les données elles-mêmes, et conserver ces traces entre six mois et un an. Elle demande aussi un système d’analyse qui génère des alertes en cas de comportement anormal. Quand les données du traitement principal sont gardées moins de six mois, elle recommande de ne garder dans les journaux que des identifiants pseudonymes, ou de purger automatiquement ce qui a expiré.

D’après la recommandation de la CNIL sur la journalisation (14 octobre 2021) et la note CNIL et CIANum du 20 juillet 2026.
ThèmeLe journal gardeLe journal évite
AuteurL’agent ou la personne qui a agi, identifié un par un Un compte partagé qui ne dit pas qui a agi
OpérationL’horodatage, la nature de l’opération, la référence de la donnée Une copie intégrale de l’e-mail ou du document traité
ChaîneLes agents intervenus et les services tiers appelés, dans l’ordre Une trace qui s’arrête au premier agent
CoûtLe coût de chaque exécution Un total mensuel sans détail par tâche
AccèsRéservé aux personnes qui en ont besoin ; l’agent écrit, sans pouvoir réécrire Un journal que l’agent peut modifier ou effacer

Le contenu des échanges, lui, ne se garde pas plus longtemps que nécessaire (article 5 du RGPD) : sur nos missions, les journaux de l’agent sont conservés six mois, durée recommandée par la CNIL pour les journaux de traçabilité, sans copie des données traitées, puis supprimés. Pour un système à haut risque, l’article 26 impose au déployeur de garder au moins six mois les journaux qu’il contrôle, sauf disposition contraire, notamment du droit de la protection des données : la durée se fixe alors au cadrage. Mémoire de l’agent, droits d’accès et sous-traitants sont traités dans le guide agents IA et données personnelles.

Ce que la supervision a mesuré sur notre infrastructure

Notre infrastructure fait tourner en production un orchestrateur et douze agents spécialisés. Chaque action est inscrite dans un registre : qui, quoi, résultat, coût. Une surveillance quotidienne détecte les échecs (intégration continue, workflows n8n), envoie une alerte et propose un correctif, fusionné seulement si les tests passent. Cinq rapports récurrents remontent à une personne : erreurs informatiques, indexation Google, comportement des visiteurs, indicateurs, audit qualité.

16 sur 16
erreurs détectées par la surveillance quotidienne de notre infrastructure, puis résolues, du 17 juillet au 7 août 2026. Méthode : décompte du registre où la surveillance inscrit chaque erreur et sa résolution.

Dix incidents y sont documentés en post-mortem ; les collisions entre sessions d’agents ont produit les règles qui s’appliquent aujourd’hui. Ce que ces chiffres ne disent pas : aucun gain de temps global n’est mesuré, et le rapport d’audit qualité part encore sur Telegram au lieu de l’e-mail. L’architecture est décrite sur la page notre infrastructure d’agents IA, en production, et la coordination de plusieurs agents sur la page orchestrateur d’agents IA.

Reprendre la main quand l’agent se trompe

Un agent en production ne vaut que si vous pouvez le reprendre en main sans dépendre de personne. L’article 14 et la note CNIL et CIANum prévoient tous deux un bouton d’arrêt ; le reste tient en cinq gestes, dans cet ordre.

  1. Arrêter

    Interrompre l’agent par son bouton d’arrêt, prévu dès la conception.

  2. Comprendre

    Relire le registre : quelle demande, quels agents, quelles données, quel résultat.

  3. Corriger

    La règle, la consigne ou l’accès en cause, puis rejouer les cas de test.

  4. Remettre en service

    Seulement si les tests passent.

  5. Consigner

    Un post-mortem daté, qui devient une règle de l’agent.

Pour un système à haut risque, l’article 26 ajoute une obligation : suspendre l’usage et prévenir le fournisseur et l’autorité de surveillance du marché dès que le système présente un risque, et signaler sans délai tout incident grave.

Vos données, pendant la supervision

Les six décisions à prendre avant tout outil d’IA sont détaillées sur la page IA et protection des données. Pour un agent supervisé, voici ce qui est écrit au cadrage.

Vos données, sous supervision

Ce que l’agent voit
Les champs utiles à sa tâche, listés au cadrage.
Où partent les données
Vers le modèle retenu au cadrage : européen, hébergé en Europe, ou sur vos serveurs si les données sont sensibles.
Durée de conservation
Journaux conservés six mois, puis supprimés.
Agent à haut risque
L’AI Act impose d’en garder les journaux au moins six mois à partir du 2 décembre 2027 : la durée se fixe au cadrage.
Qui supervise
Vous, grâce à la documentation, ou Agentic Conseil si vous lui confiez la supervision : cela se décide au cadrage.
À qui appartient le système
À vous : code, accès et documentation.

Ce qui a changé

  1. Création de la page.

Sources

Questions fréquentes

L’AI Act oblige-t-il à superviser tous les agents IA ?
Non. Le contrôle humain des articles 14 et 26 ne vise que les systèmes à haut risque, à partir du 2 décembre 2027 pour ceux de l’annexe III (recrutement, évaluation de salariés, crédit). Pour un agent courant, l’AI Act demande la maîtrise de l’IA de vos équipes et, s’il échange avec des personnes, la transparence. Le RGPD s’applique dans tous les cas.
Qui doit valider les actions d’un agent IA ?
Une personne désignée, qui connaît le métier et a l’autorité de refuser. Pour un système à haut risque, l’article 26 exige qu’elle ait la compétence, la formation et l’autorité nécessaires, et le soutien pour les exercer. Une validation de pure forme ne compte pas : la CNIL et le CIANum la jugent insuffisante.
Faut-il tout faire valider par un humain ?
Non : seulement les actions critiques, comme un achat, une mise en ligne, un envoi hors de vos outils ou une suppression. Tout faire valider expose au biais d’automatisation, cette tendance à se fier par défaut à la sortie d’un système, que l’article 14 demande de garder en tête. Le reste passe par des contrôles automatiques, un registre et une relecture par échantillon.
Combien de temps garder les journaux d’un agent ?
Il n’y a pas de durée unique. Pour un système à haut risque, l’AI Act impose au moins six mois à partir du 2 décembre 2027. Pour les journaux de traçabilité (qui a fait quoi, quand), la CNIL recommande de six mois à un an, sans y recopier les données traitées. Sur nos missions, les journaux de l’agent suivent cette recommandation : six mois, sans copie des données traitées, puis suppression.
Peut-on confier la supervision d’un agent à un autre agent ?
En partie. Un second modèle peut contrôler le premier : sur notre chaîne de contenus, un agent évaluateur note chaque texte sur 100 et bloque ceux qui n’atteignent pas 70. Mais la décision qui engage l’entreprise reste humaine, et pour un système à haut risque l’AI Act confie le contrôle à des personnes physiques.
Que faire quand un agent se trompe en production ?
L’arrêter, relire le registre pour comprendre, corriger la règle ou l’accès en cause, rejouer les tests, puis le remettre en service. Pour un système à haut risque, l’article 26 impose aussi de suspendre l’usage et de prévenir le fournisseur et l’autorité de surveillance du marché dès qu’il présente un risque.
Faut-il prévenir les salariés qu’un agent IA travaille avec eux ?
Pour un système à haut risque utilisé au travail, oui : l’article 26 impose à l’employeur d’informer les représentants du personnel et les salariés concernés avant la mise en service. Dans tous les cas, le RGPD impose d’informer les personnes dont l’agent traite les données personnelles.
Qui supervise l’agent après sa mise en production ?
Vous pouvez le reprendre seul grâce à la documentation, ou en confier la supervision : cela se décide au cadrage. Dans les deux cas, le code, les accès et la documentation vous appartiennent.
Comment mesurer l’adoption de l’IA après la mission ?
Avec trois indicateurs suivis chaque mois : le taux d’utilisation par les équipes concernées, le temps gagné sur la tâche ciblée, comparé à la mesure faite avant le projet, et la satisfaction des utilisateurs. Un suivi mensuel pendant les six premiers mois repère tôt un usage qui s’essouffle, et la règle ou la formation en cause se corrige.
AppelerLudovic Bobée
Prendre rendez-vous