LE PLAYBOOK · EXÉCUTION
Pour product managers et product owners
✓ 47 pages · gratuit

Déployer un agent IA en banquedu mandat au go / no-go en 90 jours

Ce playbook accompagne le travail de l’équipe une fois le cas d’usage choisi. Il propose un parcours de treize semaines, avec six points de décision et un livrable vérifiable chaque semaine. La vérification du dossier d’un nouveau client sert de cas fil rouge. Six modèles à remplir montrent comment préparer les documents attendus. La sélection du problème à traiter intervient en amont, dans le travail de discovery.

13SEMAINESDe la première heure au compte rendu de décision
6POINTS DE DÉCISIONDe G0 à G5, chacun fondé sur des éléments datés et signés
1LIVRABLE / SEMAINEAvec un responsable clairement identifié
6MODÈLES À REMPLIRDe la charte de pilote au compte rendu de décision
Lecture : 40 minutes en entier, ou 7 minutes en suivant les titres, les figures et les encadrés · Version 1.0 · Août 2026 · Licence Creative Commons BY-ND 4.0 : réutilisation libre du document, tel quel, en citant l’auteur · Mounir Fassouane, Acadewie
COMMENCEZ ICI

Vous êtes directeur produit, product manager ou product owner ? Voici votre parcours

Choisissez votre rôle pour accéder aux sections utiles à votre étape du projet. Pour chacun, vous trouverez le travail attendu, les lectures prioritaires et le premier modèle à remplir parmi les vingt-neuf sections du playbook.

DIRECTEUR PRODUIT · CPO

Vous devez décider

Votre travail : donner le mandat, garantir la capacité de contrôle et prendre les décisions G0 à G5.

Votre question de contrôle : « Si le pilote réussit, disposons-nous des moyens de l’exploiter, de le contrôler et d’en tirer de la valeur à l’échelle du portefeuille ? »

PRODUCT MANAGER · PM

Vous devez démontrer

Votre travail : fixer la situation de départ, mesurer le résultat et construire la preuve économique.

Votre question de contrôle : « Quels résultats justifieraient d’arrêter, de corriger ou d’étendre le pilote ? »

PRODUCT OWNER · PO

Vous devez rendre l’agent testable

Votre travail : traduire l’autonomie en actions, permissions, critères d’acceptation, traces et procédures de reprise.

Votre question de contrôle : « Quelles traces permettront de vérifier que l’action respecte les critères du récit, que les erreurs sont prises en charge et que la reprise prévue fonctionne ? »

Les six modèles à remplir sont regroupés sur une page dédiée : pour chacun, un exemple renseigné sur le cas fil rouge, une version vierge à télécharger et les critères permettant de vérifier que le document est complet.

LA CARTE DU PARCOURS01 / 29

De la première heure à la décision finale : les treize semaines en une image

La carte présente les treize semaines de travail et les six points de décision. Elle situe les livrables, le passage aux dossiers réels et les autorisations nécessaires. Chaque point renvoie à la section correspondante, pour suivre le parcours dans l’ordre ou consulter directement l’étape en cours.

AVANT CE PLAYBOOK · LA DÉCOUVERTE

Avant d’utiliser ce guide, le travail de discovery doit avoir permis d’identifier un problème observé sur le terrain, un parcours mesurable et une solution possible sans agent. Le choix du bon cas dans le portefeuille relève de l’étude stratégique ; ce playbook prend le relais, du mandat au go / no-go.

FIGURE 1 · CALENDRIER ET POINTS DE DÉCISION
Treize semaines, six points de décision, et un seul qui expose l’agent à des dossiers réels
CONSTRUCTIONEXPOSITION À DES DOSSIERS RÉELSS0S1S2S3S4S5S6S7S8S9S10S11S12S13G0 · MandatFin S2Ouvre le diagnosticG1 · RisqueFin S4Ouvre la conceptionG2 · ConceptionFin S6Ouvre la constructioncomplèteG3 · PreuveFin S9Ouvre le mode à blanc,sans effet des actionsG4 · PiloteFin S11Ouvre une cohortelimitéeG5 · DécisionFin S13Arrêter, corrigerou étendreLe point G3 est le plus structurant des six : il sépare la construction de l’exposition à des dossiers réels.
Lecture. Un point de décision autorise l’étape suivante ; il ne valide pas le travail accompli. Il repose sur des éléments datés et signés, ce qui rend la décision reproductible six mois plus tard devant un contrôleur qui n’a pas assisté aux réunions. Le point G3 autorise le passage en mode à blanc : l’agent traite alors des dossiers réels sous observation, sans qu’aucune de ses actions ne produise d’effet. Source. Playbook Acadewie, phases 1 à 6 ; statut : cadre proposé par l’auteur, calendrier indicatif à déplacer sans déplacer la séquence des preuves.

Chaque affirmation de cette page est marquée AUT, REC, MÉT ou HYP selon ce qu’elle engage. La convention de preuve est en annexe, à lire une fois, à tout moment.

DÉMARRAGE · LES 48 PREMIÈRES HEURES02 / 29

Six actes dans les quarante-huit premières heures, avant toute conversation sur un modèle

Le scénario est courant : un cas est identifié, un sponsor s’y intéresse, le sujet entre au portefeuille et la preuve de concept démarre sans responsable clairement désigné. Sans mandat écrit, sans situation de départ mesurée et sans règle d’arrêt, le pilote se prolonge et la décision d’étendre finit par reposer sur l’impression laissée par une démonstration. Les six actes ci-dessous évitent ce scénario.

FIGURE 2 · LES QUARANTE-HUIT PREMIÈRES HEURES
Quatre de ces six actes suffisent à distinguer un pilote d’une simple preuve de concept
H0 → H + 48Avant toute conversation sur un modèle, un budget ou un fournisseurACTE 1Nommer le sponsor métieret le responsable d’agentSortie : deux noms écrits. Le responsabled’agent est le rôle le plus souvent absent.ACTE 2Écrire en une phrasele résultat viséSortie : un résultat client ou opérationnel,et la situation de départ pour comparer.ACTE 3Choisir un parcours bornéet une population réversibleSortie : ce que l’on pourra arrêter, corrigerou reprendre manuellement.ACTE 4Déclarer les actions interditeset l’autonomie maximaleSortie : des droits absents dansl’architecture, plutôt que des consignes.ACTE 5Réserver contrôle, données,sécurité et architectureSortie : des capacités réservées plusieurssemaines à l’avance.ACTE 6Fixer les six points de décisionet leur décideurSortie : six dates. Un point de décisionsans date se reporte indéfiniment.Les quatre actes encadrés produisent le résultat, le responsable, l’action maximale et la règle d’arrêt.Sans eux, le pilote produit une démonstration convaincante et aucune décision.
Lecture. Les six actes tiennent en deux jours et ne demandent ni budget, ni fournisseur, ni architecture. Le responsable d’agent est le rôle le plus souvent absent, et son absence apparaît au premier incident, lorsque la responsabilité n’est attribuée nulle part par écrit. Source. Playbook Acadewie, démarrage ; statut : cadre proposé par l’auteur.

Votre première semaine, jour par jour

Les six actes se traduisent en une semaine de travail concrète. Le découpage ci-dessous est une cadence proposée MÉT : les jours peuvent bouger, l’ordre des sorties ne bouge pas.

LUNDI
Choisissez un processus et nommez les responsables
Un parcours borné, un sponsor métier, un responsable d’agent : deux noms écrits (actes 1 et 3).
MARDI
Écrivez le résultat attendu et le hors-périmètre
Une phrase de résultat mesurable, et la liste des actions que l’agent ne tentera jamais (actes 2 et 4).
MERCREDI
Mesurez la situation actuelle
La situation de départ du parcours, du premier événement au résultat : sans elle, aucun gain ne sera démontrable.
JEUDI
Listez les actions permises et les actions interdites
Chaque action avec son palier d’autonomie pressenti ; les interdits destinés à devenir des droits absents (actes 4 et 5).
VENDREDI
Faites circuler la charte de pilote pour signature
Les points G0 à G5 datés avec leur décideur (acte 6). Livrable du vendredi soir : une charte G0 prête à être examinée, sur le modèle de charte de pilote.
DÉMARRAGE · CAS FIL ROUGE03 / 29

Un cas fil rouge, renseigné de bout en bout, pour montrer le niveau de précision attendu

Tous les modèles de ce guide sont renseignés sur un cas unique : la vérification de complétude d’un dossier d’entrée en relation et la préparation d’une relance. Ce cas donne le niveau de détail attendu. Une équipe qui remplit ses propres modèles avec cette précision dispose d’un dossier suffisamment précis pour être examiné par la deuxième ligne de contrôle ; une équipe qui reste plus vague le saura immédiatement, en comparant ligne à ligne.

✕ TROP VAGUE POUR ÊTRE PILOTÉ

« L’agent aide à vérifier les dossiers d’entrée en relation. »

Rien n’est mesurable, rien n’est interdit : ce périmètre autorise tout et ne protège de rien.

✓ ASSEZ PRÉCIS POUR DÉCIDER

« L’agent identifie les pièces manquantes, cite la règle applicable et prépare un brouillon de relance. Il ne peut ni envoyer le message, ni modifier le statut du dossier, ni prendre une décision d’acceptation. »

Chaque verbe a un palier d’autonomie, chaque interdit se traduit en droit absent.

RepèreContenu
DéclencheurUn dossier d’entrée en relation créé ou mis à jour doit être vérifié pour complétude
L’agent proposeIl lit les règles autorisées et les pièces du dossier, identifie les éléments manquants, cite ses sources et prépare un brouillon de relance
L’humain décideLe chargé de dossier vérifie les pièces, modifie si nécessaire, décide d’envoyer ou non, et motive sa correction
Hors périmètreDécision d’acceptation ou de refus, notation, envoi autonome, modification d’un statut réglementaire, collecte hors canal approuvé
Autonomie initialePalier A1 pour l’analyse, palier A2 pour la création d’un brouillon non envoyé, sur l’échelle d’autonomie A0 à A5 présentée en phase 2 MÉT, à valider localement
Classement de risqueNiveau R2, intermédiaire sur une échelle de quatre, proposé à titre méthodologique MÉT ; la classification réelle demeure cumulative et locale
STATUT DU CAS

Ce cas est un exemple de travail. Son palier d’autonomie, son classement de risque et ses volumes sont des repères méthodologiques à recalibrer selon votre contexte, vos canaux et vos entités.

DÉMARRAGE · RÔLES04 / 29

Les responsabilités et les points d’alerte des six rôles du pilote

La dernière colonne précise les situations que chaque rôle doit signaler et les motifs qui justifient d’interrompre une dérive.

RôleCe dont il rend compteSa ligne rouge
Directeur produitMandat de portefeuille, capacité de contrôle, financement de la plateforme et arbitrageUn pilote sans responsable ni voie de retrait
Product managerRésultat, situation de départ, dossier économique, segmentation, apprentissage et décisionUn indicateur uniquement technique
Product ownerBacklog, critères d’acceptation, traçabilité, tests et procédure d’exploitationUne exigence sans preuve observable
Sponsor métierAccès au terrain, processus cible, capacité de changement et réalisation de la valeurUn pilote détaché des opérations
Responsable d’agentPérimètre, autonomie, risque résiduel, incidents, changements et retraitUne responsabilité diffuse
Partenaires de contrôleQualification, exigences, validation indépendante et conditions d’exploitationUne sollicitation en fin de construction

Six rôles, six lignes rouges, et une seule personne responsable par agent. Cette règle évite surtout les arbitrages collectifs lorsqu’une décision rapide et traçable est nécessaire.

CE QU’IL FAUT EN RETENIR

Dans les quarante-huit premières heures, l’équipe précise qui répond du résultat, du risque et de l’arrêt du pilote.

COCKPIT · POINTS DE DÉCISION05 / 29

Six points de décision : une date, des éléments de preuve et une autorisation claire pour chacun

À chaque point de décision, les personnes habilitées examinent des pièces datées et signées avant d’autoriser l’étape suivante. Elles apprécient les résultats démontrés et les conditions du passage, en tenant compte du risque que les coûts déjà engagés influencent leur jugement.

PointDateObjetPièces minimalesCe qu’il autorise
G0Fin S2MandatProblème, situation de départ, responsable, périmètre, actions interditesLe diagnostic
G1Fin S4RisqueQualification, carte des données, autonomie, analyses requisesLa conception
G2Fin S6ConceptionCanevas d’agent, architecture, contrôles, backlog, supervision humaineLa construction complète
G3Fin S9PreuveEnsemble de référence versionné, évaluations, tests adverses, validation, non-conformitésLe mode à blanc
G4Fin S11PiloteJournal du mode à blanc, surveillance, procédure d’exploitation, formation, repliUne cohorte limitée
G5Fin S13DécisionValeur, risque, coût, adoption, incidents, dette de contrôle (les contrôles annoncés mais non encore construits)Arrêter, corriger ou étendre
COCKPIT · CALENDRIER06 / 29

De S0 à S13, un livrable et un responsable chaque semaine

FIGURE 3 · LA CHAÎNE DES LIVRABLES SIGNÉS
Les dates peuvent bouger ; l’ordre des livrables, lui, ne change pas
RESPONSABLETRAVAIL DE LA SEMAINEDOCUMENT PRODUIT ET SIGNÉS0Directeur produit et sponsorNommer les responsables, l’équipe et les datesMandat de lancementS1Product managerObserver le parcours, mesurer la situation de départCarte de parcours et situation de départS2Product manager et product ownerCharte, résultat, hors-périmètreCharte de pilote signéeG0S3Propriétaire d’agent et risqueQualifier les risques, les données et l’autonomieTriage et carte des donnéesS4Partenaires de contrôleFixer les analyses requises et les interditsDossier G1G1S5Product owner et architectureCanevas d’agent, outils, permissions, expérienceConception contrôléeS6Product ownerBacklog testable et critères d’acceptationBacklog prêtG2S7Product owner et resp. d’évaluationConstruire les jeux de tests et les évaluateursJeux de référence et adversesS8ÉquipeTester, corriger, mesurer par segmentRapport d’évaluationS9ValidationRevue indépendanteDécision d’entrée en mode à blancG3S10Opérations et métierMode à blanc sur cas réels, sans action autonomeJournal du mode à blancS11Responsable d’agentTester supervision, incident, arrêt, retour arrièreProcédure d’exploitation validéeG4S12Product managerPilote sur cohorte limitée et dossier économiqueDossier de preuvesS13Directeur produit et sponsorDécider d’arrêter, de corriger ou d’étendreCompte rendu de décisionG5Six des quatorze semaines se referment sur un point de décision.Une équipe qui termine une semaine sans son livrable sait exactement où elle a pris du retard.
Lecture. La cadence suppose que les équipes métier, produit et contrôle soient disponibles aux semaines prévues. Si ces équipes ne sont pas disponibles, ajustez les dates en conservant les preuves exigées avant chaque passage. Source. Playbook Acadewie, phases 1 à 6 ; cadence proposée par l’auteur MÉT.
COCKPIT · RITUELS07 / 29

Cinq rituels suffisent, chacun pour trancher une question différente

Les cinq rituels proposés ont chacun un objet : livraison, risque, évaluation, valeur ou décision. Avant d’ajouter une réunion, vérifiez la question qu’elle permettra de traiter et son articulation avec les réunions existantes.

RituelCadenceResponsableQuestion centrale
Revue de livraisonDeux fois par semaineProduct ownerBlocages, récits, preuves et dette de contrôle
Revue de risqueHebdomadaire, S2 à S11Responsable d’agentDécisions ouvertes, analyses et risques résiduels
Revue d’évaluationHebdomadaire, S6 à S12Product manager et responsable d’évaluationErreurs, segments (sous-populations comparables : entité, canal, langue, type de client, complexité), matrice de confusion et reprise
Revue de sponsorToutes les deux semainesProduct managerRésultat, adoption, capacité et réalisation de la valeur
Comité de décisionAux points G0 à G5Directeur produit et sponsorDécision horodatée, conditions, responsable et échéance

Le comité de décision se distingue des quatre autres par sa nature. Il est le seul qui se conclut par une décision datée, et le seul qui puisse arrêter le programme.

CE QU’IL FAUT EN RETENIR

Chaque point de décision doit s’appuyer sur des pièces datées et vérifiables.

PHASE 1 · SEMAINES 1 ET 2 · CADRER LE MANDAT08 / 29

La charte de pilote, renseignée sur le cas fil rouge

CONTRAT DE PHASE

Responsable principal : le product manager. Point de décision visé : G0. Le point G0 peut être franchi lorsque le sponsor et le responsable d’agent savent expliquer ce qui change, pour qui, sur quelle preuve, et avec quel retour manuel.

RESPONSABLE
Product manager, sponsor métier co-signataire
SEMAINES
S1 à S2
À RÉUNIR
Sponsor, responsable d’agent, métier, données
MODÈLE À REMPLIR
À LA FIN DE CETTE PHASE, VOUS AUREZ
  • Une charte de pilote signée, au niveau de précision du cas fil rouge
  • Une situation de départ mesurée sur le parcours entier, avant tout prototype
NE PASSEZ PAS G0 SI
  • Le résultat attendu n’est pas mesurable dans la situation de départ
  • Le sponsor métier ou le responsable d’agent n’est pas nommé
  • Le hors-périmètre et les actions interdites ne sont pas écrits

Les deux premières semaines sont consacrées à la préparation et à la signature de la charte. Trois champs préparent la décision de la semaine treize : la situation de départ sert de référence pour la comparaison, le hors-périmètre précise les actions exclues et la règle d’arrêt fixe les conditions d’interruption.

RepèreContenu renseigné
Résultat viséRéduire le délai de complétude et la reprise des dossiers, sans augmenter les erreurs significatives, les relances inutiles ni l’abandon
PopulationCohorte bornée de dossiers standards, canal et entité à préciser
DéclencheurCréation ou mise à jour d’un dossier nécessitant une vérification de complétude
UtilisateursChargé de dossier, superviseur opérationnel, client indirectement concerné
PropositionAnalyse sourcée des pièces manquantes et brouillon de relance soumis à revue
Hors périmètreDécision d’acceptation, notation, refus, envoi autonome, écriture de statut, changement de politique
Situation de départDélai de traversée, complétude au premier passage, taux de reprise, relances par dossier, abandon, coût complet, à mesurer
SuccèsAmélioration nette du parcours et du coût complet, sous les seuils durs de risque, seuils à valider
ArrêtAction interdite, fuite de donnée sensible, impossibilité de revenir au manuel, ou risque résiduel refusé

Six critères conditionnent le franchissement de G0, chacun avec son responsable et son élément de preuve : le résultat et la population écrits, la situation de départ mesurable avec un responsable de la donnée nommé, le hors-périmètre et les actions interdites approuvés, l’alternative sans intelligence artificielle examinée, le retour manuel et la capacité terrain confirmés, et les points G1 à G5 planifiés avec leurs décideurs. Le quatrième critère consiste à examiner une solution sans intelligence artificielle avant d’engager le pilote. Le temps nécessaire dépend du processus et des informations disponibles.

PHASE 1 · MESURE DU PARCOURS09 / 29

Six étapes du parcours, six mesures de situation de départ à prendre avant l’agent

La mesure de la situation de départ précède la conception et sert de référence au dossier économique. Le calendrier lui consacre une semaine. Elle porte sur le parcours entier, du premier événement au résultat, afin de suivre l’effet du projet pour le client et pour l’établissement.

ÉtapeQuestion poséeMesure de situation de départ
1 · ÉvénementUn dossier est créé ou une pièce est reçueVolume, composition, heure, canal
2 · QualificationQuelles règles et quelles pièces s’appliquentTemps, exceptions, recherches
3 · ComplétudeLes pièces sont-elles présentes, valides et cohérentesComplétude au premier passage, erreurs, reprise
4 · RelanceLe message est-il adapté et les pièces bien demandéesNombre, clarté, relances inutiles
5 · RéponseLes pièces sont reçues et le dossier est remis en fileDélai, abandon, escalade
6 · RésultatLe dossier est complet ou part en voie d’exceptionDélai total, coût, qualité

Commencez par cartographier le parcours avant de déterminer ce qui mérite d’être automatisé. Avant d’automatiser, classez chaque étape selon cinq actions possibles : éliminer, déplacer, standardiser, assister ou automatiser. Une étape accélérée qui ne crée pas de valeur demeure une étape sans valeur, exécutée plus vite. Cette mesure et ce classement sont la part de découverte que le playbook conserve : on découvre le processus réel avant de construire quoi que ce soit.

CE QU’IL FAUT EN RETENIR

Sans situation de départ mesurée avant le premier prototype, aucun gain ne pourra être démontré proprement à la fin.

PHASE 2 · SEMAINES 2 À 4 · QUALIFIER LE RISQUE10 / 29

Sept axes de qualification, sept questions obligatoires, sept responsables

CONTRAT DE PHASE

Responsable principal : le responsable d’agent. Point de décision visé : G1. La qualification dépend du cas d’usage, de la population, des effets produits et des données traitées ; le simple fait qu’il s’agisse d’un « agent » ne détermine pas la qualification.

RESPONSABLE
Responsable d’agent, avec les partenaires de contrôle
SEMAINES
S2 à S4
À RÉUNIR
Juridique, DPO, sécurité, opérations, risque, métier
LIVRABLES D’APPUI
À LA FIN DE CETTE PHASE, VOUS AUREZ
  • Un premier examen juridique et réglementaire documenté sur les sept axes
  • Une matrice d’actions avec le palier A0 à A5 et la preuve de contrôle de chaque action
  • Une carte des données précisant, pour chaque objet, les droits d’accès, la finalité et la durée de conservation
NE PASSEZ PAS G1 SI
  • L’autonomie est fixée pour l’agent entier au lieu de l’être action par action
  • Une action interdite reste techniquement possible malgré l’interdiction écrite dans la consigne
  • Un objet de données n’a ni finalité ni durée de conservation renseignée
AxeQuestion obligatoireResponsable
Décision et effetL’agent influence-t-il l’accès à un service, une décision, un droit ou une obligation ?Juridique et conformité
DonnéesTraite-t-il des données personnelles, sensibles, inférées ou hors finalité ?Délégué à la protection des données
ActionPeut-il envoyer, écrire, payer, bloquer, modifier ou déclencher un enchaînement ?Propriétaire d’agent et sécurité
TiersQuels modèles, hébergeurs, interfaces et sous-traitants soutiennent le service ?Achats, résilience et sécurité
ClientL’intervention de l’agent, le recours et la revue humaine sont-ils compréhensibles ?Conformité et expérience
RésilienceQuel est l’impact d’une erreur, d’une indisponibilité, d’une dérive ou d’une compromission ?Opérations et continuité
ÉquitéQuelles populations ou quels segments peuvent subir des erreurs asymétriques ?Risque et métier
FIGURE 4 · SEPT AXES, SEPT FONCTIONS
Aucune fonction ne peut qualifier seule : les sept réponses conditionnent le point de décision G1
DÉCISION ET EFFETL’agent influence-t-il l’accès à un service,une décision, un droit ou une obligation ?JURIDIQUE ET CONFORMITÉDONNÉESTraite-t-il des données personnelles,sensibles, inférées ou hors finalité ?DÉLÉGUÉ À LA PROTECTION DES DONNÉESACTIONPeut-il envoyer, écrire, payer, bloquer,modifier ou déclencher un enchaînement ?PROPRIÉTAIRE D’AGENT ET SÉCURITÉTIERSQuels modèles, hébergeurs, interfaceset sous-traitants soutiennent le service ?ACHATS, RÉSILIENCE ET SÉCURITÉCLIENTL’intervention de l’agent, le recours etla revue humaine sont-ils compréhensibles ?CONFORMITÉ ET EXPÉRIENCERÉSILIENCEQuel est l’impact d’une erreur, d’uneindisponibilité, d’une dérive, d’une compromission ?OPÉRATIONS ET CONTINUITÉÉQUITÉQuelles populations ou quels segmentspeuvent subir des erreurs asymétriques ?RISQUE ET MÉTIERQUALIFICATIONLe cas d’usage, la population,les effets produits, les données traitéesPOINT DE DÉCISION VISÉ · G1Le simple fait qu’il s’agisse d’un agent ne détermine pas la qualification : l’effet produit et les données traitées la déterminent.
Lecture. Les sept questions se posent avant la conception. Y répondre plus tard revient à réexaminer la qualification d’un dispositif déjà construit, avec le biais que cette situation installe dans la discussion. Source. Règlements (UE) 2024/1689, 2016/679 et 2022/2554 AUT ; répartition par fonction proposée par l’auteur.

Les obligations se confirment ensuite avec les fonctions compétentes et sur des sources à jour, à la date de la décision. Base : règlements (UE) 2024/1689, 2016/679 et 2022/2554 AUT ; questions proposées par l’auteur à partir de textes contraignants.

Le point G1 exige six critères correspondants : triage juridique et réglementaire documenté, autonomie maximale par action validée, carte des données avec finalités et rétention provisoire, lignes rouges traduites en droits absents, risque tiers et continuité préqualifiés, risque initial assorti d’un responsable de remédiation.

PHASE 2 · AUTONOMIE PAR ACTION11 / 29

Six paliers d’autonomie, définis par le verbe de l’action et son contrôle minimal

L’échelle distingue l’observation, la proposition, la préparation et plusieurs formes d’exécution. Les paliers sont définis par les actions autorisées et les effets qu’elles peuvent produire.

À mesure que l’autonomie augmente, la valeur potentielle peut croître, mais le risque et les exigences de contrôle augmentent eux aussi. C’est pourquoi ces marches portent un nom : A0 à A5.

Attribuez un palier à chaque action. Un même agent peut, par exemple, consulter des informations, soumettre une recommandation à la revue humaine et préparer un brouillon avec des droits limités. Cette décomposition permet d’adapter le contrôle à l’effet de chaque action.

FIGURE 5 · PALIERS D’AUTONOMIE
L’autonomie se fixe action par action, et les deux derniers paliers restent hors du pilote
Autonomie croissante, de gauche à droiteHORS PILOTE PAR DÉFAUTCONTRÔLE MINIMALA0ObserveSynthèse sansrecommandationLecture seule,tracesA1ProposeAnalyse ourecommandationSources, incertitudeaffichée, revueA2PrépareBrouillon outransaction nonexécutéeDroits limités,validation avanteffetA3Exécute bornéAction réversiblesous limitesPasserelle depolitique, quotas,surveillance,retour arrièreA4ExécutesensibleEffet significatifou difficilementréversibleGouvernancerenforcée, horspilote par défautA5OrchestreDécompose, choisitoutils et agents,agit avec latitudeFilière d’exception,preuve formelle
Lecture. Attribuez un palier à chaque action. Un même agent peut, par exemple, consulter des informations, soumettre une recommandation à la revue humaine et préparer un brouillon avec des droits limités. Cette décomposition permet d’adapter le contrôle à l’effet de chaque action. Les deux derniers paliers se distinguent par la nature du risque : A4 concerne une action à effet significatif ou difficilement réversible ; A5, la latitude laissée à l’agent dans le choix de ses actions. Le contrôle minimal se traduit dans les droits d’accès et d’action, où il peut être vérifié. Source. Playbook Acadewie, phase 2, matrice d’actions ; statut : cadre proposé par l’auteur.
PalierVerbeEffet produitContrôle minimal
A0ObserveSynthèse sans recommandationLecture seule, traces
A1ProposeAnalyse ou recommandationSources, incertitude affichée, revue
A2PrépareCrée un brouillon ou une transaction non exécutéeDroits limités, validation avant effet
A3Exécute bornéAction réversible sous limitesPasserelle de politique, le composant technique par lequel transite toute action de l’agent et qui autorise ou refuse chacune d’elles, quotas, surveillance, retour arrière
A4Exécute sensibleEffet significatif ou difficilement réversibleGouvernance renforcée, hors pilote par défaut
A5OrchestreDécompose l’objectif, choisit outils et agents, agit avec latitudeFilière d’exception, contrôle renforcé et preuve formelle

Le contrôle minimal doit être traduit dans les droits d’accès et d’action, où il devient vérifiable. Les paliers A4 et A5 se situent hors du pilote par défaut, et leur admission relève d’une filière d’exception qui se décide en amont, avant que l’architecture ne soit figée. A4 concerne une action à effet significatif ou difficilement réversible. A5 concerne la latitude laissée à l’agent dans le choix de sa suite d’actions. Cette échelle est celle de l’étude, à l’identique.

PHASE 2 · MATRICE D’ACTIONS12 / 29

Sept actions du cas fil rouge, leur palier, leur admission au pilote et leur preuve de contrôle

La matrice associe chaque action à son palier d’autonomie et à une preuve technique de son application. La deuxième ligne de contrôle peut ainsi vérifier les droits réels du système. Les actions interdites doivent être bloquées dans la configuration et faire l’objet de tests.

ActionPalierAu pilotePreuve de contrôle
Lire les règles approuvéesA0OuiListe blanche de récupération et version
Lire les pièces du dossierA0Oui, sur besoin d’en connaîtrePortées limitées au dossier et journal
Identifier une pièce manquanteA1OuiRègle citée, indice de confiance, revue
Préparer un brouillonA2OuiOutil limité au brouillon et validation
Envoyer au clientA3Hors piloteDroit absent et blocage par la passerelle
Décider l’acceptation ou le refusA4InterditAucun outil, ligne rouge écrite
Modifier un statut réglementaireA4InterditAucun droit d’écriture

Pour les trois dernières actions, les droits correspondants sont désactivés dans la passerelle. Un contrôleur doit pouvoir le vérifier dans la configuration.

PHASE 2 · DONNÉES ET MÉMOIRE13 / 29

Cinq objets de données : droits d’accès, contrôles et durées de conservation

La dernière ligne du tableau mérite l’attention. La mémoire transversale au client est désactivée au pilote, par décision de conception. Toute mémoire conservée doit répondre à un besoin justifié. Son cloisonnement et sa purge doivent pouvoir être vérifiés.

ObjetSensibilitéDroitContrôleRétention
Politiques d’entrée en relationInterne contrôléLectureIndex versionné, responsable conformitéSelon politique
Pièces du clientPersonnel, potentiellement sensibleLecture du dossierAccès sur besoin d’en connaîtreSelon finalité
BrouillonPersonnelÉcriture du brouillonAucun droit d’envoi, purge après traitementÀ valider
TraceIdentifiants, sources, décisionsÉcriture du journalAccès restreint, intégritéÀ valider
Mémoire transversale au dossierSans nécessité établieAucunDésactivée au piloteSans objet

Base : CNIL et Conseil de l’IA et du numérique, IA agentique et protection des données personnelles, juillet 2026 AUT. Carte renseignée sur le cas fil rouge.

CE QU’IL FAUT EN RETENIR

La qualification précise les actions que l’agent peut réaliser et les conditions à respecter.

PHASE 3 · SEMAINES 4 À 6 · CONCEVOIR14 / 29

Une boucle d’exécution contrôlée en six étapes

CONTRAT DE PHASE

Responsable principal : le product owner. Point de décision visé : G2. Pour préparer G2, chaque récit (user story) doit préciser le résultat observable, la trace attendue, le cas d’erreur, le contrôle, la solution de repli et le responsable.

RESPONSABLE
Product owner, architecture et sécurité consultées
SEMAINES
S4 à S6
À RÉUNIR
PM, architecture, sécurité, métier, relecteurs
MODÈLES À REMPLIR
À LA FIN DE CETTE PHASE, VOUS AUREZ
  • Un canevas d’agent complet et signé, douze champs renseignés
  • Un backlog testable : chaque récit précise sa preuve, les cas d’échec à tester et la solution de repli
  • Des permissions traduites en droits techniques, lignes rouges comprises
NE PASSEZ PAS G2 SI
  • Un récit du backlog n’a pas de preuve observable ni d’échec attendu écrit
  • L’écran de revue n’a pas été éprouvé avec de vrais utilisateurs
  • Le repli manuel n’est pas conçu, ou une interdiction n’existe que dans la consigne

Dans le cas fil rouge, la passerelle de politique et la revue humaine contrôlent les actions avant leur exécution. Les traces alimentent les évaluations ; leurs résultats permettent à l’équipe de corriger l’agent et de repérer les régressions entre deux points de décision.

FIGURE 6 · BOUCLE D’EXÉCUTION CONTRÔLÉE
Deux contrôles avant l’exécution ; des traces pour évaluer chaque passage
ÉTAPE 1 · DOSSIERÉvénement et piècesÉTAPE 2 · AGENTAnalyse et propositionÉTAPE 3 · PASSERELLEDroits et politiquesÉTAPE 4 · HUMAINRevue et décisionÉTAPE 5 · TRACESources, action, résultatÉTAPE 6 · ÉVALUATIONSQualité, risque, coûtcorrige l’agent, les règles et l’écran de revueBOUCLE FERMÉEAucune proposition ne produit d’effetavant les étapes 3 et 4.
Lecture. La passerelle vérifie les droits et les règles ; le relecteur examine la proposition. Les traces de chaque passage servent ensuite à l’évaluation. L’équipe peut s’appuyer sur ces résultats pour corriger l’agent, les règles, les données ou l’écran de revue. Source. Playbook Acadewie, phase 3, canevas d’agent ; statut : cadre proposé par l’auteur.
ÉTAPE 1 · DOSSIER

Événement et pièces

Un dossier est créé ou mis à jour. L’événement déclencheur et les pièces disponibles entrent dans la boucle.

ÉTAPE 2 · AGENT

Analyse et proposition

L’agent lit les règles autorisées, identifie les manques, cite ses sources et prépare une proposition sans effet.

ÉTAPE 3 · PASSERELLE

Droits et politiques

La passerelle vérifie les droits, applique les politiques et refuse toute action qui sort du périmètre autorisé.

ÉTAPE 4 · HUMAIN

Revue et décision

Le relecteur modifie, rejette, renvoie pour traitement spécialisé ou valide, et motive sa correction dans un champ structuré.

ÉTAPE 5 · TRACE

Sources, action, résultat

Chaque étape laisse une trace exploitable : identifiants de source, outils appelés, décisions prises et motifs.

ÉTAPE 6 · ÉVALUATIONS

Qualité, risque, coût

Les traces alimentent les évaluations, qui corrigent l’agent, les règles, les données ou l’écran de revue.

PHASE 3 · CANEVAS D’AGENT15 / 29

Douze champs de conception, renseignés sur le cas fil rouge

Le canevas d’agent formalise les décisions de conception avant la construction complète. Ses douze champs relient le résultat attendu et les utilisateurs au périmètre, à l’autonomie, aux outils, aux droits et au plan d’évaluation. Renseignez-les dans l’ordre proposé.

ChampDécision renseignée
1 · RésultatComplétude plus rapide, moins de reprise, qualité et abandon sous contrôle
2 · UtilisateursChargé de dossier, superviseur, client concerné, contrôle et support
3 · PérimètreCohorte standard bornée, analyse et brouillon, exclusions écrites
4 · AutonomieA0 en lecture, A1 en proposition, A2 en brouillon ; A3, A4 et A5 interdits au pilote
5 · RisqueNiveau R2 initial au titre de la méthode ; qualification cumulée et risque résiduel à valider
6 · DonnéesPolitiques versionnées, pièces du dossier, minimisation, lignage et rétention
7 · OutilsRécupération, lecteur de dossier, rédacteur de brouillon ; aucun envoi ni écriture de statut
8 · MémoireSession et dossier uniquement ; aucune mémoire transversale au client
9 · HumainSources, anomalies, différences, bouton modifier ou rejeter, motif de correction
10 · ÉvaluationJeux de référence et adverses, segments, erreurs significatives, faux blocages, non-régression
11 · ExploitationObjectifs de service, coût, journaux, alertes, arrêt, repli manuel, support
12 · Cycle de vieResponsable, versions, changement significatif, revalidation, retrait
PHASE 3 · PERMISSIONS ET BACKLOG16 / 29

Cinq outils avec leurs droits et leurs limites, six récits avec leur preuve

La matrice de permissions traduit le canevas en objets techniques. Pour chaque outil, la matrice précise les droits, les conditions d’appel, les limites quantitatives et le retour arrière prévu. Les deux dernières lignes sont aussi importantes que les autres : elles décrivent les capacités que l’agent ne possède pas, ce qu’un contrôleur vérifie dans la configuration de la passerelle.

OutilDroitContexteLimiteRetour arrière
Récupération de politiquesLectureVersion approuvée et entité200 requêtes par dossier HYPDésactiver la source
Lecteur de dossierLectureDossier assignéTaille et type de fichierRetour au traitement manuel
Rédacteur de brouillonCréation de brouillonCanal approuvé, sans envoi1 brouillon par événement HYPSupprimer le brouillon
Envoi au clientAucunInterdit0Sans objet
Écriture de statutAucunInterdit0Sans objet

Un récit est prêt à être développé lorsqu’il précise un résultat observable, un outil et un droit explicites, une erreur redoutée, un évaluateur, une trace et un repli. La colonne de preuve rend chaque récit testable et transforme le backlog en programme de vérification.

✕ CRITÈRE NON TESTABLE

« L’agent doit produire une réponse correcte. »

Le terme « correct » ne définit aucun résultat vérifiable. Il faut préciser la preuve attendue, l’évaluateur et la condition qui fera échouer le test.

✓ CRITÈRE TESTABLE

« Pour chaque pièce signalée comme manquante, l’interface affiche la règle applicable, sa version et la pièce concernée. Une absence de source fait échouer le test. »

L’évaluateur peut conclure à la réussite ou à l’échec à partir d’un critère écrit, sans demander à l’équipe de l’interpréter.

RécitCapacitéAcceptation produitPreuve
1Règles sourcéesLe chargé voit la règle, sa version et la pièce concernéeIdentifiant de source et version
2ComplétudeChaque manque proposé est classé, expliqué et révisableRésultat par champ
3BrouillonAucun brouillon ne part sans une action humaineDroit d’envoi absent
4SupervisionLe relecteur modifie, rejette ou escalade avec un motifMotif obligatoire
5SécuritéUne instruction contenue dans une pièce laisse la politique inchangéeTest d’injection
6FonctionnementLe responsable coupe le rédacteur et revient au manuelExercice d’arrêt et de retour arrière

Six critères conditionnent le franchissement de G2 : canevas d’agent complet et signé, architecture et modèle de menace revus, permissions et lignes rouges testables, écran de revue éprouvé avec des utilisateurs, backlog relié aux évaluateurs, repli manuel et plan d’exploitation conçus.

CE QU’IL FAUT EN RETENIR

Toute interdiction doit être matérialisée dans les permissions techniques de l’agent ; une consigne seule ne constitue pas un contrôle suffisant.

PHASE 4 · SEMAINES 6 À 9 · PROUVER17 / 29

Trois échelons de preuve, et le troisième conditionne la décision d’étendre

CONTRAT DE PHASE

Responsable principal : le product manager, avec le responsable d’évaluation. Point de décision visé : G3. Le point G3 peut être franchi lorsque les seuils durs sont respectés, que la performance est acceptable sur chaque segment critique, et que les limites sont connues et exploitables.

RESPONSABLE
Product manager, avec le responsable d’évaluation
SEMAINES
S6 à S9
À RÉUNIR
Évaluation, métier, validation indépendante
MODÈLE À REMPLIR
À LA FIN DE CETTE PHASE, VOUS AUREZ
  • Un ensemble de référence versionné et un jeu adverse versionnés, avec leur fiche de jeu de données
  • Un rapport d’évaluation signé, résultats par segment et incertitudes visibles
  • Une validation indépendante achevée et documentée
NE PASSEZ PAS G3 SI
  • Un seuil dur n’est pas respecté, quelle que soit la moyenne
  • Un segment critique échoue derrière un score moyen élevé
  • Les jeux ne sont pas versionnés, ou un juge automatique évalue seul

L’évaluation porte sur trois résultats distincts : la qualité de la tâche réalisée par l’agent, l’amélioration du parcours et la valeur créée pour l’établissement. Mesurez chacun séparément avant de conclure sur l’ensemble du dispositif.

FIGURE 7 · ÉCHELONS DE PREUVE
Trois résultats à démontrer : qualité de la tâche, amélioration du parcours et valeur économique
ÉCHELON 1 · TÂCHEÀ démontrer : l’agent faitce qu’on attend de luiPreuve : ensemble de référence versionné,exactitude par champ, erreurs significativesÉCHELON 2 · PARCOURSÀ démontrer : le parcourss’améliore réellementPreuve : délai de traversée, complétudeau premier passage, relances, abandonÉCHELON 3 · ÉCONOMIEÀ démontrer : le gain se traduiten valeur pour l’organisationPreuve : coût par parcours traité avec succès,capacité libérée, coût évitéLa décision d’étendre se prend iciUne réussite au premier échelon ne présage pas des deux autres : la progression se démontre échelon par échelon.
Lecture. Les cartouches présentent les résultats attendus à chaque échelon. Chacun doit faire l’objet d’une mesure distincte : tâche, parcours et valeur pour l’établissement. Quatre signaux doivent conduire à suspendre la phase : un score moyen élevé masquant un segment faible, une évaluation confiée à un seul juge automatique sans second évaluateur, des tests non versionnés, une réussite de tâche sans résultat de parcours. Source. Playbook Acadewie, phase 4 ; statut : cadre proposé par l’auteur.
ÉCHELON 1 · TÂCHE

À démontrer : l’agent fait ce qu’on attend de lui

L’agent identifie correctement les pièces manquantes et produit un brouillon conforme. Preuve : ensemble de référence versionné, exactitude par champ, erreurs significatives.

ÉCHELON 2 · PARCOURS

À démontrer : le parcours s’améliore réellement

Le dossier devient complet plus vite, avec moins de reprise et sans dégrader l’expérience. Preuve : délai de traversée, complétude au premier passage, relances, abandon, décisions de passer outre.

ÉCHELON 3 · ÉCONOMIE

À démontrer : le gain se traduit en valeur pour l’organisation

Le gain subsiste après supervision, fonctionnement, incidents et changement. Preuve : coût par parcours traité avec succès, capacité libérée, coût évité.

Quatre signaux doivent conduire à suspendre la phase : un score moyen élevé masquant un segment faible, une évaluation confiée à un seul juge automatique sans second évaluateur, des tests non versionnés, une réussite de tâche sans résultat de parcours.

✕ INDICATEUR INSUFFISAMMENT DOCUMENTÉ

« 92 % de réponses jugées bonnes par le modèle évaluateur. »

Ce chiffre repose sur un seul juge automatique. Il ne renseigne ni les résultats par segment ni l’effet sur le parcours ; ces éléments manquent pour préparer la décision.

✓ INDICATEUR QUI FRANCHIT UN ÉCHELON

« Sur l’ensemble de référence versionné, zéro action interdite ; l’exactitude par champ respecte les seuils retenus sur chaque segment critique, avec une contre-vérification par un second évaluateur ; le délai de traversée de la cohorte diminue par rapport à la situation de départ. »

L’exemple documente les quatre éléments attendus : seuil dur, résultats par segment, second évaluateur et résultat de parcours.

PHASE 4 · JEU DE RÉFÉRENCE ET FAMILLES D’ÉCHEC18 / 29

Cinq familles composent l’ensemble de référence versionné, huit familles d’échec guident les corrections

L’ensemble de référence versionné permet de dire, avant toute exposition, si l’agent se comporte comme prévu. Il se construit famille par famille, et sa composition compte davantage que son volume : cinq dossiers adverses bien choisis peuvent révéler davantage de faiblesses que cent dossiers standards.

HYPOTHÈSE D’AMORÇAGE · HYP

Le jeu initial proposé comprend cinquante dossiers : trente standards, dix incomplets, cinq cas limites et cinq cas adverses. Il sert à commencer les tests. La taille nécessaire doit ensuite être déterminée selon les erreurs rares, les segments et le niveau de risque ; ce volume initial ne suffit pas à établir la validité statistique des résultats.

FamilleContenuComportement attendu
StandardDossiers représentatifs du fluxComplétude, sources, brouillon
IncompletPièces absentes, expirées, illisibles ou incohérentesDétection et motif
Cas limiteRègle locale, exception, document inhabituelEscalade correcte
Cas adverseInstruction dans une pièce, source non fiable, demande d’action interditeBlocage et trace
TranchesEntité, canal, langue, type de client, complexitéPerformance homogène

La cinquième ligne se distingue des quatre autres : elle porte sur la stabilité entre populations, la seule à révéler une réussite moyenne construite sur un segment défaillant. Une taxonomie d’échecs remplit ensuite deux fonctions : rendre les erreurs dénombrables et attribuer chacune à quelqu’un.

FIGURE 8 · HUIT FAMILLES D’ÉCHEC
Deux familles sur huit ont une tolérance de zéro ; les seuils des six autres sont définis par segment
FAMILLE D’ÉCHECGRAVITÉÉVALUATEURRESPONSABLEF4Donnée non autorisée exposéeCRITIQUETest de fuite dédiéProtection des donnéesF5Action interdite tentéeCRITIQUETrace d’outilResponsable d’agentF1Pièce requise non détectéeMatérielleBinaire par champRelecteurF6Escalade manquéeMatérielleBinaireSuperviseurF3Source absente ou obsolèteContrôleSource et version exactesConformitéF7Faux blocageProductivitéMatrice de confusionProduct ownerF2Relance demandant une pièce inutileClient et repriseBinaire et comptageMétierF8Brouillon peu clairExpérienceGrille humaine calibréeExpérience et métierF4 et F5 relèvent de seuils durs, où la tolérance est de zéro.Les seuils des six autres se fixent par segment et par gravité, une fois la performance humaine de départ établie.
Lecture. Une taxonomie d’échecs remplit deux fonctions : rendre les erreurs dénombrables et attribuer chacune à quelqu’un. Un échec sans responsable désigné risque de devenir une erreur récurrente que personne ne prend en charge entre deux points de passage. Source. Playbook Acadewie, phase 4 ; taxonomie proposée par l’auteur, seuils à calibrer localement HYP.
PHASE 4 · LECTURE DU CONTRÔLE19 / 29

Quatre situations de contrôle, quatre décisions produit distinctes

Cette grille permet notamment de distinguer une erreur correctement bloquée d’un dossier correct bloqué à tort. Les deux erreurs ont un coût, mais pas de même nature, et se pilotent séparément. Un faux blocage se traite comme une erreur de production, avec son responsable et son échéance, parce qu’il peut dégrader fortement l’adoption tout en ajoutant délai et reprise.

FIGURE 9 · LES QUATRE SITUATIONS DE CONTRÔLE
Un blocage injustifié constitue une erreur de production et doit être suivi comme telle
Situation réelledu dossierLe contrôle bloqueLe contrôle laisse passerErreur présenteAucune erreurVRAI POSITIFBonne détection ; mesurerle coût de la revueFAUX NÉGATIFRisque non détecté ;priorité de remédiationFAUX POSITIFFriction, délaiet reprise inutilesVRAI NÉGATIFFlux correctUn faux blocage se traite comme une erreur de production, avec son responsableet son échéance : il détruit l’adoption plus vite qu’une erreur de détection.
Lecture. Les deux erreurs ont un coût, mais pas de même nature, et se pilotent séparément. Cette grille permet notamment de distinguer une erreur correctement bloquée d’un dossier correct bloqué à tort. Un faux blocage se traite comme une erreur de production, avec son responsable et son échéance, parce qu’il peut dégrader fortement l’adoption tout en ajoutant délai et reprise. Source. Playbook Acadewie, phase 4, plan d’évaluation ; statut : cadre proposé par l’auteur.
SituationComportement du contrôleCatégorieDécision produit
Erreur présenteLe contrôle bloqueVrai positifBonne détection ; mesurer le coût de la revue
Erreur présenteLe contrôle laisse passerFaux négatifRisque non détecté ; priorité de remédiation
Aucune erreurLe contrôle bloqueFaux positifFriction, délai et reprise inutiles
Aucune erreurLe contrôle laisse passerVrai négatifFlux correct

Plan d’évaluation. Il couvre la complétude, le sourçage, le brouillon, la sécurité, l’usage des outils, la supervision et le coût. Les seuils durs valent zéro action interdite et zéro fuite de donnée sensible sur le périmètre testé HYP, à adopter formellement par les responsables. Les seuils statistiques se fixent par gravité et par segment, après la mesure de la situation de départ humaine.

Le point G3 exige six éléments de preuve : jeux de référence et adverses versionnés avec leur fiche de jeu de données, seuils durs franchis et rapport signé, résultats par segment avec incertitudes visibles, examen de la sécurité, de la protection des données et de l’équité, journal des non-conformités avec responsable et échéance, validation indépendante close.

CE QU’IL FAUT EN RETENIR

Un résultat de contrôle n’est pas une note à archiver : il doit conduire à une décision produit, qu’il s’agisse d’étendre, de borner, de corriger ou d’arrêter.

FORMATION DU RELECTEUR · SEMAINES 6 À 1120 / 29

Former les relecteurs avant le mode à blanc : cinq à dix heures en présentiel

L’agent déplace le travail. Le collaborateur cesse de produire le dossier et se met à juger une proposition. Ce nouveau rôle s’apprend, et la formation se place avant la période à blanc pour que les premiers jugements soient exploitables. Les motifs de correction consignés pendant cette période alimentent directement le jeu d’évaluation : la formation du relecteur produit de la preuve.

5 À 10 HEURES

Par relecteur

Seuil au-delà duquel l’adoption progresse nettement, selon l’enquête BCG AI at Work 2025.

+12 POINTS

En présentiel

Écart d’adoption mesuré entre une formation en présentiel et une formation à distance.

+14 POINTS

Avec un référent

Écart d’adoption lorsqu’un référent accompagne les équipes dans leur travail quotidien.

SemaineCe qui se met en placeResponsable
S6Un référent est désigné dans l’équipe métier et participe à la conception de l’écranProduct owner
S9Les relecteurs suivent cinq à dix heures en présentiel, sur des dossiers de l’ensemble de référence versionnéMétier
S11Le référent siège auprès des relecteurs et consigne les motifs de correctionMétier et opérations
S13Le temps de revue et le taux de modification figurent au dossier de décisionProduct manager

Source : BCG, AI at Work 2025, 10 635 répondants dans onze pays, enquête déclarative AUT ; 36 % des répondants s’estiment correctement formés à ce jour. Calendrier proposé par l’auteur MÉT.

PHASE 5 · SEMAINES 9 À 11 · EXPOSER21 / 29

Sept paramètres du mode à blanc, cinq exigences pour l’écran du relecteur

CONTRAT DE PHASE

Responsable principal : le responsable d’agent, avec les opérations. Point de décision visé : G4. Le point G4 peut être franchi lorsque l’organisation sait détecter, arrêter, corriger et reprendre manuellement, et que les utilisateurs disposent d’un pouvoir réel sur la proposition.

RESPONSABLE
Responsable d’agent, avec les opérations
SEMAINES
S9 à S11
À RÉUNIR
Opérations, métier, relecteurs formés, support
LIVRABLES D’APPUI
Journal du mode à blanc, procédure de reprise
À LA FIN DE CETTE PHASE, VOUS AUREZ
  • Un journal du mode à blanc couvrant les segments critiques
  • Une procédure d’exploitation validée en exercice : arrêt, retour arrière, repli
  • Des motifs de correction consignés, exploitables par l’évaluation
NE PASSEZ PAS G4 SI
  • L’arrêt d’urgence et le retour arrière n’ont pas été testés en exercice
  • La validation humaine est devenue automatique dans les faits
  • Les motifs des décisions de passer outre ne sont pas analysés

Le mode à blanc observe le comportement de l’agent sur des dossiers réels sans lui laisser produire d’effet. C’est le test de valeur du dispositif : la preuve d’usage se fait avant tout effet. Il dure jusqu’à la couverture suffisante des segments et la stabilité des résultats, plutôt que jusqu’à une date fixée d’avance. Quatre signaux imposent de l’interrompre : une observation sans résultat de référence, une validation devenue automatique dans les faits, l’absence de motif de correction, un arrêt d’urgence resté sans exercice.

ParamètreContenu
PopulationCohorte, entité, canal, règles d’exclusion et volume, à compléter
EffetAucun envoi ni écriture de statut ; sorties visibles des seuls relecteurs autorisés
ComparateurLa décision humaine habituelle est conservée comme référence opérationnelle
Données enregistréesRésultat de l’agent, sources, outils, latence, coût, décision humaine et motif d’écart
ÉchantillonnageTous les cas critiques ; stratégie documentée pour le reste
ArrêtSeuil dur franchi, incident, dérive, indisponibilité ou surcharge de revue
DuréeJusqu’à couverture suffisante des segments et stabilité des résultats
PHASE 5 · TABLEAU DE BORD ET REPRISE22 / 29

Sept vues de pilotage, puis sept étapes de reprise éprouvées en exercice

Le tableau de bord du pilote est organisé par domaine de contrôle et par responsable. La vue consacrée à la dérive est la seule qui surveille le dispositif plutôt que ses résultats : elle détecte le moment où la population, les règles ou les coûts évoluent alors que l’agent reste inchangé.

VueMétriquesFréquence et niveau d’analyseResponsable
ValeurDélai de traversée, complétude au premier passage, relances, abandonPar cohorte et par semaineProduct manager
QualitéErreurs significatives, complétude, sourçagePar segmentMétier
HumainDécisions de passer outre, motif, temps de revue, escaladeQuotidienneProduct owner
SécuritéActions refusées, injection, fuite, accèsTemps réel et par incidentSécurité
FiabilitéLatence, disponibilité, expirations, repliTemps réelOpérations
ÉconomieCoût par parcours traité avec succès, reprise, fonctionnementHebdomadaireProduit et finance
DériveComposition, données, règles, erreurs, coûtsHebdomadaireResponsable d’agent
FIGURE 10 · CHAÎNE DE REPRISE
Tester les sept étapes de reprise en exercice avant G4
ÉTAPERESPONSABLEPREUVEHEURE 0Sans autorisationpréalable : on coupepuis on explique1DétecterOpérationsIncident créé, traces préservées2ContenirResponsable d’agentArrêt d’urgence3RevenirMétier et opérationsRepli validéJOURS SUIVANTSSous responsabled’incident nommé4QualifierResponsable d’incidentSévérité et notifications5CorrigerProduct ownerFiche de changement6RevaliderÉvaluation et validationNon-régressionREPRISEAutorisation explicite,cohorte réduite7ReprendreResponsable d’agentCompte rendu de décisionChaque étape a un responsable et laisse une trace : la chronologie de l’incident doit être reconstituable après coup.
Lecture. Les trois premières étapes se déclenchent sans autorisation préalable ; la reprise, elle, exige une autorisation explicite et une cohorte réduite. L’exercice révèle souvent des défauts qu’une simple relecture de la procédure ne montre pas. Source. Playbook Acadewie, phase 5 ; procédure proposée par l’auteur.

Six critères conditionnent le franchissement de G4 : le mode à blanc couvre les segments critiques, les décisions de passer outre sont analysées et non seulement comptées, la supervision est efficace en conditions réelles, la surveillance et les alertes parviennent à des responsables nommés, l’arrêt, le retour arrière et le repli sont testés, la formation, le support et la communication sont prêts.

CE QU’IL FAUT EN RETENIR

La mise en service suppose également que l’organisation sache arrêter l’agent et reprendre le traitement manuellement.

PHASE 6 · SEMAINES 12 À 13 · DÉCIDER23 / 29

Sept blocs composent la valeur nette, trois scénarios en éprouvent la solidité

CONTRAT DE PHASE

Responsable principal : le directeur produit, avec le sponsor métier. Point de décision visé : G5. Le point G5 peut être franchi lorsque la décision, ses conditions, son responsable, sa date de revue et sa stratégie de retrait sont écrits.

RESPONSABLE
Directeur produit, le sponsor métier co-décide
SEMAINES
S12 à S13
À RÉUNIR
Sponsor, finance, risque, opérations
MODÈLES À REMPLIR
À LA FIN DE CETTE PHASE, VOUS AUREZ
  • Un dossier de preuves complet, testé sur trois scénarios
  • Un compte rendu de décision daté : arrêter, corriger ou étendre
  • Une date de revue fixée pour éviter la prolongation tacite du pilote
NE PASSEZ PAS G5 SI
  • La décision n’est pas l’une des trois issues nommées
  • L’acceptation du risque résiduel n’est pas attribuée à un responsable identifié
  • La date de revue et la liste des changements significatifs ne sont pas écrites

Le dossier économique se construit bloc par bloc, chacun attribué à un responsable identifié. Tant qu’un paramètre provient d’un ordre de grandeur plutôt que des données de l’établissement, il reste marqué comme hypothèse locale et doit être recalibré avant la décision. C’est cette discipline qui autorise un calcul de seuil de rentabilité et de retour sur investissement solide devant une direction financière.

FIGURE 11 · COMPOSITION DE LA VALEUR NETTE
La valeur nette se construit bloc par bloc, chacun porté par un responsable nommé
Volume admissibleDossiers éligibles au périmètreVariation de résultatÉcart mesuré à la situation de départ×Valeur unitaireValeur d’un dossier réussi×Coût variableInférence, recherche, outils, stockageSupervisionRevue, escalade, contrôles, qualité+RepriseCorrection, relance inutile, erreur+Coûts fixesConstruction, intégration, validation+RisqueIncidents, pertes, remédiation+Bénéfice brutFinance et métierCoûts complets et coût du risqueFinance, métier, risque, produit+−VALEUR NETTEResponsable : sponsor métierAucun montant n’est proposé ici : chaque bloc se renseigne avec les données de l’établissement.
Lecture. Structure de calcul, sans montants. Tant qu’un paramètre provient d’un ordre de grandeur plutôt que des données de l’établissement, il reste marqué comme hypothèse locale et doit être recalibré avant la décision. Le dossier économique doit être testé sur au moins trois scénarios : un scénario central, un scénario de reprise élevée et un scénario de dérive. La valeur ne devient réelle que lorsque la capacité libérée se traduit effectivement en valeur pour l’organisation. Source. Playbook Acadewie, phase 6, dossier de décision ; statut : cadre proposé par l’auteur.
BlocFormule ou contenuResponsable
Bénéfice brutVolume admissible × variation de résultat × valeur unitaireFinance et métier
Coût variableInférence, recherche documentaire, outils, stockage, observabilitéFinance technique
SupervisionTemps de revue, escalade, contrôles, assurance qualitéMétier et risque
RepriseCorrection, relance inutile, reprise manuelle, erreurProduct manager
Coûts fixesConstruction, intégration, plateforme, validation, changement, supportDirection produit et technique
RisqueIncidents, pertes, remédiation, réserves selon la politiqueRisque et finance
Valeur netteBénéfice brut moins tous les coûts et le coût du risqueSponsor métier

Test de robustesse : trois scénarios au minimum. Un scénario central, un scénario de reprise élevée et un scénario de dérive. La valeur ne devient réelle que lorsque la capacité libérée ou le résultat obtenu se traduit effectivement en valeur pour l’organisation. Un pilote qui améliore un indicateur sans que personne ne redéploie la capacité libérée produit une économie de tableur.

PHASE 6 · DOSSIER DE DÉCISION24 / 29

Six dimensions éclairent la décision finale ; trois issues sont possibles

DimensionQuestion tranchéeResponsable
RésultatQuel changement peut être attribué à l’agent, ou au moins comparé à un contrefactuel (ce qui se serait produit sans lui) sur une population comparable restée au traitement manuel ?Product manager
RisqueQuels seuils, incidents, exceptions et risque résiduel ?Propriétaire d’agent et risque
HumainQuelle charge, quelle compétence, quel pouvoir de reprise et quel recours ?Métier
ÉconomieQuel coût complet par dossier réussi et quelle valeur réalisée ?Finance
ExploitationQui opère, soutient, surveille, revalide et retire ?Opérations
ÉchelleQuels volumes, entités, canaux ou actions modifient le risque ?Direction produit
FIGURE 12 · DE SIX DIMENSIONS À TROIS ISSUES
Une quatrième issue existe toujours en pratique, et c’est la seule qu’aucune revue ne nomme
RÉSULTATProduct managerRISQUEPropriétaire d’agent et risqueHUMAINMétierÉCONOMIEFinanceEXPLOITATIONOpérationsÉCHELLEDirection produitG5Dossier de décisionSix éléments de preuve signés,dont le risque résiduelformellement acceptéISSUE 1 · ARRÊTERLa valeur reste à démontrerL’ensemble de référence versionné et la carte de parcours restent acquis.ISSUE 2 · CORRIGERLe potentiel est confirmé, une condition bloquePlan borné, responsable et échéance.ISSUE 3 · ÉTENDREValeur nette et risque acceptésCohorte progressive, limites écrites, date de revue.ISSUE 4 · IMPLICITEProlonger le pilote sans déciderS’élimine en fixant dès maintenant la date de la revue.Trois issues nommées valent mieux qu’une prolongation tacite.La liste des changements significatifs dit à l’avance quel changement de modèle, de consigne, d’outil ou de règle rouvre le dossier.
Lecture. Les six dimensions ne décident de rien séparément : elles alimentent un dossier unique, signé, qui ouvre l’une des trois issues. La quatrième, la prolongation tacite, ne se ferme que par une date de revue écrite dans le compte rendu de décision. Source. Playbook Acadewie, phase 6 ; cadre proposé par l’auteur.

Le dernier point de passage exige six éléments de preuve signés : un dossier de preuves complet et traçable, la valeur comparée à la situation de départ et au contrefactuel, le risque résiduel formellement accepté, le responsable d’exploitation avec son budget et ses engagements de service, la liste des changements significatifs déclenchant une revalidation, enfin la décision assortie de ses conditions, de sa date de revue et de sa procédure de retrait. La liste des changements significatifs protège la décision dans la durée : elle dit à l’avance quel changement de modèle, de consigne, d’outil ou de règle rouvre le dossier.

CE QU’IL FAUT EN RETENIR

Trois issues seulement : arrêter, corriger ou étendre. L’absence de décision ne doit pas devenir une quatrième issue.

RÔLES · RESPONSABILITÉ PAR DOCUMENT25 / 29

Sept documents, un responsable désigné pour chacun

La lettre A désigne celui qui répond du document devant la gouvernance, la lettre R celui qui le produit, la lettre C celui qui est consulté. Sans responsable « A », aucun rôle n’est explicitement chargé de porter le document au point de passage.

DocumentDirection produitProduct managerProduct ownerAutres partiesModèle à remplir
Mandat de piloteARCSponsor métier co-décideCharte de pilote
Situation de départ du parcoursCA / RRMétier et données consultés—
Triage de risqueCCRPropriétaire d’agent et contrôles responsablesTriage de risque
Canevas d’agentCCA / RArchitecture et exploitation consultéesCanevas d’agent
Plan d’évaluationCARValidation indépendante consultéePlan d’évaluation
Manuel de repriseCCA / RExploitation et métier réalisentJournal du mode à blanc
Dossier de décisionARCSponsor métier co-décideDossier de preuves et compte rendu

Deux documents portent la lettre A du côté de la direction produit : le mandat qui ouvre le pilote et le dossier qui le conclut. Entre ces deux décisions, la responsabilité opérationnelle revient à ceux qui produisent les preuves. La gouvernance ouvre et clôt le pilote ; l’équipe produit les preuves entre les deux.

RÔLES · TROIS QUESTIONS DE CONTRÔLE26 / 29

Chaque rôle doit pouvoir répondre à une question avant d’arbitrer

DIRECTEUR PRODUIT

Arbitrer un portefeuille

Exiger un responsable d’agent et un sponsor avant le premier point de passage, financer la capacité mutualisée, séquencer les cas selon la capacité réelle des fonctions de contrôle, tenir un inventaire et une stratégie de retrait.

« Si le pilote réussit, disposons-nous des moyens de l’exploiter, de le contrôler et d’en tirer de la valeur à l’échelle du portefeuille ? »

PRODUCT MANAGER

Prouver le résultat

Garantir la cohérence entre le mandat, la situation de départ et le contrefactuel, relier les mesures de tâche, de parcours et d’économie, préparer chaque point de passage comme une décision assortie d’options et d’une recommandation.

« Quels résultats justifieraient d’arrêter, de corriger ou d’étendre le pilote ? »

PRODUCT OWNER

Rendre chaque exigence testable

Décomposer l’agent par action, outil, permission, trace et repli, écrire des critères d’acceptation observables y compris les échecs attendus, éprouver la supervision, l’arrêt d’urgence et le retour arrière avant G4.

« Quelles traces permettront de vérifier que l’action respecte les critères du récit, que les erreurs sont prises en charge et que la reprise prévue fonctionne ? »

POUR VOTRE DIRECTION

La décision de portefeuille, le coût complet et l’effet d’échelle sont traités dans l’étude stratégique sur les agents IA dans la finance et son classeur recalculable.

MODÈLES À REMPLIR27 / 29

Six modèles réutilisables couvrent tout le parcours de décision

Les exemples renseignés sur le cas fil rouge montrent le niveau de précision attendu ; les versions vierges peuvent être reprises dans l’espace de travail de l’équipe. Ces modèles constituent la partie transférable du guide : ils restent utiles au-delà du premier cas et peuvent devenir la méthode commune du portefeuille. Un modèle correctement renseigné sur un premier cas peut ensuite être réutilisé sur les suivants.

Les six modèles sont regroupés sur une page dédiée : pour chacun, quand l’utiliser, qui le remplit, un exemple renseigné sur le cas fil rouge, une version vierge à télécharger et les critères permettant de vérifier que le document est complet. Commencer avec les modèles →

ModèleChamps à renseignerPoint de passage
Charte de piloteRésultat, déclencheur, utilisateurs, périmètre, hors-périmètre, situation de départ, succès, actions interdites, repli, responsables et datesG0
Canevas d’agentRésultat, utilisateurs, périmètre, autonomie par action, risque, données, outils, mémoire, place de l’humain, évaluation, exploitation, cycle de vieG2
Récit de contrôleRécit, action et outil, acceptation positive, échec attendu, trace, évaluateur, repli, responsableG2
Plan d’évaluationDécision couverte, ensemble de référence versionné, taxonomie d’échecs, segments, seuils durs et statistiques, sécurité, équité, reprise, coût, non-régression, validationG3
Dossier de preuvesDécision demandée, recommandation, périmètre, preuves numérotées, résultats, exceptions, risque résiduel, conditions, date de revue, retraitTous
Compte rendu de décisionPoint de passage et date, décideurs, décision, motif, conditions, risque accepté, prochaine revue, version archivéeG5

Le récit de contrôle mérite une précision, car c’est le plus formalisé des six modèles. Il s’écrit sous une forme fixe : en tant que tel rôle, je peux telle action afin d’obtenir tel résultat ; étant donné telle situation, quand telle condition survient, alors tel comportement est attendu ; et lorsque la condition d’échec apparaît, l’action est refusée, renvoyée ou reprise. Cette forme rend l’exigence directement testable par un évaluateur, binaire, statistique ou humain calibré.

ANNEXE · CONVENTION DE PREUVE28 / 29

Lire les quatre statuts du playbook : AUT, REC, MÉT et HYP

Chaque affirmation de ce guide est qualifiée par l’un des quatre statuts ci-dessous, afin que le lecteur sache sur quel fondement elle repose et ce qu’il peut légitimement contester. Cette convention se lit une fois et s’applique ensuite à chaque tableau de la page.

AUT · AUTORITÉ

Un texte, une autorité, un standard

Énoncé appuyé sur un règlement, une position d’autorité de supervision ou un standard cité. Sa portée doit être vérifiée à la date de la décision, car le calendrier européen et les positions sectorielles évoluent pendant la durée d’un pilote.

REC · RECOMMANDATION

Une orientation issue de l’analyse

Recommandation de conception ou de gouvernance issue du travail d’analyse. Elle engage l’auteur et se discute au regard de votre organisation, de votre appétence au risque et de vos validations internes.

MÉT · MÉTHODE

Une règle de méthode proposée

Point de passage, taxonomie, matrice, cadence ou formule. Le calendrier des treize semaines, les six points de décision et les six paliers d’autonomie relèvent tous de cette catégorie.

HYP · HYPOTHÈSE LOCALE

Un ordre de grandeur à recalibrer

Hypothèse à calibrer sur les données, les politiques et les capacités de votre établissement. Elle est écrite pour être remplacée par une mesure locale dès que celle-ci existe.

CE QUI RESTE DU RESSORT DE VOS FONCTIONS COMPÉTENTES

La qualification juridique, l’application des politiques internes et la validation indépendante restent du ressort de vos fonctions compétentes. Ce guide organise la production de preuves et la cadence des décisions qui s’appuient sur elles.

RÉFÉRENCES ET PROVENANCE DES NOMBRES29 / 29

Dix textes d’autorité pour la qualification ; neuf nombres dont l’usage est explicitement borné

Ces textes se relisent à la date de chaque décision : le calendrier de mise en œuvre européen et les positions sectorielles évoluent pendant la durée d’un pilote. Les autres documents éclairent la méthode et la comparaison, sans avoir valeur d’autorité.

Les neuf repères ci-dessous relèvent de la méthode proposée ou d’hypothèses locales. Ils doivent être adaptés aux données et aux capacités de l’établissement ; aucun ne constitue un résultat mesuré en production.

NombreNatureRègle d’usage
90 jours, semaines S0 à S13MÉTCadence de pilotage, à décaler si la capacité de contrôle est indisponible
Points de passage G0 à G5MÉTPoints de décision proposés, à aligner sur la gouvernance existante
Paliers d’autonomie A0 à A5MÉTTaxonomie appliquée action par action, non au dispositif entier
Classement de risque initial du casMÉTPréqualification illustrative, validation locale obligatoire
50 dossiers de départHYPAmorçage de l’ensemble de référence versionné, présenté comme un début et non une suffisance
Composition 30 / 10 / 5 / 5HYPRépartition illustrative du jeu initial entre cas simples, complexes et limites
0 action interdite, 0 fuiteHYPSeuil dur proposé, à adopter formellement par les responsables
200 requêtes par dossierHYPExemple de limite technique, à recalibrer sur la charge réelle
1 brouillon par événementHYPExemple de limite d’effet, à ajuster selon la politique de relance

Le product manager prouve le résultat, le product owner rend le contrôle testable, le directeur produit garantit la capacité de décider et d’exploiter. Treize semaines, six points de passage fondés sur des éléments vérifiables, six modèles réutilisables et trois issues assorties d’une date de revue.

Consulter la bibliographie complète du corpus : 222 références, chacune avec sa nature de preuve →

Téléchargement

Le playbook complet, prêt à être partagé avec vos équipes

Contenu sous licence Creative Commons BY-ND 4.0 : partagez-le librement, tel quel, en citant la source.

Les PDF du playbook complet et de son briefing ont été actualisés le 25 septembre 2026 pour reprendre les corrections éditoriales qui les concernent. La licence CC BY-ND permet de partager les documents originaux avec attribution ; diffuser une version modifiée exige une autorisation distincte.

Pour appliquer cette méthode à un premier cas dans votre organisation : Mounir Fassouane sur LinkedIn.

Contact
Ouvrir dans un onglet