# Plan d'évaluation — modèle vierge

> Point de passage : G3 · Responsables : product manager (en répond) et product owner (produit), avec le responsable d'évaluation
> Source : Playbook Acadewie, phase 4 · Licence CC BY-ND 4.0 · www.acadewie.com/agents/playbook/

| Champ | À renseigner |
|---|---|
| Rempli par / le / version | |
| Décision couverte | *Ce que l'évaluation permettra de décider à G3* |
| Jeu de référence | *Familles, volumes, versionnage — composition avant volume* |
| Taxonomie d'échecs | *Les familles d'échec, leur gravité, leur évaluateur, leur responsable* |
| Segments | *Entité, canal, langue, type de client, complexité* |
| Seuils durs | *Tolérance zéro : lesquels, adoptés formellement par qui* |
| Seuils statistiques | *Par gravité et par segment, après la mesure de la performance humaine de départ* |
| Sécurité | *Tests d'injection, fuite, actions interdites* |
| Équité | *Segments exposés à des erreurs asymétriques* |
| Reprise | *Exercice d'arrêt et de retour arrière* |
| Coût | *Coût d'inférence et de revue par dossier* |
| Non-régression | *Ce qui est rejoué à chaque changement* |
| Validation | *Qui valide indépendamment, et quand* |

## Un bon plan d'évaluation distingue

- [ ] Les seuils durs (tolérance zéro) des seuils statistiques (négociés par segment)
- [ ] La performance moyenne de la performance du pire segment critique
- [ ] Le juge automatique du second évaluateur (jamais un juge unique)
- [ ] La réussite de tâche du résultat de parcours (les trois échelons se mesurent séparément)
- [ ] Les jeux versionnés des jeux modifiés en cours de route (les seconds n'ont pas valeur de preuve)

---
Modèle v1.0 · août 2026 · Les durées et volumes sont des hypothèses locales (HYP) à recalibrer sur les données de votre établissement. Les gabarits vierges sont fournis pour être renseignés et réutilisés en interne ; la restriction « sans modification » de la licence CC BY-ND porte sur la republication du guide et des exemples, non sur le remplissage des modèles.
