Identifier
Repérez les informations personnelles et celles réellement nécessaires. Le repérage se fait sur les champs et les formats connus ; un identifiant écrit en toutes lettres dans un paragraphe demande une relecture.
Pour beaucoup de tâches, les données personnelles ne sont pas nécessaires. Étudiez leur protection avant de transmettre quoi que ce soit à un modèle.
Illustration fictive d’une substitution. Le dispositif réel dépend du traitement et de sa configuration.
Camille Martin demande un retour pour la commande CMD-0042. Son appareil ne démarre plus.
[PERSONNE_1] demande un retour pour la commande [COMMANDE_1]. Son appareil ne démarre plus.
Repérez les informations personnelles et celles réellement nécessaires. Le repérage se fait sur les champs et les formats connus ; un identifiant écrit en toutes lettres dans un paragraphe demande une relecture.
Étudiez la détection et le remplacement des identifiants selon les options disponibles. Le choix du procédé se décide tâche par tâche : une synthèse interne et un contenu publié n’exigent pas le même niveau.
Contrôlez les éléments résiduels et les possibilités de réidentification. Un contrôle sur un échantillon réel vaut mieux qu’une promesse de configuration : c’est là que les cas particuliers apparaissent.
Réduire les données utilisées au strict besoin de la tâche.
Remplacer des identifiants tout en conservant, potentiellement, une possibilité de réidentification.
Empêcher la réidentification de façon effective et durable : une exigence à évaluer rigoureusement.
Une vérification reste nécessaire. Des informations indirectes, un contexte particulier ou une mauvaise qualité de document peuvent laisser subsister des possibilités d’identification.
Il faut vérifier les formats, les catégories d’informations, la qualité de l’extraction et le résultat attendu. La démonstration permet de cadrer les modalités applicables à votre cas.
Nous pouvons commencer par un exemple fictif et définir les exigences de protection.