Pseudonymes cohérents : remplacer des noms sans perdre le sens
Étiquette de rôle, jeton numéroté ou faux nom : trois façons de remplacer des noms dans un document en gardant une étiquette cohérente pour chaque personne.
Un bandeau noir sur un nom casse une histoire. Un rapport peut dire que le responsable a ignoré trois réclamations. Le lecteur doit alors comprendre qu'il s'agit du même responsable à chaque fois, pas de trois personnes différentes. Les pseudonymes cohérents résolvent ce problème : ils cachent qui est qui, et ils gardent le texte lisible et cohérent.
Pourquoi les bandeaux noirs cassent le sens
Un bandeau noir traite chaque nom de la même façon : il disparaît. Mais une étude de cas de formation, une transcription de recherche ou une instruction donnée à une IA sont souvent longues. Le lecteur doit alors pouvoir suivre une même personne sur plusieurs pages. Si Claire Exemple devient un bandeau illisible trois fois, puis un bandeau différent la quatrième fois, l'histoire s'effondre. Le lecteur ne peut plus savoir s'il s'agit d'une seule responsable ou de quatre.
Trois façons de remplacer un nom
| Méthode | Comment ça marche | Utile pour | À surveiller |
|---|---|---|---|
| Étiquette de rôle | Remplacer le nom par une fonction, comme le locataire ou la responsable | Textes courts, peu de personnes, résumés en langage clair | Deux personnes avec le même rôle sont faciles à confondre |
| Jeton numéroté | Remplacer chaque nom par un code, comme NAME1, répété pour la même personne | Documents longs, nombreuses personnes, données d'entraînement, instructions pour IA | La liste des jetons doit elle-même être protégée |
| Faux nom réaliste | Remplacer le vrai nom par un autre nom inventé, comme Claire Exemple | Études de cas lisibles, ateliers, contrats types | Les lecteurs peuvent le confondre avec une vraie personne |
Choisissez une seule méthode par document et gardez-la du début à la fin. Mélanger étiquettes de rôle et jetons dans le même texte perd souvent plus le lecteur que cela ne protège. Il doit apprendre deux codes à la fois.
La seule règle qui garde un texte cohérent
La règle est simple : une personne, une étiquette, sur chaque page. Si Claire Exemple devient [NAME2] page un, elle reste [NAME2] page dix. Rompre cette règle une seule fois fait perdre le fil au lecteur. Pire encore, cela peut faire croire que deux personnes différentes ont dit la même chose.
- Construisez la liste des étiquettes avant de commencer à lire le document, pas au fil de l'eau.
- Gardez la même étiquette pour une personne même si son nom est orthographié de deux façons différentes dans le texte d'origine.
- Retirez le genre et le rôle d'une étiquette, sauf si le texte en a besoin pour rester compréhensible. Gardez par exemple la responsable si l'affaire porte justement sur une décision de management.
- Réutiliser une étiquette dans deux documents sans lien peut les relier entre eux : traitez la liste d'étiquettes de chaque projet séparément.
Généraliser les détails sans perdre le contexte
Une étiquette cache un nom, mais la phrase autour peut encore identifier quelqu'un. La directrice commerciale de 34 ans à Annecy ramène la recherche à une seule personne, même sans nom. Généraliser garde la phrase utile tout en élargissant le groupe qu'elle peut décrire.
- Transformez un âge exact en tranche : 34 ans devient la trentaine.
- Transformez une petite ville en région : Annecy devient une ville des Alpes françaises.
- Transformez une date exacte en date décalée ou arrondie : 14 mars 2024 devient printemps 2024. Décalez-la de la même façon pour cette personne dans tout le texte.
- Transformez un intitulé de poste trop précis en intitulé plus large quand il identifie une personne à lui seul. La seule directrice technique devient ainsi une cadre de direction technique.
Un texte pseudonymisé reste-t-il une donnée personnelle
En droit européen, oui. L'article 4, paragraphe 5, du RGPD définit la pseudonymisation comme un traitement qui empêche d'attribuer une donnée à une personne sans informations supplémentaires. Ces informations supplémentaires doivent être conservées séparément et protégées. Le considérant 26 précise qu'une donnée pseudonymisée reste une information sur une personne identifiable, une fois ces informations supplémentaires réunies.
La CNIL rappelle que ces données restent donc soumises aux obligations du RGPD. Le Comité européen de la protection des données a adopté un projet de lignes directrices 01/2025 sur la pseudonymisation en janvier 2025. Il la présente comme une garantie, pas comme une façon d'échapper au RGPD.
Si construire et vérifier une liste d'étiquettes à la main vous semble long, le mode Jeton d'ONYRI Sanitize (offre Pro) fait cette partie du travail. Chaque nom, e-mail ou numéro de téléphone détecté reçoit une étiquette unique, comme [NAME1], répétée partout où elle apparaît dans le document. L'outil ne garde aucun fichier clé pour restaurer les valeurs d'origine : gardez votre document non masqué avant de partager la version étiquetée.
Une vérification rapide avant de publier
- Choisissez une seule méthode, étiquette de rôle, jeton numéroté ou faux nom, pour tout le document.
- Donnez une étiquette à chaque personne et vérifiez qu'elle reste la même de la première à la dernière page.
- Généralisez tout détail, âge, lieu, date ou intitulé, qui pourrait à lui seul désigner quelqu'un.
- Rangez la liste des étiquettes séparément du texte pseudonymisé, ou supprimez-la si vous n'en aurez jamais besoin.
- Souvenez-vous qu'un texte pseudonymisé reste une donnée personnelle au sens du RGPD : il lui faut toujours une base légale et une sécurité raisonnable.
Questions fréquentes
- Quelle est la différence entre pseudonymisation et anonymisation ?
- La pseudonymisation remplace les détails identifiants par des étiquettes mais garde un moyen de revenir en arrière, même stocké séparément. L'anonymisation supprime ce moyen de revenir en arrière. En droit européen, une donnée pseudonymisée reste une donnée personnelle. Une donnée vraiment anonymisée ne l'est plus, selon le considérant 26 du RGPD.
- Puis-je réutiliser le même faux nom, comme Claire Exemple, dans plusieurs documents sans lien ?
- Mieux vaut éviter. Si le même faux nom désigne toujours la même personne réelle, cela crée un lien entre les projets. Quelqu'un qui verrait deux documents pourrait alors mieux cerner qui se cache derrière Claire Exemple. Utilisez une liste d'étiquettes distincte pour chaque projet.
- Une étiquette de rôle peut-elle être trop précise et identifier quelqu'un ?
- Une étiquette de rôle n'est sûre que si plusieurs personnes pourraient l'occuper. La directrice régionale convient dans une grande entreprise. Dans une équipe de trois personnes, elle désigne une seule personne. Quand un rôle n'a qu'un titulaire évident, préférez un jeton numéroté ou un faux nom.
- Dois-je garder le fichier qui relie les étiquettes aux vrais noms ?
- Seulement si vous aurez vraiment besoin d'annuler la pseudonymisation plus tard. Si vous le gardez, rangez-le séparément du texte pseudonymisé, sur un autre système, et limitez qui peut l'ouvrir. Si vous n'en aurez jamais besoin, le supprimer, c'est une source de fuite en moins.
Sources et références
- Identifier les données personnelles (définition de la pseudonymisation) — CNIL
- Le CEPD adopte des lignes directrices 01/2025 sur la pseudonymisation — CNIL
- Règlement (UE) 2016/679 (RGPD), article 4 paragraphe 5 et considérant 26 — EUR-Lex, Office des publications de l'Union européenne
Masquez un document sans l'envoyer nulle part
ONYRI Sanitize repère les noms, identifiants, coordonnées bancaires et secrets dans un PDF, un Word ou un scan, et les masque dans votre navigateur. Vous relisez l'aperçu, puis vous téléchargez une copie aplatie.