L’essentiel
- La pseudonymisation remplace ce qui identifie une personne par un pseudonyme, et garde la correspondance à part.
- Contrairement à l’anonymisation, elle est réversible : les données restent des données personnelles au sens du RGPD.
- Le guide du CNB de mars 2026 recommande de pseudonymiser ou d’anonymiser systématiquement les données avant d’utiliser une IA générative.
Qu’est-ce que la pseudonymisation ?
Le RGPD la définit à son article 4 :
« le traitement de données à caractère personnel de telle façon que celles-ci ne puissent plus être attribuées à une personne concernée précise sans avoir recours à des informations supplémentaires, pour autant que ces informations supplémentaires soient conservées séparément et soumises à des mesures techniques et organisationnelles […] »
Règlement (UE) 2016/679, article 4, 5)
Concrètement, Claire Delaunay devient Personne A et Atelier Noroit devient Organisation A. La table qui relie chaque pseudonyme à la vraie identité est conservée à part, hors de l’outil qui reçoit le texte.
Le guide du CNB reprend la formule de la CNIL : il s’agit de « remplacer les données directement identifiantes (nom, prénom, etc.) d’un jeu de données par des données indirectement identifiantes ».
Pseudonymisation ou anonymisation ?
Les deux termes sont souvent confondus. Le guide du CNB le rappelle : « L’anonymisation ne doit pas être confondue avec la pseudonymisation. »
| Pseudonymisation | Anonymisation | |
|---|---|---|
| Réversible ? | Oui, pour qui détient la table de correspondance | Non, par définition |
| Statut au regard du RGPD | Les données restent des données personnelles | Les données sortent du champ du RGPD |
| Avec une IA | L’IA suit le dossier : Personne A reste Personne A d’une pièce à l’autre | Souvent trop destructrice pour analyser un dossier précis |
La CNIL définit l’anonymisation comme « un traitement qui consiste à utiliser un ensemble de techniques de manière à rendre impossible, en pratique, toute identification de la personne par quelque moyen que ce soit et de manière irréversible ». Le considérant 26 du RGPD précise que les données pseudonymisées restent des données personnelles, alors que les informations anonymes ne sont pas concernées.
Pourquoi pseudonymiser avant d’utiliser ChatGPT ou Claude
Toute requête envoyée à une IA générative part chez l’entreprise qui l’exploite. Le guide du CNB souligne que ces données sont conservées et traitées, « parfois utilisées pour l’amélioration des modèles », le plus souvent par des entreprises américaines.
D’où une règle claire :
« Il est impératif pour l’avocat de veiller à ne jamais communiquer des données relatives à ses dossiers ou à ses clients à des intelligences artificielles génératives (IAG). »
CNB, La déontologie et l’intelligence artificielle, mars 2026
Le même guide apporte la réponse pratique : « La solution réside dans la pseudonymisation ou l’anonymisation des données. » La pseudonymisation a un avantage décisif pour le travail juridique : les faits restent lisibles. L’IA peut résumer, analyser ou rédiger, parce qu’elle sait toujours qui fait quoi.
Ce qu’il faut remplacer
Le CNB vise « les noms, adresses, numéros de téléphone, informations financières et/ou stratégiques » sur les clients et les membres du cabinet, et plus largement « tout détail spécifique d’un dossier qui pourrait permettre d’identifier une personne ou une entreprise ». En pratique :
- Les identités : personnes physiques, sociétés, associations, administrations.
- Les coordonnées : adresses, e-mails, téléphones.
- L’état civil : dates et lieux de naissance.
- Les identifiants : IBAN, SIREN et SIRET, numéro de sécurité sociale, immatriculations, numéros de contrat ou de dossier.
Attention aux identifiants indirects
Un dossier peut rester reconnaissable sans aucun nom. Le CNB cite les « montants, noms de projets donnés en interne, façon de rédiger un contrat ». Renommez les projets internes, élargissez les lieux trop précis (une région plutôt qu’une rue, comme le suggère le guide) et méfiez-vous des faits rares ou médiatisés.
Les limites à connaître
- Une détection automatique peut manquer un élément. La relecture de la version pseudonymisée reste indispensable.
- Le contexte peut suffire à réidentifier, même sans nom : une fonction unique, une affaire connue, un montant atypique.
- Elle ne couvre pas toutes les tâches. Le CNB donne l’exemple du compte-rendu rédigé en direct pendant un rendez-vous : les informations partent avant toute pseudonymisation.
- Elle ne vaut pas conformité à elle seule. Les données restent personnelles : le RGPD continue de s’appliquer, et le choix de l’outil compte (hébergement, conservation, réutilisation).
La méthode en quatre étapes
- Ne garder que l’utile. Le CNB recommande de « limiter la mise en contexte à ce qui est strictement nécessaire pour accomplir la tâche ».
- Remplacer de façon cohérente. Un même nom doit devenir le même pseudonyme dans toutes les pièces du dossier, sinon l’IA perd le fil.
- Relire ce qui part. Vérifiez chaque remplacement et cherchez les identifiants indirects.
- Garder la table chez vous. Ne la transmettez jamais à l’IA ; servez-vous-en pour remettre les vrais noms dans le résultat.
Pseudonymiser avec LexTandem
LexTandem applique cette méthode à vos pièces, PDF (même scannés) et Word. L’application repère les identités, les coordonnées et les identifiants, propose un pseudonyme pour chacun et garde le même pseudonyme dans tout le dossier. Vous validez, corrigez ou complétez chaque remplacement avant l’envoi.
La détection est faite sur nos serveurs en France, sans conservation du texte. La table de correspondance reste sur votre ordinateur : c’est elle qui permet de remettre les vrais noms dans les réponses de l’IA.