Anonymiser un document avant de l'envoyer à ChatGPT ou une IA
Avant de coller un contrat, un CV ou un dossier client dans ChatGPT, Claude, Copilot ou Gemini, retirez les noms, adresses, e-mails et passages confidentiels. Une fois le texte envoyé, vous ne contrôlez plus ce qu'il devient.
Pourquoi anonymiser un document avant de le donner à une IA
Un contrat, un CV, un compte rendu médical ou un dossier client contient des noms, des adresses, des numéros de téléphone, parfois des secrets d'affaires. Dès que vous collez ce texte dans une IA généraliste comme ChatGPT, Claude, Copilot ou Gemini, ces informations quittent votre poste et transitent par les serveurs d'un tiers. Vous ne savez plus précisément où elles sont stockées, combien de temps, ni qui peut y avoir accès en interne chez le fournisseur.
Anonymiser ou pseudonymiser le document avant l'envoi — remplacer « Marie Dupont » par « PERSONNE 1 », une adresse par « ADRESSE 1 » — permet d'utiliser l'IA pour résumer, reformuler ou analyser un texte sans exposer l'identité des personnes concernées. C'est une précaution simple, qui ne coûte rien et qui s'applique aussi bien à un usage personnel qu'à un usage professionnel soumis au RGPD.
Ce que les IA font (ou peuvent faire) de vos documents
Les politiques varient selon l'éditeur et surtout selon l'offre utilisée. Sur les versions grand public gratuites ou payantes, il est fréquent que les conversations puissent servir à améliorer les modèles, sauf si vous désactivez cette option dans les paramètres de confidentialité. Sur les offres entreprise (API, ChatGPT Enterprise, Team avec la bonne configuration, Copilot en contexte professionnel), les fournisseurs indiquent généralement ne pas utiliser les données pour l'entraînement.
Dans les deux cas, le document a quitté votre machine. Il a été lu, traité, potentiellement journalisé à des fins de sécurité ou de support technique. Si le fournisseur subit une faille, ou si un employé accède aux journaux pour du débogage, vos données confidentielles y sont exposées. Ce n'est pas une accusation contre un éditeur en particulier : c'est la nature même d'un service en ligne, IA ou non.
Que faut-il retirer avant d'envoyer un document à une IA
Selon le type de document, la liste change, mais on retrouve toujours les mêmes familles d'informations :
- Identité des personnes : noms, prénoms, surnoms, initiales identifiantes.
- Coordonnées : adresses postales, e-mails, numéros de téléphone.
- Identifiants uniques : numéro de sécurité sociale, numéro de dossier, numéro de client, IBAN.
- Organisations : nom de l'entreprise, du service, parfois même la ville si elle permet de remonter à un site précis.
- Contenu confidentiel : clauses financières, informations médicales, secrets industriels, passages sous accord de confidentialité.
Une bonne pratique consiste à remplacer chaque occurrence par une étiquette stable plutôt que par un simple « [confidentiel] » : si « Marie Dupont » devient systématiquement « PERSONNE 1 » partout dans le document, l'IA peut toujours comprendre qui fait quoi dans le texte, ce qui préserve l'utilité de l'analyse tout en supprimant l'identité réelle.
Méthode manuelle et gratuite pour anonymiser un document
Si le document est court ou que vous n'avez pas encore d'outil dédié, une anonymisation manuelle reste possible :
- Faites une copie du fichier original, ne travaillez jamais sur la seule version source.
- Repérez chaque donnée sensible avec la fonction de recherche de votre traitement de texte ou de votre lecteur PDF (Ctrl/Cmd+F sur les noms connus, puis relecture complète pour le reste).
- Remplacez par des étiquettes cohérentes : « PERSONNE 1 », « PERSONNE 2 », « ORGANISATION 1 », en gardant la même étiquette pour la même entité tout au long du texte.
- Si le document est un PDF avec des passages à cacher plutôt qu'à remplacer, utilisez un vrai caviardage : Adobe Acrobat Pro (Outils › Caviarder), Aperçu sur Mac (Outils › Caviarder) ou LibreOffice Draw (Outils › Caviarder), puis vérifiez le fichier final par un copier-coller. Un simple rectangle noir dessiné par-dessus le texte ne suffit pas : le texte reste sélectionnable dessous dans la plupart des cas.
- Relisez l'intégralité du document avant de l'envoyer à l'IA, y compris les métadonnées (propriétés du fichier) et les commentaires ou notes de révision qui peuvent contenir des noms.
Ces outils gratuits font le travail correctement si vous prenez le temps de la relecture. Leur limite : tout est manuel, ce qui devient long et source d'oubli dès que le document dépasse quelques pages ou qu'il faut traiter plusieurs fichiers.
Anonymiser un document avec AnonymFiles avant de l'envoyer à une IA
AnonymFiles est une application de bureau pour Mac (Apple Silicon) et Windows qui automatise cette étape. Ce serait un comble de passer par un service en ligne pour préparer ce qui partira vers une IA : AnonymFiles est donc 100 % hors ligne, sans compte, sans vérification de licence, sans télémétrie et sans chat IA dans le cloud. Rien ne quitte votre ordinateur tant que vous n'avez pas décidé vous-même d'envoyer une copie.
Le fonctionnement : vous déposez un dossier entier (PDF contenant du texte, Word .docx, .txt, .md), l'application détecte les personnes, organisations, adresses, e-mails, téléphones et IBAN, puis les remplace par des étiquettes stables comme « PERSONNE 1 » ou « ORGANISATION 1 », identiques d'un fichier à l'autre. Vous comparez ensuite chaque original à sa copie côte à côte, caviardez à la main ce que la détection automatique aurait manqué, validez pièce par pièce, puis exportez des copies propres, avec des noms de fichiers neutres. La table de correspondance entre étiquettes et identités ne part jamais avec les copies : elle reste sur votre ordinateur, et sert à remettre les vrais noms dans la réponse de l'IA une fois celle-ci récupérée. Les PDF scannés et les images ne sont pas encore lus : l'app les signale et les exclut.
Les copies exportées sont alors prêtes à être collées dans ChatGPT, Claude ou un autre assistant : le texte garde sa structure et sa logique, mais plus aucune identité réelle. Si vous travaillez avec Claude ou un autre agent compatible MCP, vous pouvez aussi lui donner accès au dossier via le serveur MCP local d'AnonymFiles : l'agent ne lit que les copies caviardées, jamais les originaux. Relisez tout de même les copies avant de les confier à une IA : aucune détection automatique n'est parfaite.
Anonymisez avant de coller dans une IA
AnonymFiles anonymise un dossier entier sur votre Mac ou PC, 100 % hors ligne : sans vérification de licence, sans télémétrie, sans chat dans le cloud. Bientôt disponible sur Mac et Windows.
Découvrir AnonymFilesCas particuliers : code, tableurs, e-mails, contrats
Un contrat ou une pièce judiciaire pose un problème spécifique : les noms des parties reviennent souvent des dizaines de fois, y compris dans des formules indirectes (« le bailleur », « la société venderesse représentée par M. X »). Vérifiez que toutes les variantes d'un même nom sont couvertes par la même étiquette.
Un tableur exporté en texte pour une IA doit être vérifié colonne par colonne : une colonne « Client » ou « Email » entière peut passer inaperçue si vous ne relisez que les premières lignes.
Un e-mail collé dans une IA contient presque toujours une signature avec nom, fonction, téléphone et parfois adresse : pensez à la retirer, pas seulement le corps du message.
Du code source peut contenir des clés d'API, des mots de passe en dur ou des noms de domaine internes : ce ne sont pas des données personnelles au sens du RGPD, mais ce sont des secrets qui ne doivent pas non plus finir dans les journaux d'un fournisseur d'IA.
Erreurs à éviter
- Ne demandez pas à l'IA elle-même d'anonymiser le document : à ce moment-là, les données confidentielles lui ont déjà été transmises, ce qui annule l'intérêt de la démarche.
- Ne vous arrêtez pas à la première page : les listes, annexes et pièces jointes contiennent souvent les données les plus sensibles.
- Ne réutilisez pas un fichier « anonymisé » sans vérifier ses métadonnées (auteur, historique de révisions), qui peuvent contenir un nom réel même quand le corps du texte est propre.
- Ne considérez jamais un traitement automatique comme fiable à 100 % : une relecture humaine reste nécessaire avant tout envoi.
Pour aller plus loin sur la définition exacte des termes utilisés ici, la différence entre anonymisation et pseudonymisation selon le RGPD mérite d'être connue avant de choisir son niveau de précaution. Si le document à traiter est une pièce de dossier judiciaire, consultez aussi notre guide sur l'anonymisation d'un jugement ou de pièces judiciaires. Et pour la méthode générale de traitement d'un PDF, voir comment anonymiser un PDF gratuitement.
Questions fréquentes
Est-ce que ChatGPT garde mes documents ?
Cela dépend du produit et des réglages. Sur le grand public, les conversations peuvent être utilisées pour améliorer les modèles sauf désactivation dans les paramètres ; sur les offres entreprise (API, ChatGPT Enterprise, Team avec les bons réglages), OpenAI indique ne pas entraîner ses modèles sur ces données. Dans tous les cas, un fichier envoyé quitte votre machine et transite par les serveurs du fournisseur : la seule garantie totale contre la fuite reste de ne pas l'envoyer tel quel.
Anonymiser un document rend-il son usage avec une IA sans risque ?
Non, cela réduit le risque, ça ne l'annule pas. Une anonymisation mal faite peut laisser des indices qui permettent de ré-identifier une personne (un nom propre oublié dans un tableau, un numéro de dossier unique, une combinaison de détails rares). Relisez toujours le résultat avant de l'envoyer, et gardez à l'esprit que l'IA elle-même peut recouper des informations.
Puis-je utiliser ChatGPT pour anonymiser mon document ?
Ce serait envoyer les données confidentielles à l'IA avant même de savoir si elle est autorisée à les recevoir, ce qui annule l'intérêt de l'anonymisation. Il faut retirer les données sensibles avant d'utiliser l'IA, pas pendant, avec un outil qui tourne sur votre poste ou dont vous maîtrisez le traitement.
Quelle différence entre anonymiser et pseudonymiser un document pour une IA ?
La pseudonymisation remplace les identifiants par des codes ou des étiquettes réversibles : quelqu'un qui a la clé peut retrouver qui est qui, donc le RGPD continue de s'appliquer (article 4(5)). L'anonymisation vise à rendre la ré-identification impossible ; si elle est réussie, le document sort du champ du RGPD (considérant 26). Pour un usage IA courant, une pseudonymisation soignée avec des étiquettes stables suffit déjà à réduire fortement le risque.