Accueil › Blog › Anonymiser avant ChatGPT

Anonymiser un document avant de l'envoyer à ChatGPT ou une IA

Avant de coller un contrat, un CV ou un dossier client dans ChatGPT, Claude, Copilot ou Gemini, retirez les noms, adresses, e-mails et passages confidentiels. Une fois le texte envoyé, vous ne contrôlez plus ce qu'il devient.

Publié le 26 septembre 2026 · 8 min de lecture

Pourquoi anonymiser un document avant de le donner à une IA

Un contrat, un CV, un compte rendu médical ou un dossier client contient des noms, des adresses, des numéros de téléphone, parfois des secrets d'affaires. Dès que vous collez ce texte dans une IA généraliste comme ChatGPT, Claude, Copilot ou Gemini, ces informations quittent votre poste et transitent par les serveurs d'un tiers. Vous ne savez plus précisément où elles sont stockées, combien de temps, ni qui peut y avoir accès en interne chez le fournisseur.

Anonymiser ou pseudonymiser le document avant l'envoi — remplacer « Marie Dupont » par « PERSONNE 1 », une adresse par « ADRESSE 1 » — permet d'utiliser l'IA pour résumer, reformuler ou analyser un texte sans exposer l'identité des personnes concernées. C'est une précaution simple, qui ne coûte rien et qui s'applique aussi bien à un usage personnel qu'à un usage professionnel soumis au RGPD.

Ce que les IA font (ou peuvent faire) de vos documents

Les politiques varient selon l'éditeur et surtout selon l'offre utilisée. Sur les versions grand public gratuites ou payantes, il est fréquent que les conversations puissent servir à améliorer les modèles, sauf si vous désactivez cette option dans les paramètres de confidentialité. Sur les offres entreprise (API, ChatGPT Enterprise, Team avec la bonne configuration, Copilot en contexte professionnel), les fournisseurs indiquent généralement ne pas utiliser les données pour l'entraînement.

Dans les deux cas, le document a quitté votre machine. Il a été lu, traité, potentiellement journalisé à des fins de sécurité ou de support technique. Si le fournisseur subit une faille, ou si un employé accède aux journaux pour du débogage, vos données confidentielles y sont exposées. Ce n'est pas une accusation contre un éditeur en particulier : c'est la nature même d'un service en ligne, IA ou non.

Le point clé : une fois envoyée, une donnée n'est plus sous votre contrôle exclusif. Anonymiser en amont, avant l'envoi, est la seule méthode qui élimine ce risque à la source plutôt que de faire confiance a posteriori à la politique de confidentialité du fournisseur.

Que faut-il retirer avant d'envoyer un document à une IA

Selon le type de document, la liste change, mais on retrouve toujours les mêmes familles d'informations :

Une bonne pratique consiste à remplacer chaque occurrence par une étiquette stable plutôt que par un simple « [confidentiel] » : si « Marie Dupont » devient systématiquement « PERSONNE 1 » partout dans le document, l'IA peut toujours comprendre qui fait quoi dans le texte, ce qui préserve l'utilité de l'analyse tout en supprimant l'identité réelle.

Méthode manuelle et gratuite pour anonymiser un document

Si le document est court ou que vous n'avez pas encore d'outil dédié, une anonymisation manuelle reste possible :

  1. Faites une copie du fichier original, ne travaillez jamais sur la seule version source.
  2. Repérez chaque donnée sensible avec la fonction de recherche de votre traitement de texte ou de votre lecteur PDF (Ctrl/Cmd+F sur les noms connus, puis relecture complète pour le reste).
  3. Remplacez par des étiquettes cohérentes : « PERSONNE 1 », « PERSONNE 2 », « ORGANISATION 1 », en gardant la même étiquette pour la même entité tout au long du texte.
  4. Si le document est un PDF avec des passages à cacher plutôt qu'à remplacer, utilisez un vrai caviardage : Adobe Acrobat Pro (Outils › Caviarder), Aperçu sur Mac (Outils › Caviarder) ou LibreOffice Draw (Outils › Caviarder), puis vérifiez le fichier final par un copier-coller. Un simple rectangle noir dessiné par-dessus le texte ne suffit pas : le texte reste sélectionnable dessous dans la plupart des cas.
  5. Relisez l'intégralité du document avant de l'envoyer à l'IA, y compris les métadonnées (propriétés du fichier) et les commentaires ou notes de révision qui peuvent contenir des noms.

Ces outils gratuits font le travail correctement si vous prenez le temps de la relecture. Leur limite : tout est manuel, ce qui devient long et source d'oubli dès que le document dépasse quelques pages ou qu'il faut traiter plusieurs fichiers.

Anonymiser un document avec AnonymFiles avant de l'envoyer à une IA

AnonymFiles est une application de bureau pour Mac (Apple Silicon) et Windows qui automatise cette étape. Ce serait un comble de passer par un service en ligne pour préparer ce qui partira vers une IA : AnonymFiles est donc 100 % hors ligne, sans compte, sans vérification de licence, sans télémétrie et sans chat IA dans le cloud. Rien ne quitte votre ordinateur tant que vous n'avez pas décidé vous-même d'envoyer une copie.

Le fonctionnement : vous déposez un dossier entier (PDF contenant du texte, Word .docx, .txt, .md), l'application détecte les personnes, organisations, adresses, e-mails, téléphones et IBAN, puis les remplace par des étiquettes stables comme « PERSONNE 1 » ou « ORGANISATION 1 », identiques d'un fichier à l'autre. Vous comparez ensuite chaque original à sa copie côte à côte, caviardez à la main ce que la détection automatique aurait manqué, validez pièce par pièce, puis exportez des copies propres, avec des noms de fichiers neutres. La table de correspondance entre étiquettes et identités ne part jamais avec les copies : elle reste sur votre ordinateur, et sert à remettre les vrais noms dans la réponse de l'IA une fois celle-ci récupérée. Les PDF scannés et les images ne sont pas encore lus : l'app les signale et les exclut.

Les copies exportées sont alors prêtes à être collées dans ChatGPT, Claude ou un autre assistant : le texte garde sa structure et sa logique, mais plus aucune identité réelle. Si vous travaillez avec Claude ou un autre agent compatible MCP, vous pouvez aussi lui donner accès au dossier via le serveur MCP local d'AnonymFiles : l'agent ne lit que les copies caviardées, jamais les originaux. Relisez tout de même les copies avant de les confier à une IA : aucune détection automatique n'est parfaite.

Anonymisez avant de coller dans une IA

AnonymFiles anonymise un dossier entier sur votre Mac ou PC, 100 % hors ligne : sans vérification de licence, sans télémétrie, sans chat dans le cloud. Bientôt disponible sur Mac et Windows.

Découvrir AnonymFiles

Cas particuliers : code, tableurs, e-mails, contrats

Un contrat ou une pièce judiciaire pose un problème spécifique : les noms des parties reviennent souvent des dizaines de fois, y compris dans des formules indirectes (« le bailleur », « la société venderesse représentée par M. X »). Vérifiez que toutes les variantes d'un même nom sont couvertes par la même étiquette.

Un tableur exporté en texte pour une IA doit être vérifié colonne par colonne : une colonne « Client » ou « Email » entière peut passer inaperçue si vous ne relisez que les premières lignes.

Un e-mail collé dans une IA contient presque toujours une signature avec nom, fonction, téléphone et parfois adresse : pensez à la retirer, pas seulement le corps du message.

Du code source peut contenir des clés d'API, des mots de passe en dur ou des noms de domaine internes : ce ne sont pas des données personnelles au sens du RGPD, mais ce sont des secrets qui ne doivent pas non plus finir dans les journaux d'un fournisseur d'IA.

Erreurs à éviter

Ne faites pas confiance à un simple surlignage noir ou à une suppression visuelle du texte dans un PDF : dans de nombreux cas, le texte masqué reste sélectionnable et copiable en dessous. En janvier 2019, un dépôt judiciaire dans une affaire concernant Paul Manafort avait ainsi laissé lire par copier-coller des passages censés être caviardés, alors qu'ils n'étaient que recouverts visuellement.

Pour aller plus loin sur la définition exacte des termes utilisés ici, la différence entre anonymisation et pseudonymisation selon le RGPD mérite d'être connue avant de choisir son niveau de précaution. Si le document à traiter est une pièce de dossier judiciaire, consultez aussi notre guide sur l'anonymisation d'un jugement ou de pièces judiciaires. Et pour la méthode générale de traitement d'un PDF, voir comment anonymiser un PDF gratuitement.

Questions fréquentes

Est-ce que ChatGPT garde mes documents ?

Cela dépend du produit et des réglages. Sur le grand public, les conversations peuvent être utilisées pour améliorer les modèles sauf désactivation dans les paramètres ; sur les offres entreprise (API, ChatGPT Enterprise, Team avec les bons réglages), OpenAI indique ne pas entraîner ses modèles sur ces données. Dans tous les cas, un fichier envoyé quitte votre machine et transite par les serveurs du fournisseur : la seule garantie totale contre la fuite reste de ne pas l'envoyer tel quel.

Anonymiser un document rend-il son usage avec une IA sans risque ?

Non, cela réduit le risque, ça ne l'annule pas. Une anonymisation mal faite peut laisser des indices qui permettent de ré-identifier une personne (un nom propre oublié dans un tableau, un numéro de dossier unique, une combinaison de détails rares). Relisez toujours le résultat avant de l'envoyer, et gardez à l'esprit que l'IA elle-même peut recouper des informations.

Puis-je utiliser ChatGPT pour anonymiser mon document ?

Ce serait envoyer les données confidentielles à l'IA avant même de savoir si elle est autorisée à les recevoir, ce qui annule l'intérêt de l'anonymisation. Il faut retirer les données sensibles avant d'utiliser l'IA, pas pendant, avec un outil qui tourne sur votre poste ou dont vous maîtrisez le traitement.

Quelle différence entre anonymiser et pseudonymiser un document pour une IA ?

La pseudonymisation remplace les identifiants par des codes ou des étiquettes réversibles : quelqu'un qui a la clé peut retrouver qui est qui, donc le RGPD continue de s'appliquer (article 4(5)). L'anonymisation vise à rendre la ré-identification impossible ; si elle est réussie, le document sort du champ du RGPD (considérant 26). Pour un usage IA courant, une pseudonymisation soignée avec des étiquettes stables suffit déjà à réduire fortement le risque.