Bientôt disponible

Anonymiser vos données avant les API ChatGPT, Claude ou Gemini

Vos équipes veulent utiliser les meilleurs modèles du marché, mais ces API envoient vos données chez des éditeurs tiers. Nous développons et testons actuellement une couche d'anonymisation qui masque les données sensibles avant l'envoi, puis les restaure à la réception, afin de limiter les fuites tout en gardant la puissance de ces modèles.

Statut : bientôt disponible — actuellement en phase de test. Les éléments présentés ci-dessous décrivent l'approche que nous validons avant l'ouverture en production.

Le problème : chaque prompt est une fuite potentielle

Dès qu'un utilisateur copie un document dans ChatGPT, Claude ou Gemini, les données quittent votre périmètre : nom, prénom, adresse email, adresse IP, numéro de dossier, données de santé… Ces informations transitent et peuvent être conservées par l'éditeur. Pour beaucoup d'organisations, c'est inacceptable, mais interdire ces outils ne fait que pousser vers le shadow IT.

L'approche que nous testons : masquer, envoyer, restaurer

1

Détection des données sensibles

Un moteur repère automatiquement les données personnelles dans le texte : noms, emails, IP, numéros, adresses…

2

Remplacement par des jetons

Chaque donnée est remplacée par un jeton neutre. Le sens de la phrase est conservé, mais plus aucune information personnelle ne sort.

3

Envoi à l'API tierce

Seul le texte anonymisé est transmis à ChatGPT, Claude ou Gemini. La table de correspondance reste chez vous.

4

Restauration à la réception

À la réponse, les jetons sont remplacés par les vraies valeurs. L'utilisateur reçoit un résultat complet ; l'éditeur n'a jamais vu les données réelles.

L'aller-retour, en un schéma

Seul le texte masqué franchit la frontière. La table de correspondance — la seule clé pour relire les vraies valeurs — ne quitte jamais votre infrastructure.

CHEZ VOUS · votre infrastructure API TIERCE Texte original « Jean Dupont, dossier n°74123 » ① masquage Texte masqué « [PERSONNE_1], dossier [REF_1] » Restauration jetons → vraies valeurs → réponse complète, en clair Table de correspondance [PERSONNE_1] → Jean Dupont la clé — ne sort jamais API tierce ChatGPT · Claude · Gemini ② envoi — uniquement le texte masqué ③ réponse (encore masquée)
L'éditeur ne voit que des jetons ; il n'a jamais accès aux données réelles.

Exemple concret

Texte d'origine (reste chez vous)

« Merci de recontacter Jean Dupont à j.dupont@ville.fr au sujet du dossier n°74123. »

Envoyé à l'API (anonymisé)

« Merci de recontacter [PERSONNE_1] à [EMAIL_1] au sujet du dossier [REF_1]. »

Réponse restaurée (côté utilisateur)

« Un courriel de relance a été rédigé pour Jean Dupont (j.dupont@ville.fr), dossier n°74123. »

Une défense en profondeur, pas une solution miracle

L'anonymisation réduit fortement l'exposition des données personnelles, mais elle ne remplace pas une IA souveraine : la détection n'est jamais parfaite à 100 %, et le canal reste celui d'un éditeur tiers. C'est un excellent complément quand l'usage d'API externes est incontournable.

Pour une maîtrise totale, la meilleure réponse reste l'IA souveraine hébergée en interne, où la question de la fuite ne se pose plus.

Participez à la phase de test

Cette solution sera bientôt disponible (phase de test en cours). Contactez-nous pour être informé de son ouverture ou pour participer aux essais avec vos propres cas d'usage.

Être tenu informé