# Passer des données clients dans une IA sans les perdre en route

> Dossiers clients, contrats, données RH dans une IA : les cinq chemins de fuite, la charte d'usage de la CNIL et l'outil adapté à chaque niveau.


*Ou : la fuite ne ressemble presque jamais à un piratage, elle ressemble à un collègue pressé qui colle un contrat dans la fenêtre la plus proche.*

La réponse courte : les données clients qui fuient par l'IA passent rarement par une attaque. Elles partent par un compte grand public qui entraîne ses modèles, par une conversation conservée plus longtemps que prévu, par une relecture humaine, par un connecteur qui ouvre trop de dossiers, ou par un salarié qui utilise son compte personnel. La parade tient en trois gestes : une charte d'usage qui dit quelles données vont dans quel outil, une offre professionnelle avec un contrat de sous-traitance pour tout ce qui est personnel, et une machine locale ou un fournisseur qui ne garde rien pour le plus sensible. C'est l'application concrète de [la souveraineté des données IA](/guides/gpu-cloud-ia/donnees-souverainete-ia/).

Un exemple suffit à montrer que « supprimé » ne veut pas toujours dire supprimé. En 2025, dans le procès que lui intentait le New York Times, OpenAI a été contraint par une ordonnance de conserver les conversations de ChatGPT Free, Plus, Pro et Team et les données de son API sans accord de conservation nulle, y compris les conversations supprimées et temporaires. [OpenAI indique](https://openai.com/index/response-to-nyt-data-demands/) que cette obligation a pris fin le 26 septembre 2025, mais qu'une partie des données d'avril à septembre 2025 reste conservée. Les offres Enterprise et Edu n'étaient pas concernées. Aucune entreprise ne pouvait prévoir cette ordonnance ; toutes pouvaient choisir une offre qui y échappait.

La CNIL a posé en juillet 2024 une méthode qui tient toujours. Dans [ses recommandations pour déployer une IA générative](https://www.cnil.fr/fr/comment-deployer-une-ia-generative-la-cnil-apporte-de-premieres-precisions), elle demande d'« encadrer les usages en définissant une liste d'utilisations autorisées et interdites », par exemple « ne pas fournir de données personnelles au système », de privilégier des systèmes « locaux, sécurisés et spécialisés », et de former les utilisateurs. Pour un service grand public, elle recommande de ne jamais y partager d'informations confidentielles.

> **Pour qui** : une PME qui veut donner à ses équipes un assistant IA pour les dossiers clients, hébergé en Suisse, sans conservation des requêtes ni entraînement sur leur contenu.
>
> **À partir de** : Euria gratuit avec un compte Infomaniak pour l'usage courant ; 0,20 CHF le million de tokens en entrée pour Mistral Small 4 chez Infomaniak AI Services, hors taxes, pour les outils internes.
>
> **Pour démarrer** : rédiger la charte d'usage en une page, ouvrir Euria pour l'équipe, et réserver Infomaniak AI Services aux traitements automatisés sur les dossiers.

## Données confidentielles et IA : quel outil pour quel niveau de sensibilité

| Données | Outil acceptable | Précaution minimale |
|---|---|---|
| Publiques : fiche produit, article publié, offre d'emploi | tout assistant | aucune |
| Internes sans données personnelles : procédure, note stratégique | offre professionnelle sans entraînement | réglage vérifié, compte de l'entreprise |
| Données clients ordinaires : nom, commande, échange commercial | offre commerciale avec contrat de sous-traitance | pseudonymiser si possible, ligne au registre |
| Données sensibles : santé, justice, ressources humaines, finances personnelles | machine locale ou fournisseur sans conservation, en Europe | pseudonymiser, analyse d'impact, accès limité |
| Secrets d'affaires, contentieux en cours | machine locale | aucun envoi à l'extérieur |

Classement proposé à partir des recommandations de la CNIL de juillet 2024 et des clauses des fournisseurs relevées le 28 septembre 2026.

Les cinq chemins de fuite méritent d'être nommés, parce que chacun a sa parade. Le premier est l'entraînement : un assistant grand public qui apprend de vos conversations peut, en théorie, en restituer des fragments ; l'offre professionnelle ou le réglage de refus le ferme. Le deuxième est la conservation : même sans entraînement, les conversations sont gardées jusqu'à ce que l'utilisateur les supprime chez la plupart des éditeurs, puis effacées dans un délai de trente jours, parfois plus tard sur ordre d'un juge. Le troisième est la relecture humaine : chez Google, les conversations Gemini relues par des humains restent jusqu'à trois ans, même quand l'utilisateur efface son activité.

Le quatrième est le connecteur. Brancher un assistant sur la messagerie, le stockage ou le CRM lui donne accès à tout ce que l'utilisateur voit ; la CNIL rappelle que l'entreprise qui connecte sa propre base de connaissance devient responsable de ce traitement. Le cinquième, le plus banal, est le compte personnel : un salarié qui n'a pas d'outil fourni en trouvera un gratuit. La meilleure protection contre ce risque est un outil officiel qui fonctionne bien.

Un dernier point, souvent ignoré : les utilisateurs aussi peuvent être visés. L'autorité italienne de protection des données a adressé un avertissement, mentionné dans son rapport d'activité 2025, aux utilisateurs de plateformes capables de produire des hypertrucages, dont Grok, ChatGPT et Clothoff. La responsabilité ne s'arrête pas au fournisseur.

Ma recommandation : une charte d'une page affichée dans l'outil lui-même, un assistant professionnel fourni à tous pour que personne n'aille chercher ailleurs, les dossiers sensibles traités en local ou chez un fournisseur européen qui ne conserve rien, et une pseudonymisation dès qu'un document quitte l'entreprise.

![Illustration : réseau de tuyaux de cuivre dans une salle des machines sombre, une lumière ambrée circulant à l'intérieur, une seule jointure laissant échapper une fine lueur bleu froid](/images/donnees-clients-ia-sans-fuite-tuyaux.original.webp "On surveille les grosses canalisations ; la fuite vient d'une jointure qu'on croyait serrée.")

### Si vous voulez retirer les noms avant l'envoi

La pseudonymisation réduit ce qui part, sans vous dispenser du RGPD. La méthode en six étapes est dans [anonymiser des données avant l'IA](/guides/gpu-cloud-ia/donnees-souverainete-ia/anonymiser-pseudonymiser-avant-ia/).

### Si vous envisagez de tout garder en interne

Une machine locale ne laisse rien sortir, mais elle a un prix, et il a monté. Le calcul est dans [l'IA locale face au cloud](/guides/gpu-cloud-ia/donnees-souverainete-ia/ia-locale-vs-cloud-garder-chez-soi/).

### Si vous voulez comprendre le trajet complet

Du clavier au serveur, chaque étape d'une requête a ses copies et ses intermédiaires. Le parcours est dans [le voyage d'un prompt](/guides/gpu-cloud-ia/donnees-souverainete-ia/ou-partent-vos-prompts/).


---

Cette page contient des liens d'affiliation. Si tu souscris via ces liens, je peux toucher une commission sans coût supplémentaire pour toi. Mon avis reste indépendant et basé sur mon usage réel des outils que je recommande.


---

**Tarifs :** prix relevés le 28 septembre 2026 sur les sites officiels des fournisseurs, dans la devise qu'ils affichent : dollars américains pour les plateformes américaines, euros hors taxes pour les européennes. Les tarifs du GPU bougent souvent, et sur une place de marché chaque hôte fixe son prix : les montants cités peuvent avoir changé depuis cette date.

