IA et données personnelles : ce que le modèle reçoit vraiment
« Est-ce que ChatGPT garde ce que je lui écris ? » La question revient dès qu'on utilise un assistant pour de vrai : rendez-vous médicaux, factures, contrats, courriers administratifs. Ce guide explique ce qui est réellement transmis à un modèle de langage, ce qu'il en reste, ce que le RGPD impose, et quels réflexes changent vraiment quelque chose.
Ce qu'un modèle reçoit quand vous lui écrivez
Un modèle de langage ne consulte pas votre ordinateur : il reçoit un texte, envoyé par l'application que vous utilisez. Ce texte contient plus que votre dernière phrase.
- Votre message, mot pour mot, ponctuation et fautes comprises.
- Une partie de l'historique de la conversation, pour garder le fil.
- Les instructions internes de l'application (le « prompt système »).
- Le contenu des fichiers joints : texte extrait d'un PDF, image transmise à un modèle de vision.
Tout ce qui est dans ce texte quitte votre appareil. Ce qui n'y est pas ne peut pas fuir.
C'est le point clé : la protection ne se joue pas « chez le fournisseur d'IA », elle se joue avant l'envoi, dans l'application qui construit la requête.
Entraînement, conservation, journalisation : trois choses différentes
| Question | Ce que ça signifie |
|---|
| Entraînement | Vos contenus servent-ils à améliorer le modèle ? Sur les API professionnelles, non par défaut ; sur les offres grand public, cela dépend des réglages. |
| Conservation | Combien de temps la requête est-elle stockée ? Souvent quelques jours pour la détection d'abus, puis supprimée. |
| Journalisation | L'application enregistre-t-elle le contenu dans ses journaux techniques ? C'est un choix de l'éditeur, indépendant du fournisseur d'IA. |
Une application peut donc être irréprochable côté fournisseur et fuiter par ses propres journaux. Inversement, une application qui masque les secrets avant l'envoi réduit le risque quel que soit le fournisseur.
Ce que dit le RGPD, en pratique
- Minimisation : ne transmettre que les données nécessaires à la réponse attendue.
- Transparence : savoir quels sous-traitants interviennent (fournisseur d'IA, hébergeur, paiement).
- Droit d'accès et d'effacement : pouvoir consulter et supprimer ce qui est conservé sur vous.
- Limitation de conservation : des durées définies, pas un stockage indéfini « au cas où ».
- Sécurité : chiffrement des identifiants, accès restreint aux données par utilisateur.
Pour un assistant personnel, la minimisation est le levier le plus efficace : un numéro de carte n'aide jamais le modèle à répondre à « déplace mon rendez-vous de mardi ».
Les réflexes qui changent vraiment quelque chose
- Ne collez jamais un identifiant complet quand une partie suffit : « la carte qui finit par 42 » plutôt que les seize chiffres.
- Décrivez un document au lieu de le photographier quand c'est possible.
- Vérifiez que l'application permet de consulter et supprimer ce qu'elle a retenu de vous.
- Préférez une application qui masque les données sensibles avant l'envoi plutôt qu'un accès direct au modèle.
- Relisez la politique de confidentialité pour identifier les sous-traitants et les durées de conservation.
C'est exactement le modèle retenu par Happy Assistant : filtrage automatique des secrets avant l'appel au modèle, avertissement à l'utilisateur avant envoi, mémoire stockée dans l'application et supprimable souvenir par souvenir.
Questions fréquentes
Un assistant IA peut-il être conforme au RGPD ?
Oui, à condition de documenter les sous-traitants, de limiter les données transmises, de définir des durées de conservation et de permettre l'accès et l'effacement.
Faut-il éviter complètement les assistants IA pour les sujets personnels ?
Non. Le risque se réduit fortement dès que l'application filtre les données sensibles avant l'envoi et garde la mémoire de son côté plutôt que chez le fournisseur du modèle.
Une photo est-elle plus risquée qu'un texte ?
Oui. Un texte peut être masqué automatiquement, une image non : tout ce qui est visible sur la photo est transmis, y compris ce qui traîne au second plan.