Quelles IA s’entraînent sur vos données par défaut ? (comparatif)
Comparatif daté au 2026-08-08 : quelles IA (ChatGPT, Claude, Gemini…) entraînent sur vos conversations par défaut, et où trouver l’opt-out.
Quelles IA s’entraînent sur vos données par défaut ? La réponse honnête : ça dépend de l’outil et de la formule. Sur les offres grand public — gratuit, Plus, Pro — plusieurs assistants utilisent vos conversations pour améliorer leurs modèles par défaut. L’opt-out est à activer à la main. Sur les offres API et Entreprise, l’entraînement est en général désactivé par défaut. Le tableau ci-dessous est un instantané daté au 2026-08-08, avec chaque ligne attribuée à son éditeur. Ces politiques changent souvent : vérifiez toujours la page officielle avant de conclure.
La réponse courte, avant le tableau
Retenez d’abord la ligne de partage. Elle explique 90 % des cas.
- Grand public (gratuit, Plus, Pro) : l’entraînement par défaut est fréquent, avec un opt-out à activer manuellement.
- API et Entreprise : l’entraînement est en général désactivé par défaut, encadré par un avenant de traitement des données (DPA).
- L’opt-out ne vaut souvent que pour l’avenir : il n’efface pas les données déjà utilisées.
- Un compte perso de salarié suit les règles grand public, pas les garanties d’une offre entreprise.
Comparatif attribué, au 2026-08-08
Chaque cellule reflète la politique déclarée par l’éditeur, telle que lue au 2026-08-08. Quand une information n’est pas vérifiable, elle est marquée « à vérifier ». Ce n’est pas un jugement : c’est un instantané qui peut bouger.
| Outil | Grand public : entraînement par défaut ? | Opt-out ? | API / Entreprise |
|---|---|---|---|
| ChatGPT (OpenAI) | Oui (Free/Plus/Pro), selon le centre d’aide OpenAI | Oui (réglage « Improve the model for everyone ») | Non par défaut (API, offres entreprise) |
| Claude (Anthropic) | Oui depuis le 28/08/2025 (Free/Pro/Max), selon Anthropic | Oui (Privacy Settings ; exception : convos signalées pour revue sécurité) | Non par défaut (API, Team/Enterprise) |
| Gemini (Google) | Oui, avec revue humaine via « Gemini Apps Activity », selon Google | Oui (désactiver Activity ; réduit aussi l’historique) | Protections renforcées côté Workspace/entreprise |
| Microsoft 365 Copilot | Entreprise : Non (Enterprise Data Protection), selon Microsoft | s.o. (pas d’entraînement des modèles de fondation) | Non (prompts/réponses non utilisés pour l’entraînement) |
| Le Chat (Mistral AI) | Oui (compte gratuit), selon Mistral AI | Oui (réglage de confidentialité) | Non par défaut (Team, Enterprise, API) |
| Perplexity | Oui (Free/Pro/Max), selon Perplexity | Oui (préférences du compte) | Non (Enterprise n’est jamais utilisé) |
| DeepSeek | Oui, avec stockage en Chine (droit chinois), selon DeepSeek | Oui | À vérifier selon le plan |
| Grok (xAI) | Oui (activé par défaut), selon xAI | Oui (deux réglages dédiés) | Conditions entreprise distinctes |
| GitHub Copilot (IDE) | Oui depuis le 24/04/2026 (Free/Pro/Pro+), selon GitHub | Oui | Non (comptes Entreprise/organisation, régis par le DPA) |
Pourquoi ça change, et comment vérifier
Les éditeurs ajustent régulièrement leurs conditions grand public. La CNIL rappelle un cadre utile pour lire ces politiques. Selon la CNIL, le RGPD s’applique dans de nombreux cas aux modèles entraînés sur des données personnelles, du fait de leur capacité de mémorisation. Elle ajoute que les personnes doivent être informées quand leurs données servent à l’entraînement. Voici comment vérifier vous-même, en quatre étapes.
- 1Ouvrez la page de confidentialité de l’outil et repérez la section « entraînement » ou « amélioration des modèles ».
- 2Identifiez votre formule exacte : un réglage grand public diffère souvent d’un contrat API ou entreprise.
- 3Cherchez le réglage d’opt-out et notez s’il ne vaut que pour l’avenir.
- 4Datez votre lecture et reprogrammez une vérification, car la politique peut évoluer sans préavis visible.
Le levier qui ne dépend d’aucun éditeur
Il existe un contrôle qui ne change pas quand les conditions changent : anonymiser les identifiants dans le prompt avant de l’envoyer. Si l’IA ne reçoit qu’un jeton à la place d’un nom ou d’un IBAN, la question « s’entraîne-t-elle dessus ? » perd l’essentiel de son enjeu. C’est un levier que vous gardez en main, quelle que soit la politique du fournisseur. Il réduit l’exposition de vos données ; il ne la supprime pas, et ne remplace pas une mise en conformité.
ONYRI Sanitize applique exactement ce principe. L’extension se greffe sur les sites de chat IA — ChatGPT, Claude, Gemini, Le Chat, Perplexity, Copilot web, DeepSeek, Grok. Elle agit dans votre navigateur, avant l’envoi. Elle ne couvre pas l’autocomplétion d’un IDE, ni les appels IA internes d’un autre outil : c’est une couche sur le prompt de chat, rien de plus.
En résumé, le défaut d’entraînement varie selon l’outil et la formule, et il évolue. Sur le grand public, il est souvent actif ; sur l’API et l’entreprise, rarement. Vérifiez la page de chaque éditeur, car ce comparatif est daté. La défense qui ne dépend d’aucune politique reste la même : anonymiser les identifiants avant l’envoi. ONYRI détecte, remplace par des jetons réversibles, puis restaure la réponse dans votre navigateur. Des jetons réversibles restent de la pseudonymisation : cela réduit l’exposition, sans rendre vos données « anonymes au sens du RGPD ».
Questions fréquentes
- Quelles IA s’entraînent sur mes données par défaut (ChatGPT, Claude, Gemini…) ?
- Ça dépend de l’outil et de la formule, au 2026-08-08. Sur le grand public, plusieurs assistants entraînent par défaut avec un opt-out. Exemples : selon Anthropic pour Claude (Free/Pro/Max), selon Mistral AI pour Le Chat gratuit, selon Perplexity pour ses offres Free/Pro/Max. Sur l’API et l’entreprise, l’entraînement est en général désactivé par défaut. Vérifiez toujours la page en vigueur de l’éditeur.
- L’opt-out efface-t-il les données déjà utilisées pour l’entraînement ?
- En général, non. L’opt-out ne vaut souvent que pour les échanges futurs et n’efface pas ce qui a déjà servi. Certains réglages ont des exceptions : selon Anthropic, des conversations signalées pour revue de sécurité peuvent rester utilisées malgré l’opt-out. D’où l’intérêt d’anonymiser avant l’envoi, plutôt que de compter sur un réglage rétroactif.
- Anonymiser avec ONYRI me met-il en conformité RGPD ?
- Non, pas à soi seul. Les jetons réversibles relèvent de la pseudonymisation : vos données restent personnelles au sens du RGPD. Le bénéfice est concret : vos vraies valeurs ne quittent pas votre navigateur. Cela réduit fortement l’exposition et sert le principe de minimisation, quelle que soit la politique d’entraînement de l’éditeur.
Sources et références
- Updates to Consumer Terms and Privacy Policy (bascule grand public Free/Pro/Max vers l’entraînement par défaut, avec opt-out, 28 août 2025) — Anthropic
- Data, Privacy, and Security for Microsoft 365 Copilot (prompts, réponses et données Microsoft Graph non utilisés pour entraîner les modèles de fondation) — Microsoft
- IA et RGPD : nouvelles recommandations (le RGPD s’applique aux modèles entraînés sur des données personnelles ; information des personnes) — CNIL
Gardez vos données sensibles dans votre navigateur
ONYRI Sanitize détecte et masque vos données sensibles avant l'envoi à l'IA, puis restaure la réponse — du nom à la clé API.