Fondamentaux7 min de lecture

Quelles IA s’entraînent sur vos données par défaut ? (comparatif)

Comparatif daté au 2026-08-08 : quelles IA (ChatGPT, Claude, Gemini…) entraînent sur vos conversations par défaut, et où trouver l’opt-out.

Par Pierre de ONYRI
Vos données vous inquiètent ? Anonymisez-les avant l'IA

Quelles IA s’entraînent sur vos données par défaut ? La réponse honnête : ça dépend de l’outil et de la formule. Sur les offres grand public — gratuit, Plus, Pro — plusieurs assistants utilisent vos conversations pour améliorer leurs modèles par défaut. L’opt-out est à activer à la main. Sur les offres API et Entreprise, l’entraînement est en général désactivé par défaut. Le tableau ci-dessous est un instantané daté au 2026-08-08, avec chaque ligne attribuée à son éditeur. Ces politiques changent souvent : vérifiez toujours la page officielle avant de conclure.

La réponse courte, avant le tableau

Retenez d’abord la ligne de partage. Elle explique 90 % des cas.

  • Grand public (gratuit, Plus, Pro) : l’entraînement par défaut est fréquent, avec un opt-out à activer manuellement.
  • API et Entreprise : l’entraînement est en général désactivé par défaut, encadré par un avenant de traitement des données (DPA).
  • L’opt-out ne vaut souvent que pour l’avenir : il n’efface pas les données déjà utilisées.
  • Un compte perso de salarié suit les règles grand public, pas les garanties d’une offre entreprise.

Comparatif attribué, au 2026-08-08

Chaque cellule reflète la politique déclarée par l’éditeur, telle que lue au 2026-08-08. Quand une information n’est pas vérifiable, elle est marquée « à vérifier ». Ce n’est pas un jugement : c’est un instantané qui peut bouger.

OutilGrand public : entraînement par défaut ?Opt-out ?API / Entreprise
ChatGPT (OpenAI)Oui (Free/Plus/Pro), selon le centre d’aide OpenAIOui (réglage « Improve the model for everyone »)Non par défaut (API, offres entreprise)
Claude (Anthropic)Oui depuis le 28/08/2025 (Free/Pro/Max), selon AnthropicOui (Privacy Settings ; exception : convos signalées pour revue sécurité)Non par défaut (API, Team/Enterprise)
Gemini (Google)Oui, avec revue humaine via « Gemini Apps Activity », selon GoogleOui (désactiver Activity ; réduit aussi l’historique)Protections renforcées côté Workspace/entreprise
Microsoft 365 CopilotEntreprise : Non (Enterprise Data Protection), selon Microsofts.o. (pas d’entraînement des modèles de fondation)Non (prompts/réponses non utilisés pour l’entraînement)
Le Chat (Mistral AI)Oui (compte gratuit), selon Mistral AIOui (réglage de confidentialité)Non par défaut (Team, Enterprise, API)
PerplexityOui (Free/Pro/Max), selon PerplexityOui (préférences du compte)Non (Enterprise n’est jamais utilisé)
DeepSeekOui, avec stockage en Chine (droit chinois), selon DeepSeekOuiÀ vérifier selon le plan
Grok (xAI)Oui (activé par défaut), selon xAIOui (deux réglages dédiés)Conditions entreprise distinctes
GitHub Copilot (IDE)Oui depuis le 24/04/2026 (Free/Pro/Pro+), selon GitHubOuiNon (comptes Entreprise/organisation, régis par le DPA)
Instantané au 2026-08-08, chaque ligne attribuée à son éditeur (« selon … »). Les politiques changent souvent — vérifiez la page officielle de chaque outil. « À vérifier » = information non confirmée à cette date.

Pourquoi ça change, et comment vérifier

Les éditeurs ajustent régulièrement leurs conditions grand public. La CNIL rappelle un cadre utile pour lire ces politiques. Selon la CNIL, le RGPD s’applique dans de nombreux cas aux modèles entraînés sur des données personnelles, du fait de leur capacité de mémorisation. Elle ajoute que les personnes doivent être informées quand leurs données servent à l’entraînement. Voici comment vérifier vous-même, en quatre étapes.

  1. 1Ouvrez la page de confidentialité de l’outil et repérez la section « entraînement » ou « amélioration des modèles ».
  2. 2Identifiez votre formule exacte : un réglage grand public diffère souvent d’un contrat API ou entreprise.
  3. 3Cherchez le réglage d’opt-out et notez s’il ne vaut que pour l’avenir.
  4. 4Datez votre lecture et reprogrammez une vérification, car la politique peut évoluer sans préavis visible.

Le levier qui ne dépend d’aucun éditeur

Il existe un contrôle qui ne change pas quand les conditions changent : anonymiser les identifiants dans le prompt avant de l’envoyer. Si l’IA ne reçoit qu’un jeton à la place d’un nom ou d’un IBAN, la question « s’entraîne-t-elle dessus ? » perd l’essentiel de son enjeu. C’est un levier que vous gardez en main, quelle que soit la politique du fournisseur. Il réduit l’exposition de vos données ; il ne la supprime pas, et ne remplace pas une mise en conformité.

ONYRI Sanitize applique exactement ce principe. L’extension se greffe sur les sites de chat IA — ChatGPT, Claude, Gemini, Le Chat, Perplexity, Copilot web, DeepSeek, Grok. Elle agit dans votre navigateur, avant l’envoi. Elle ne couvre pas l’autocomplétion d’un IDE, ni les appels IA internes d’un autre outil : c’est une couche sur le prompt de chat, rien de plus.

Grille de comparaison abstraite : des lignes d’assistants IA face à deux colonnes de pastilles d’état. La colonne « entraîne par défaut » montre des points ambre ; la colonne « contrôle anonymisé » montre des jetons cobalt suivis de coches.
Le comportement par défaut varie d’un outil à l’autre (colonne ambre). Le contrôle qui ne dépend d’aucun éditeur reste le même partout : anonymiser avant l’envoi (jetons cobalt).

En résumé, le défaut d’entraînement varie selon l’outil et la formule, et il évolue. Sur le grand public, il est souvent actif ; sur l’API et l’entreprise, rarement. Vérifiez la page de chaque éditeur, car ce comparatif est daté. La défense qui ne dépend d’aucune politique reste la même : anonymiser les identifiants avant l’envoi. ONYRI détecte, remplace par des jetons réversibles, puis restaure la réponse dans votre navigateur. Des jetons réversibles restent de la pseudonymisation : cela réduit l’exposition, sans rendre vos données « anonymes au sens du RGPD ».

Questions fréquentes

Quelles IA s’entraînent sur mes données par défaut (ChatGPT, Claude, Gemini…) ?
Ça dépend de l’outil et de la formule, au 2026-08-08. Sur le grand public, plusieurs assistants entraînent par défaut avec un opt-out. Exemples : selon Anthropic pour Claude (Free/Pro/Max), selon Mistral AI pour Le Chat gratuit, selon Perplexity pour ses offres Free/Pro/Max. Sur l’API et l’entreprise, l’entraînement est en général désactivé par défaut. Vérifiez toujours la page en vigueur de l’éditeur.
L’opt-out efface-t-il les données déjà utilisées pour l’entraînement ?
En général, non. L’opt-out ne vaut souvent que pour les échanges futurs et n’efface pas ce qui a déjà servi. Certains réglages ont des exceptions : selon Anthropic, des conversations signalées pour revue de sécurité peuvent rester utilisées malgré l’opt-out. D’où l’intérêt d’anonymiser avant l’envoi, plutôt que de compter sur un réglage rétroactif.
Anonymiser avec ONYRI me met-il en conformité RGPD ?
Non, pas à soi seul. Les jetons réversibles relèvent de la pseudonymisation : vos données restent personnelles au sens du RGPD. Le bénéfice est concret : vos vraies valeurs ne quittent pas votre navigateur. Cela réduit fortement l’exposition et sert le principe de minimisation, quelle que soit la politique d’entraînement de l’éditeur.

Sources et références

Gardez vos données sensibles dans votre navigateur

ONYRI Sanitize détecte et masque vos données sensibles avant l'envoi à l'IA, puis restaure la réponse — du nom à la clé API.

À lire aussi