Schützt ein falscher Name Ihre Daten in der KI?
Den Namen vor ChatGPT durch ein Pseudonym zu ersetzen wirkt clever, schützt aber selten. Warum der manuelle falsche Name scheitert und was wirklich funktioniert.
Einen Namen vor dem Einfügen von Text in ChatGPT, Claude oder Gemini durch ein Pseudonym zu ersetzen, schützt aus zwei Gründen selten: Man lässt die Gewohnheit irgendwann fallen, um Zeit zu sparen, und der Rest des Textes (Geburtsdatum, Adresse, Betrag, seltene Erkrankung) reicht oft aus, um die Person wieder zu identifizieren. Zuverlässiger Schutz bedeutet, jeden Identifikator automatisch durch umkehrbare Token im Browser zu ersetzen — und nicht, einen Namen von Hand zu ändern.
Warum der falsche Name auszureichen scheint
Die Intuition ist naheliegend: Wenn der Name verschwindet, verweisen die Daten auf niemanden mehr. In einem Thread, in dem sich eine Fachkraft darüber sorgte, dass Kolleginnen und Kollegen Patientendaten in eine KI einfügen, fasste ein Kommentar es so zusammen: „Solange sie einen fiktiven Namen einsetzen, verbindet nichts es mit dem echten Patienten, es sollte in Ordnung sein.“ Der Fehler besteht in der Annahme, die Identität stecke allein im Namen.
Die Re-Identifikation hört nicht beim Namen auf
Eine Person wird durch Abgleich wieder identifiziert. Den Namen zu entfernen, aber den Rest zu belassen, hinterlässt einen Fingerabdruck: Oft genügt eine Handvoll Merkmale, um bei einer einzigen Person zu landen.
- Geburtsdatum + Postleitzahl + Geschlecht: Dieses Trio identifiziert einen großen Teil einer Bevölkerung.
- Eine seltene Erkrankung, ein Aufnahmedatum, ein bestimmter Arbeitgeber: jeweils ein eindeutiger Hinweis.
- Nummern, die „kein Name“ sind, aber identifizieren: Sozialversicherung, Aktenzeichen, IBAN, Kennzeichen.
- Der Kontext selbst: Ein detailliert beschriebener Fall kann auf nur eine einzige Person zutreffen.
Das eigentliche Problem: Es ist manuell, also hört man auf
Selbst wenn man dabei bleibt, hat die manuelle Maskierung einen menschlichen Schwachpunkt. Derselbe Thread bringt es unverblümt auf den Punkt: „Manche tun es am Anfang, dann hören sie auf, um Zeit zu sparen.“ Ein Reflex, der von der Disziplin jeder einzelnen Person bei jeder Nachricht abhängt, ist kein Schutz — er ist eine Absicht. Die sensibelsten Daten gehen an dem Tag durch, an dem jemand in Eile ist.
Was funktioniert: jeden Identifikator automatisch tokenisieren
- 1Erkennung: Eine Engine erkennt jeden Identifikator — den Namen, aber auch Daten, Adressen, Nummern, Beträge.
- 2Tokenisierung: Jeder wird durch ein neutrales, konsistentes Token ersetzt, das im lokalen Speicher gehalten wird.
- 3Versand: Nur der tokenisierte Text geht an die KI — nichts verweist mehr auf eine reale Person.
- 4Wiederherstellung: Die Antwort wird in Ihrem Browser detokenisiert und den richtigen Werten zugeordnet.
ONYRI Sanitize macht genau das: Es erkennt alle Identifikatoren (nicht nur den Namen), ersetzt sie durch umkehrbare Token und behält das Mapping im Browser. Der von Hand gesetzte falsche Name wird überflüssig — der Schutz hängt nicht mehr von Ihrer Wachsamkeit bei jedem Prompt ab.
Häufig gestellte Fragen
- Macht ein falscher Name meine Daten im Sinne der DSGVO anonym?
- Nein. Den Namen zu ändern erzeugt „pseudonymisierte“ Daten: Solange die Person re-identifizierbar bleibt (durch Abgleich oder über eine Zuordnungstabelle), sind es personenbezogene Daten, die durch die DSGVO geschützt sind. Anonymisierung im rechtlichen Sinne verlangt, dass die Re-Identifikation unangemessen schwierig geworden ist.
- Es reicht doch sicher, den Namen UND das Geburtsdatum zu ändern?
- Nach wie vor nicht zuverlässig. Die Re-Identifikation entsteht durch Abgleiche: Adresse, Postleitzahl, seltene Erkrankung, Nummern, Kontext. Zwei Felder zu entfernen lässt oft genug Anhaltspunkte übrig. Besser ist eine Engine, die alle Identifikatoren erkennt und maskiert.
- Kann die KI mir mit Token noch helfen?
- Ja. Die Token sind konsistent: Derselbe Wert erhält immer dasselbe Token, sodass das Modell der Argumentation und der Struktur folgt. Nach der Wiederherstellung in Ihrem Browser erhalten Sie eine vollständige Antwort, die den echten Werten zugeordnet ist.
Quellen & Referenzen
Behalten Sie Ihre sensiblen Daten in Ihrem Browser
ONYRI Sanitize erkennt und maskiert Ihre sensiblen Daten, bevor sie die KI erreichen, und stellt anschließend die Antwort wieder her — vom Namen bis zum API-Schlüssel.