Ein Dokument anonymisieren, bevor Sie es der KI übergeben
Ein Vertrag, Bericht oder PDF, der an die KI übergeben wird, enthält Namen, Adressen und Beträge. Die Methode, um ihn vor ChatGPT, Claude oder Gemini zu anonymisieren.
Damit die KI ein Dokument zusammenfasst, übersetzt oder analysiert, ohne dessen Inhalt preiszugeben, anonymisieren Sie es zuerst: Eine Engine erkennt Namen, Adressen, Beträge und Kennungen, ersetzt sie durch Token, sendet nur den neutralisierten Text und stellt die Antwort anschließend in Ihrem Browser wieder her. ChatGPT, Claude oder Gemini arbeiten mit einem strukturell identischen Dokument, das jedoch von allen identifizierenden Daten befreit ist.
Warum ein Dokument riskanter ist als ein einfacher Prompt
Wenn Sie einen Prompt tippen, wählen Sie Ihre Worte. Wenn Sie ein ganzes Dokument einfügen – Vertrag, Bericht, Schreiben –, senden Sie auch alles mit, was Sie nicht mehr erneut lesen: Unterzeichner, Adressen, Aktenzeichen, Beträge. Ein Dokument ist eine Anhäufung von Kennungen; genau das wird vergessen, wenn man es in einem Block kopiert.
- Identitäten und Kontaktdaten: Unterzeichner, Empfänger, genannte Dritte.
- Aktenzeichen: Vertrags-, Vorgangs- und interne Kennungen.
- Beträge und bezifferte Klauseln, die eine Beziehung oder Situation offenlegen.
- Technische Daten einer Datei: Kopfzeilen, interne Links, Metadaten.
Den Text zu kopieren und einzufügen reicht nicht
Zwei klassische Fallen. Erstens ist manuelles Schwärzen unvollständig: Sie streichen einen Namen durch, übersehen drei weitere, und die Re-Identifizierung kehrt durch Querverweise zurück. Zweitens reicht das optische Verdecken in einem PDF nicht aus – ein darübergelegtes schwarzes Rechteck lässt den Text darunter oft weiterhin auswählbar. Die automatische Erkennung entfernt die Information selbst, nicht nur ihr Erscheinungsbild.
Die Methode: erkennen, tokenisieren, wiederherstellen
- 1Erkennung: Die Engine findet jede Kennung im Dokument, auch solche ohne offensichtliches Schlüsselwort.
- 2Tokenisierung: Jede wird zu einem neutralen, konsistenten Token, der im lokalen Speicher gehalten wird.
- 3Versand: Nur der anonymisierte Text geht an die KI – das identifizierende Dokument wird nicht übertragen.
- 4Wiederherstellung: Die Antwort (Zusammenfassung, Übersetzung, Analyse) wird in Ihrem Browser detokenisiert.
ONYRI Sanitize erkennt die Kennungen eines Dokuments – Identitäten, Kontaktdaten, Aktenzeichen, Beträge, technische Geheimnisse – und stellt die Antwort in Ihrem Browser wieder her. Sie lassen Ihre Dokumente von der KI zusammenfassen, übersetzen oder analysieren, ohne deren sensiblen Inhalt jemals preiszugeben.
Häufig gestellte Fragen
- Wie anonymisiere ich ein Dokument, bevor ich es ChatGPT übergebe?
- Lassen Sie seine Kennungen (Namen, Adressen, Aktenzeichen, Beträge) vor dem Senden erkennen und durch Token ersetzen und stellen Sie die Antwort anschließend in Ihrem Browser wieder her. Die KI arbeitet mit einem neutralisierten, aber strukturell identischen Dokument: Die Zusammenfassung oder Analyse bleibt relevant.
- Genügt es nicht, die sensiblen Stellen im PDF zu schwärzen?
- Nein. Ein auf ein PDF gelegtes schwarzes Rechteck lässt den Text darunter oft auswählbar: Die Information ist für das Auge verborgen, nicht entfernt. Die Anonymisierung ersetzt den Wert selbst durch ein Token und lässt nichts Verwertbares zurück.
- Ist das Dokument nach der Anonymisierung noch verwendbar?
- Ja. Die Token sind konsistent und die Struktur bleibt erhalten, sodass die KI normal argumentiert. Nach der Wiederherstellung in Ihrem Browser erhalten Sie ein vollständiges Ergebnis, das mit den echten Werten verknüpft ist.
Quellen & Referenzen
Behalten Sie Ihre sensiblen Daten in Ihrem Browser
ONYRI Sanitize erkennt und maskiert Ihre sensiblen Daten, bevor sie die KI erreichen, und stellt anschließend die Antwort wieder her — vom Namen bis zum API-Schlüssel.