Gescannte Dokumente schwärzen: So geht es bei Scans und Fotos
Ein Scan ist ein Bild: Schwärzen braucht OCR und eine Kontrolle von Hand. So scannen Sie gut, entfernen versteckten Text und prüfen die fertige Datei.
Ein gescanntes Dokument ist ein Foto einer Seite. Um es sicher zu schwärzen, decken Sie jede sensible Stelle mit einem deckenden Balken ab und exportieren die Seite als neues, flaches Bild. So bleibt darunter nichts übrig. Ist die Datei ein durchsuchbares PDF, muss auch ihre unsichtbare Textebene weg.
Das gilt für einen Büroscan ebenso wie für ein Handyfoto. Unser Beispiel ist die erfundene Mieterin Erika Mustermann. Sie muss einem Vermieter einen gescannten Kontoauszug schicken, ohne ihre Kontonummer zu zeigen.
Was unterscheidet ein gescanntes PDF von einem normalen PDF?
Ein normales PDF speichert echte Zeichen, die Sie markieren, kopieren und durchsuchen können. Ein gescanntes PDF speichert von jeder Seite ein Bild. Der Computer sieht Punkte, keine Buchstaben: Die Suche nach Erika findet nichts. Die Software muss zuerst eine Texterkennung (OCR) ausführen, die Buchstaben anhand ihrer Form errät. Drei schnelle Tests zeigen, welche Datei Sie vor sich haben.
- Markieren Sie ein Wort. Wird die ganze Seite als Block markiert, ist sie ein Bild.
- Suchen Sie ein sichtbares Wort. Kein Treffer heißt: keine Textebene.
- Lassen sich auf einer klar gescannten Seite Wörter markieren, ist es ein durchsuchbares PDF. Lesen Sie den nächsten Abschnitt.
Warum kann ein gescanntes PDF noch versteckten Text enthalten?
Viele Scanner und PDF-Programme führen die OCR von selbst aus. Sie behalten das Bild und legen die erkannten Wörter als unsichtbaren Text dazu, den Suche und Kopieren nutzen. Laut der Dokumentation von OCRmyPDF, einem quelloffenen OCR-Programm, machen die meisten OCR-Werkzeuge eine gescannte Seite so durchsuchbar.
Angenommen, Erika zeichnet auf dem Bild einen schwarzen Balken über ihre Kontonummer. Die Seite sieht sicher aus, doch der unsichtbare Text enthält die Nummer weiter. Die Sächsische Datenschutz- und Transparenzbeauftragte warnt: Oft muss man die vermeintlich geschwärzten Inhalte nur markieren und in einen Texteditor kopieren, schon ist alles wieder lesbar.
Was übersieht die OCR auf einer gescannten Seite?
OCR ist eine Schätzung. Auf einem schlechten Scan liest sie falsch, und die Erkennung findet keinen falsch gelesenen Wert. Ist ein Buchstabe von Erikas IBAN falsch, übersieht ein Detektor vielleicht die ganze IBAN.
| Problem | Was passiert | Was Sie tun |
|---|---|---|
| Geringe Auflösung | Laut seiner Dokumentation arbeitet Tesseract am besten ab 300 dpi. | Mit 300 dpi oder mehr neu scannen. |
| Schiefe Seite | Schräglage verschlechtert die Zeilenerkennung deutlich, heißt es dort. | Seite gerade auflegen oder geraderichten. |
| Dunkle Ränder | Sie können als zusätzliche Zeichen gelesen werden. | Deckel schließen oder Ränder zuschneiden. |
| Handschrift | Laut seiner Dokumentation erkennt OCRmyPDF keine Handschrift. | Von Hand schwärzen. |
| Stempel, Unterschriften, Logos | Laut Adobe hat OCR Mühe, wenn Text und Grafik gemischt sind. | Von Hand schwärzen. |
Wie scannen Sie eine Seite, bevor Sie sie schwärzen?
- 1Scannen Sie mit 300 dpi, bei sehr kleiner Schrift mit mehr.
- 2Legen Sie die Seite flach und gerade auf.
- 3Wählen Sie Graustufen oder Farbe bei blassem Druck. Reines Schwarzweiß kann hellen Text verlieren.
- 4Halten Sie das Smartphone gerade über die Seite. Adobe rät zu gutem Licht und einem geraden Dokument.
- 5Prüfen Sie den Scan in voller Größe. Was Sie kaum lesen können, liest auch die OCR kaum.
Wie schwärzen Sie Handschrift, Unterschriften und Stempel?
Von Hand. Kein automatischer Detektor findet eine Randnotiz, eine Unterschrift oder einen Namen in einem runden Stempel. Legen Sie über jede dieser Stellen einen deckenden Balken, etwas größer als der Text: Schon die Unterlänge eines Buchstabens kann einen Namen verraten.
Denken Sie auch an Bilder: Ein Ausweisfoto, ein Barcode oder ein QR-Code verraten eine Person ebenso. Vorsicht beim Schwärzen mit Stift auf Papier. Laut dem Landesbeauftragten für den Datenschutz Niedersachsen bleibt der Text häufig lesbar, etwa gegen eine Lampe gehalten. Er rät, die Stellen zu überkleben oder auszuschneiden und nur eine Kopie weiterzugeben.
Wie prüfen Sie, ob die Schwärzung wirklich hält?
Verlassen Sie sich nicht nur auf Ihre Augen. Testen Sie die fertige Datei, nicht die Arbeitskopie.
- 1Markieren Sie alles, kopieren Sie es und fügen Sie es in einen einfachen Texteditor ein. Erscheint ein geschwärzter Wert, ist die Textebene noch da.
- 2Suchen Sie in der Datei nach den geschwärzten Werten, etwa dem Nachnamen.
- 3Versuchen Sie, einen schwarzen Balken zu verschieben. Bewegt er sich, ist er nur ein Kommentar.
- 4Vergrößern Sie die Ansicht und erhöhen Sie den Kontrast. Laut der sächsischen Aufsichtsbehörde wurden Stiftschwärzungen schon so wieder lesbar gemacht.
- 5Prüfen Sie die Metadaten: Autor, Titel und bei Fotos Datum und Ort. Dazu rät auch der niedersächsische Landesbeauftragte.
- 6Lassen Sie die Datei gegenlesen. Die ICO empfiehlt eine solche Zweitprüfung.
Bewahren Sie den Originalscan sicher und klar beschriftet auf, wie es die ICO rät. Eine gute Schwärzung lässt sich nicht rückgängig machen. Auch Fehler haben Folgen: Werden personenbezogene Daten versehentlich offengelegt, kann das eine Datenpanne sein. Nach Artikel 33 DSGVO ist sie möglichst binnen 72 Stunden der Aufsichtsbehörde zu melden, es sei denn, sie führt voraussichtlich zu keinem Risiko.
Welche Werkzeuge schwärzen einen Scan richtig?
Mehrere Wege funktionieren, solange das Ergebnis flach ist. Für PDFs nennt die ICO das Schwärzungswerkzeug von Adobe Acrobat, ersatzweise schwarze Rechtecke auf der gescannten Seite mit anschließendem Umweg über BMP. Für Bilder raten die sächsische und die niedersächsische Aufsichtsbehörde zu deckenden Balken in einem Format ohne Ebenen wie JPG.
Stand September 2026 erklärt die Dokumentation von OCRmyPDF, wie man eine unsichtbare Textebene entfernt oder jede Seite als Bild neu aufbaut. Auch ohne Software geht es: ausdrucken, schwärzen, einscannen, prüfen. Die sächsische Aufsichtsbehörde nennt diesen Weg ausdrücklich.
Werkzeuge, die im Browser laufen, sind ein weiterer Weg. ONYRI Sanitize zum Beispiel liest Scans per OCR auf Ihrem Gerät, auf Deutsch, Englisch oder Französisch. Die Datei wird nicht hochgeladen. Sie prüfen jeden gefundenen Wert, und der Export ist immer ein flaches PDF oder PNG ohne Textebene. Geschwärzt wird nur Text, den die OCR lesen konnte: Handschrift und Unterschriften werden nicht gelesen, ein Stempel kann ihr entgehen. Kein Werkzeug ersetzt die Schlusskontrolle.
Ist ein geschwärzter Scan anonym?
Nicht automatisch. Ein seltener Beruf, ein Datum oder ein kleiner Ort können weiter auf eine Person zeigen. Namen durch Platzhalter wie NAME1 zu ersetzen, ist eine Form der Pseudonymisierung nach Artikel 4 Nr. 5 DSGVO. Laut Erwägungsgrund 26 sind solche Daten weiter als Informationen über eine identifizierbare Person zu betrachten.
Sehen Sie das Schwärzen deshalb als Weg, weniger weiterzugeben, im Sinne der Datenminimierung nach Artikel 5 Abs. 1 Buchst. c DSGVO. Es senkt das Risiko. Es ersetzt nicht Ihre übrigen Pflichten.
Häufige Fragen
- Kann ich einfach einen schwarzen Balken auf ein gescanntes PDF zeichnen?
- Nur, wenn die Datei danach flach gerechnet wird. Ein Balken als Kommentar lässt sich verschieben, und in einem durchsuchbaren PDF bleibt der OCR-Text darunter. Schwärzen Sie, exportieren Sie eine neue flache Datei und machen Sie den Kopiertest.
- Mit welcher Auflösung sollte ich ein Dokument zum Schwärzen scannen?
- Beginnen Sie mit 300 dpi: Laut seiner Dokumentation arbeitet Tesseract ab dieser Auflösung am besten. Eine gerade Seite und weiße Ränder zählen genauso viel.
- Ist das Foto eines Dokuments sicherer als ein PDF?
- Ein Foto hat keine Textebene. Das nimmt ein Risiko weg. Aber es kann Metadaten tragen, laut der sächsischen Aufsichtsbehörde etwa GPS-Position, Datum und Uhrzeit der Aufnahme. Zudem kann jeder später eine OCR darüber laufen lassen. Schwärzen Sie, exportieren Sie ein neues flaches Bild und prüfen Sie die Metadaten.
Quellen und Verweise
- Hinweise zum Schwärzen von Dokumenten — Der Landesbeauftragte für den Datenschutz Niedersachsen
- Datenschutzkonformes Schwärzen: Darauf sollten Sie achten! (30.08.2024) — Sächsische Datenschutz- und Transparenzbeauftragte
- Verordnung (EU) 2016/679 (DSGVO), Art. 4 Nr. 5, Art. 5 Abs. 1 Buchst. c, Art. 33, Erwägungsgrund 26 — EUR-Lex
- How do we avoid an accidental breach when redacting information? (englisch) — Information Commissioner's Office (ICO)
- Improving the quality of the output (englisch) — Tesseract-OCR-Dokumentation
- Cookbook: OCR-Textebene aus einem PDF entfernen (englisch) — OCRmyPDF-Dokumentation
- Introduction: Grenzen (englisch) — OCRmyPDF-Dokumentation
- How to scan and get text from an image with OCR (englisch) — Adobe Acrobat
Maskieren Sie ein Dokument, ohne es hochzuladen
ONYRI Sanitize findet Namen, Kennungen, Bankdaten und Geheimnisse in einer PDF, einer Word-Datei oder einem Scan und maskiert sie in Ihrem Browser. Sie prüfen die Vorschau und laden dann eine reduzierte Bildkopie herunter.