Ein PDF oder Word-Dokument schwärzen
Die Nummern, Adressen und Namen, die Sie schwärzen, werden aus der Datei entfernt, nicht nur verdeckt. Nichts wird gesendet.
So läuft es ab
Legen Sie das Dokument ab
Ein PDF oder ein Word-Dokument (.docx). Ihr Browser liest es, in diesem Tab. Die Vorschläge erscheinen nach wenigen Sekunden.
Entscheiden Sie jeden Vorschlag
Rechts die Vorschläge nach Art gruppiert, auf der Seite hervorgehoben. Schwärzen, belassen, einen Namen überall schwärzen, einen Bereich zeichnen. J und K zum Wechseln zwischen den Vorschlägen, M zum Schwärzen, L zum Belassen, Strg+Z zum Rückgängigmachen.
Erstellen Sie die Datei
Die Schaltfläche wird aktiv, wenn alles entschieden ist. Das Werkzeug baut das Dokument neu, liest es gegen und bietet es Ihnen dann an: Gespeichert wird über Ihren Browser.
Was erkannt wird, und wie
| Angabe | Prüfung |
|---|---|
| Namen von Personen und Firmen | Ein Modell, das in Ihrem Browser läuft, einmal von dieser Website heruntergeladen und geprüft; die Schreibweisen derselben Person werden zusammengefasst |
| IBAN | Länge je Land und Prüfziffer Modulo 97 |
| RIB (französische Bankverbindung) | Schlüssel des RIB |
| NIR (französische Sozialversicherungsnummer) | Zweistellige Prüfziffer, Korsika eingeschlossen (2A, 2B) |
| SIREN, SIRET (französische Unternehmensnummern) | Luhn-Prüfziffer, mit der Ausnahme für Niederlassungen von La Poste |
| Umsatzsteuer-ID | Aus der SIREN berechnete Prüfziffer |
| Bankkarte | Luhn-Prüfziffer und bekanntes Präfix |
| Telefon, E-Mail, IP-Adresse | Format |
| Postanschrift | Hausnummer, Straßentyp, Postleitzahl und Gemeinde |
| Geburtsdatum | Nur wenn der Text „geboren am“, „Geburtsdatum“ sagt |
| Kfz-Kennzeichen, Reisepass, Steuernummer | Format, mit dem Kontext, wenn es mehrdeutig ist |
Ein richtiges Format mit falscher Prüfziffer wird als „zu prüfen“ vorgeschlagen: Oft ist es ein Tippfehler im Dokument, und die Angabe bleibt personenbezogen. Sammelentscheidungen berühren nie, was zu prüfen ist.
Word-Dokumente
Ein Word-Dokument ist ein Archiv aus Dateien: der Text, aber auch nachverfolgte Änderungen, Kommentare, Eigenschaften (Autor, Firma), Felder und Links. Ein Name, der in einem dieser Teile steckt, übersteht ein Suchen und Ersetzen.
Klarmask bereinigt das Dokument nicht: Es schreibt ein neues, nur mit den Teilen, die es versteht. Überarbeitungen werden angenommen (gelöschter Text verschwindet samt Autor), Kommentare und Eigenschaften werden entfernt, und jeder geschwärzte Wert wird überall ersetzt, wo er steht: im Text, auch wenn er über mehrere Formatierungsabschnitte verteilt ist, in Kopf- und Fußzeilen, Fußnoten, Textfeldern, Feldern, im Alternativtext von Bildern und in der Adresse von Links.
Die erstellte Datei wird wie ein PDF gegengelesen: Jeder Absatz, jedes Attribut und jedes Bild wird durchlaufen, und die Struktur des Pakets wird geprüft, bevor sie Ihnen angeboten wird.
Was es nicht tut
- Alle Namen sicher finden. Das Modell schlägt welche vor, es kann welche übersehen: „Überall schwärzen“ schwärzt einen vergessenen Namen im ganzen Dokument, auch wenn er am Zeilenende getrennt ist.
- Dokumente in anderen Sprachen gleich gut lesen. Die Erkennung ist auf französische Dokumente abgestimmt: französische Kennungen (NIR, SIREN, SIRET, Steuernummer), Telefonnummern und Adressen im französischen Format, ein auf Französisch trainiertes Namensmodell. In deutschen und anderen Texten werden Namen möglicherweise seltener vorgeschlagen.
- Einen Scan lesen: Ein PDF ohne Text liefert keine Vorschläge, zeichnen Sie die Bereiche von Hand.
- Ein passwortgeschütztes PDF öffnen: Entfernen Sie zuerst den Schutz.
- Links, Formulare und Barrierefreiheits-Tags der Seiten eines PDF erhalten: Sie werden als Bild gerendert.
- Den Inhalt von Bildern in einem Word-Dokument lesen: Eine Unterschrift oder ein Stempel auf einem Bild bliebe sichtbar. Aktivieren Sie in diesem Fall „Bilder entfernen“.
- Diagramme und eingebettete Objekte eines Word-Dokuments erhalten: Sie werden entfernt. Eine .doc-Datei (Word 97-2003) öffnen: Speichern Sie sie zuerst als .docx.