PII-Schwärzung für KI-Prompts
Maskieren Sie Telefonnummern, E-Mail-Adressen, Ausweis- und Kartennummern, IBANs, IP-Adressen und API-Schlüssel, bevor Sie Text in ChatGPT oder eine andere KI einfügen.
Eingabe
Ergebnis
Das Ergebnis erscheint hier.Support-Tickets, Logs und Kunden-E-Mails sind genau die Texte, die man in einen KI-Assistenten kopiert – und sie stecken voller personenbezogener Daten. Dieses Tool findet die Kennungen in einem Text und ersetzt sie, bevor er Ihren Rechner verlässt. Es folgt dem Ansatz von Presidio (data-privacy-stack/presidio, MIT), dem Open-Source-PII-Framework, das bei Microsoft entstanden ist, reduziert auf das, was ein Browser ohne Sprachmodell zuverlässig leisten kann: ein Muster pro Art von Kennung, gefolgt von einem Validator, der Doppelgänger aussortiert – die Luhn-Prüfsumme für Kartennummern, die Prüfziffer nach GB 11643 und ein echtes Geburtsdatum für chinesische Ausweisnummern, die Mod-97-Prüfung für IBANs.
So arbeitet es
- Erkannt werden E-Mail-Adressen; chinesische Mobil- und Festnetznummern; internationale Nummern mit + oder 00; nordamerikanische Nummern in der Form (415) 555-2671; 18-stellige chinesische Personalausweisnummern; Kartennummern; IBANs; IPv4- und IPv6-Adressen; sowie API-Schlüssel von OpenAI, Anthropic, AWS, GitHub, GitLab, Slack, Google und Hugging Face, JWTs und private PEM-Schlüssel.
- Nummerierte Platzhalter wie [PHONE_1] geben demselben Wert jedes Mal denselben Platzhalter, sodass das Modell zwei Kunden weiterhin unterscheiden kann; Sternchen erhalten die vertraute Form, etwa 138****8000; Ersatzwerte sehen echt aus, stammen aber aus Bereichen, die niemals jemandem gehören können.
- Die Fundliste nennt für jeden Eintrag Zeile, Art, maskierten Wert und Ersetzung und zeigt das Original nie vollständig.
- Alles geschieht in Ihrem Browser, und weil dieses Tool sensible Texte verarbeitet, speichert die Website keinen Verlauf davon – auch nicht für angemeldete Mitglieder.
Wohin Ihre Daten gehen
Nirgendwohin. Dieses Werkzeug läuft vollständig in Ihrem Browser: Der eingefügte Text wird von der Seite verarbeitet und weder an einen Server übertragen noch protokolliert.
Dieses Werkzeug verarbeitet Schlüssel und Zugangsdaten. Zu einem Lauf wird deshalb nichts gespeichert, auch nicht in Ihrem eigenen Verlauf.
Was es kostet
Dieses Werkzeug ist kostenlos, ohne Anmeldung und ohne Punkte.
Häufige Fragen
- Findet es Namen und Anschriften?
- Nein. Namen oder Adressen zuverlässig zu erkennen, erfordert ein eigens dafür trainiertes Sprachmodell, und eine musterbasierte Vermutung würde viele übersehen und gewöhnliche Wörter markieren. Lesen Sie den geschwärzten Text vor dem Absenden und ersetzen Sie Namen von Hand; mit nummerierten Platzhaltern bleibt das leicht einheitlich, zum Beispiel [NAME_1].
- Warum wurde eine Nummer nicht erkannt?
- Jeder Treffer muss seinen Validator bestehen: Eine Kartennummer mit falscher Prüfziffer, eine Ausweisnummer mit unmöglichem Geburtsdatum oder eine IBAN, die Mod-97 nicht besteht, wird bewusst in Ruhe gelassen – sie ist keine echte Kennung. Auch reine zehnstellige Nummern ohne Ländervorwahl oder Klammern werden übersprungen, weil Bestellnummern und Zeitstempel genauso aussehen.
- Woher stammen die Ersatzwerte?
- Aus Bereichen, die für Tests reserviert oder per Definition unmöglich sind: user1@example.com, chinesische Mobilnummern, die mit 100 beginnen, US-Nummern im fiktiven Block 555-01xx, Ausweisnummern mit dem nicht existierenden Regionscode 000000 und gültiger Prüfziffer, Kartennummern, die Zahlungsdienstleister als Testkarten veröffentlichen, sowie IPs aus den Dokumentationsbereichen 192.0.2.0/24 und 2001:db8::/32.
- Kann ich die Originalwerte wieder in die Antwort der KI einsetzen?
- Mit nummerierten Platzhaltern geht das von Hand: Behalten Sie die Fundliste und ersetzen Sie [EMAIL_1] und die übrigen Platzhalter in der Antwort. Die Liste zeigt nur maskierte Werte, bewahren Sie also Ihren Originaltext als maßgebliche Quelle für die Zuordnung auf.
Das Open Source dahinter
Dieses Werkzeug ist eine eigenständige Implementierung ohne fremde Bibliothek. data-privacy-stack/presidio (MIT) erledigt dieselbe Aufgabe als Bibliothek — wer sie im eigenen Programm braucht, fängt dort an, statt eine Webseite aufzurufen.
data-privacy-stack/presidioAuch bekannt als
- personenbezogene Daten schwärzen
- PII entfernen
- Text anonymisieren für ChatGPT
- Daten maskieren Tool
- sensible Daten entfernen
- PII Redaction