Frederik von der Heyden

Intelligente Systeme

DSGVO Shield

Eine API, die europäische Texte auf personenbezogene Daten prüft. IBAN, Steuer-ID, Personnummer und weitere Identifikatoren aus 10 Ländern. Mathematische Prüfsummen statt KI-Raten. Antwort in unter einer Millisekunde.

Projekt im Detail

!

Problem

Textpipelines verarbeiten Kundennachrichten, Support-Tickets und KI-Ausgaben. Personenbezogene Daten rutschen dabei in Logs, Analytics und Drittsysteme.

Lösung

Ein API-Call vor der Weiterverarbeitung klassifiziert den Text. Die Antwort sagt, ob und welche Art personenbezogener Daten enthalten sind. Mathematische Prüfsummen reduzieren Fehlalarme.

Ergebnis

Teams können ihre Pipelines um einen Klassifikationsschritt erweitern, ohne eigene Erkennungslogik bauen zu müssen. 400 Testfälle, Sub-Millisekunde, kein Datenversand an Dritte.

Was die Lösung kann

01

Dreistufige Klassifikation

Jeder Text wird als SICHER (bestätigt personenbezogen), PRÜFEN (möglicherweise personenbezogen) oder FREI (kein PII) eingestuft. Klare Grenzen, kein Graubereich.

02

Mathematische Validierung

IBANs werden mit Mod97 validiert, Kreditkarten mit Luhn, niederländische BSN mit Elfproef, polnische PESEL mit gewichteten Prüfsummen. Pattern-Matching plus mathematischer Beweis.

03

10 europäische Länder

Deutschland, Frankreich, Niederlande, Spanien, Italien, Polen, Österreich, Belgien, Portugal, Schweden. Jedes Land-Modul kennt die eigenen Formate und Konventionen.

04

Sub-Millisekunde

Kein LLM-Inferenz, keine Netzwerk-Calls an Dritte. Reines Pattern-Matching und Prüfsummen-Validierung. Typische Antwortzeit unter 0,5 ms.

Kennzahlen

10

Länder

400

Testfälle

<1

ms Latenz

0

Externe Calls

Tech-Stack

PythonFastAPISQLiteStripeDockerTraefik

PII-Klassifikation für Ihre Pipeline?

API-Key in 60 Sekunden. Bezahlen, Key per E-Mail erhalten, loslegen.

Jetzt starten

Projekt im Kopf? Lassen Sie uns 30 Minuten reden.

Termin vereinbaren