Server in Deutschland
Eure Daten liegen auf Infrastruktur in Deutschland. Jeder Kunde bekommt eine dedizierte Umgebung, keine geteilte Mandanten-Instanz.
Auch mit den Modellen amerikanischer Hersteller. Wie das technisch geht, steht auf dieser Seite: nachvollziehbar, gemessen und rechtlich eingeordnet.
Die Grundlage ist keine Zusicherung auf Papier, sondern die Architektur selbst. Rechenweg, Speicher und Schlüssel bleiben innerhalb der EU.
Eure Daten liegen auf Infrastruktur in Deutschland. Jeder Kunde bekommt eine dedizierte Umgebung, keine geteilte Mandanten-Instanz.
Die Modelle laufen auf EU-Infrastruktur: AWS Bedrock in Frankfurt (eu-central-1) und Google Vertex AI in der EU. Der Rechenweg verlässt die EU nicht.
API-Schlüssel und Klartextdaten verlassen die EU-Umgebung nicht. Was das Modell sieht, ist kontrolliert, was geheim ist, bleibt es.
Bevor Daten ein Modell außerhalb des EU-Pfads erreichen, wird jedes personenbezogene Datum durch einen Token ersetzt. Das geschieht in vier aufeinander aufbauenden Schichten.
Ein kuratiertes Verzeichnis bekannter Namen und Organisationen wird zuerst geprüft und ersetzt. Was wir schon kennen, rutscht nicht durch.
IBAN, Steuer-IDs, Kreditkarten und Telefonnummern folgen festen Strukturen mit Prüfziffern. Sie werden mit Prüfsummen-Validierung erkannt: 100 Prozent auf strukturell erkennbaren Daten.
Für unbekannte Personen und Organisationen im Fließtext greift eine statistische Erkennung, die auch Namen findet, die in keinem Wörterbuch stehen.
Ein zweiter Durchlauf auf EU-Infrastruktur kontrolliert das Ergebnis. Im Zweifel wird geschützt, nicht durchgelassen: die Voreinstellung ist fail-closed.
Klartext und die Re-Identifikations-Schlüssel bleiben verschlüsselt auf der EU-Infrastruktur (AES-256-GCM). Die Re-Identifikation, also das Zurückübersetzen der Token in echte Daten, passiert ausschließlich EU-seitig.
100 Prozent Erkennung auf freiem Text kann seriös niemand garantieren. Deshalb messen wir gegen einen reproduzierbaren Gold-Korpus aus 197 synthetischen deutschen Geschäftsdokumenten (Stand 14.07.2026). Die folgenden Werte gelten für den vollen Mehrstufen-Durchlauf, also die gesamte Kaskade, nicht für die statistische Namenserkennung allein.
Erkennung bei Personennamen im vollen Mehrstufen-Durchlauf
über alle Namens-Klassen in der vollen Kaskade
bei allen deterministisch prüfbaren Klassen
Was unterhalb der Konfidenz-Schwelle liegt, wird nicht nach außen gegeben, sondern geht fail-closed auf den EU-Inferenz-Pfad. Der Zweifel führt zu mehr Schutz, nicht zu weniger.
Seit dem EuGH-Urteil von 2025 gilt: Ob pseudonymisierte Daten personenbezogen sind, ist aus der Sicht des Empfängers zu beurteilen. Wer keine nutzbaren Mittel zur Zuordnung hat, für den sind sauber pseudonymisierte Daten keine personenbezogenen Daten. Genau deshalb ist die Qualität der Pseudonymisierung das eigentliche Kriterium, und genau deshalb messen wir sie.
EuGH, EDPS gegen SRB (2025)
Rechtssache C-413/23 P: Pseudonymisierung als empfängerbezogener Maßstab.
Art. 4 (5) DSGVO, Erwägungsgrund 26
Die Definition der Pseudonymisierung und der Maßstab der Bestimmbarkeit.
EDPB-Leitlinien 01/2025
Pseudonymisierung als wirksame Schutzmaßnahme, die sonst unvertretbare Verarbeitungen ermöglicht.
Verträge von Anfang an
Auftragsverarbeitungsvertrag und Verzeichnis der Verarbeitungstätigkeiten gehören zu jedem Mandat.
Für die verbindliche Bewertung eures Falls gehört euer Datenschutzbeauftragter an den Tisch. Diese Seite ist keine Rechtsberatung.
Jeder Agent wird im Betrieb überwacht. Wir sehen Auffälligkeiten, bevor sie bei euch ankommen.
Verhalten und Schutzmechanismen werden täglich automatisiert geprüft, statt einmalig zum Start.
Wir wählen das Modell pro Aufgabe: OpenAI, Anthropic, Google oder Open Source. Ihr seid an keinen Anbieter gebunden.
Wir schauen gemeinsam auf eure Daten, eure Anforderungen und den passenden Schutz. Konkret und unverbindlich.