Anonymisierungssoftware für KI-Workflows: Datenanonymisierung und Pseudonymisierung per API
ShinrAI erkennt personenbezogene Daten in Texten und Dokumenten, ersetzt sie durch realistische Platzhalter und gibt Ihrer Anwendung das Mapping zur Wiederherstellung. Gehostet auf STACKIT in Deutschland oder auf Ihrer eigenen Infrastruktur. Ab 39 € im Monat.
Pseudonymisierung nach DSGVO Art. 4 Nr. 5
Die DSGVO definiert Pseudonymisierung in Art. 4 Nr. 5: personenbezogene Daten werden so verarbeitet, dass sie ohne zusätzliche, getrennt aufbewahrte Informationen keiner Person mehr zugeordnet werden können. Genau so arbeitet ShinrAI. Der Ersatztext geht an das KI-Modell. Das Mapping bleibt in Ihrer Anwendung, getrennt vom Prompt.
Pseudonymisierte Daten können weiterhin personenbezogene Daten sein. ShinrAI nimmt Ihnen deshalb nicht die Rechtsgrundlage, die Datenschutz-Folgenabschätzung oder die Governance ab. Die Software ist eine technische Maßnahme im Sinne der Datenminimierung. Für die Auftragsverarbeitung steht ein Vertrag nach Art. 28 DSGVO bereit.
Maskierung, Label oder Ersetzung?
Anonymisierungssoftware unterscheidet sich vor allem darin, was an die Stelle des Originals tritt. Für KI-Workflows ist diese Wahl entscheidend, denn ein Sprachmodell antwortet nur so gut, wie der Text lesbar bleibt.
| Verfahren | Beispiel | Eignung für KI |
|---|---|---|
| Maskierung | „Emma Weber“ wird zu „**********“ | Der Kontext geht verloren. Das Modell weiß nicht, ob eine Person, eine Firma oder ein Ort gemeint ist. |
| Bezeichnung | „Emma Weber“ wird zu „[PERSON]“ | Der Typ bleibt erkennbar, Bezüge zwischen mehreren Personen im Text nicht. |
| Realistische Ersetzung | „Emma Weber“ wird zu „Lena Hoffmann“, im ganzen Text konsistent | Der Text bleibt natürlich lesbar. Die Antwort des Modells lässt sich lokal auf das Original zurückführen. |
ShinrAI bietet alle drei Verfahren über denselben API-Aufruf. Der Modus replace liefert realistische Ersatzwerte und auf Wunsch das Mapping, mask und label decken klassische Schwärzung ab.
Einsatz in Kanzlei, Steuerbüro, Behörde und Support
- Kanzlei. Schriftsätze, Akten und Mandantenkorrespondenz werden vor der Zusammenfassung oder Recherche mit einem KI-Assistenten pseudonymisiert. Namen, Adressen und Aktenzeichen verlassen die Kanzlei nicht im Klartext.
- Steuerbüro. Belege, Bescheide und Mandantendaten laufen durch die Batch-API, bevor ein Modell sie klassifiziert oder vorerfasst. IBAN, Kennnummern und Geburtsdaten werden ersetzt.
- Behörde. Anträge und Bürgeranfragen werden vor der Bearbeitung durch einen Assistenten geschützt. Der Betrieb in Deutschland oder auf eigener Hardware erfüllt Vorgaben zur Datenhaltung.
- Support. Tickets, Chats und E-Mails gehen pseudonymisiert an das Modell. Die Antwort wird in Ihrer Anwendung mit den echten Kundendaten wiederhergestellt.
Die Dokumentation zeigt Beispiele für Support, CRM und Dokumente. Im Live-Beispiel sehen Sie, wie ein Text vor und nach der Ersetzung aussieht.
Deutsch und 14 weitere Sprachen, mit veröffentlichter Messung
Das Modell ShinrAI 1.4 unterstützt 15 Sprachen und erkennt 19 Kategorien mit 27 Unterklassen, darunter Personen, Organisationen, Adressen, Bankkonten, Zahlungskarten, Geburtsdaten, nationale Kennnummern sowie Kunden- und Aktenzeichen. Auf 3.000 Wirtschafts-, Medizin- und Verwaltungstexten erreicht es einen medianen F1-Wert von 94,8 bei strikter Span-Bewertung. Die Ergebnisse je Sprache stehen auf der Seite Sprachen und Datenkategorien und auf dem Benchmark-Board.
Das ist eine Messung des Modells, keine Garantie für Ihre Dokumente. Prüfen Sie die Qualität in einem Pilotlauf mit eigenen Texten.
Gehostet in Deutschland oder auf Ihrer Infrastruktur
Die Managed-API läuft auf STACKIT in Deutschland und wird von der Innovius UG aus Teltow betrieben. Synchrone Anfragen werden im Arbeitsspeicher verarbeitet, ohne Archiv der Inhalte und ohne Modelltraining. Inhalte asynchroner Jobs sind verschlüsselt und verfallen 24 Stunden nach der Übermittlung. Für abgeschottete Umgebungen gibt es Offline-Pakete mit signierter Aktivierung; die Verarbeitung bleibt vollständig lokal. Details stehen im Abschnitt On-Premises.
Preise: ab 39 € im Monat
Abgerechnet werden Records. Ein Record entspricht 1.000 Unicode-Codepunkten eines Dokuments; Batch-Verarbeitung zählt halb, Real-Time das 1,6-Fache. Alle Preise verstehen sich in Euro zuzüglich Umsatzsteuer.
| Plan | Preis pro Monat | Records pro Monat |
|---|---|---|
| Starter | 39 € | 50.000 Records |
| Team | 449 € | 1.000.000 Records |
| Business | 999 € | 2.500.000 Records |
| Platform | 2.490 € | 10.000.000 Records |
Pakete ohne Verfall gibt es ab 5 Millionen Records für 1.590 €, auch als Offline-Paket. Ein optionales Onboarding durch zertifizierte Partner kostet einmalig 490 €. Der Kalkulator rechnet Ihre Mengen in einen Plan um.
Mit einem Pilotlauf starten
Starter kostet 39 € im Monat, ohne Vertragsverhandlung. Anmeldung per Magic-Link mit Ihrer Firmen-E-Mail, Zahlung über Stripe.
Häufige Fragen
Ist ShinrAI Anonymisierung oder Pseudonymisierung?
Der Modus replace ist eine Pseudonymisierung im Sinne von Art. 4 Nr. 5 DSGVO: Die Ersatzwerte lassen sich nur mit dem getrennt gehaltenen Mapping zurückführen. Verwerfen Sie das Mapping, bleibt der Text ohne Zuordnung. Ob damit Anonymität im Rechtssinn erreicht ist, hängt vom Restrisiko in Ihrem Kontext ab.
Welche Daten erkennt die Software?
ShinrAI 1.4 erkennt 19 Kategorien mit 27 Unterklassen, darunter Namen, Organisationen, Adressen, E-Mail, Telefon, Bankkonten, Zahlungskarten, nationale Kennnummern, Geburtsdaten, Kfz-Kennzeichen sowie Kunden- und Aktenzeichen, in 15 Sprachen. Die vollständige Liste steht auf der Seite Sprachen und Datenkategorien.
Wo werden meine Daten verarbeitet?
Auf STACKIT in Deutschland. Synchrone Anfragen werden im Arbeitsspeicher verarbeitet, ohne Archiv und ohne Modelltraining. Alternativ läuft ShinrAI auf Ihrer eigenen Infrastruktur mit signierter Offline-Aktivierung.
Wie kommen die Originaldaten zurück in die Antwort?
Fordern Sie mit include_mapping das Mapping an. Ihre Anwendung speichert es, sendet den geschützten Text an das KI-Modell und setzt die Originalwerte lokal in die Antwort ein. Das Mapping verlässt Ihre Anwendung nicht, und die Wiederherstellung verbraucht keine Records.
Was kostet die Anonymisierungssoftware?
Der Plan Starter kostet 39 € im Monat für 50.000 Records. Team, Business und Platform decken größere Mengen ab. Pakete ohne Verfall beginnen bei 5 Millionen Records für 1.590 €. Onboarding ist optional.
Gibt es einen Auftragsverarbeitungsvertrag?
Ja. Der Vertrag zur Auftragsverarbeitung nach Art. 28 DSGVO mit technischen und organisatorischen Maßnahmen und Subunternehmern ist auf der Website veröffentlicht.