LOKAL VS. CLOUD
Lokale Schwärzung vs. Cloud-Schwärzungs-APIs
Im Kern der Cloud-Schwärzung steckt eine strukturelle Merkwürdigkeit: Damit Ihre sensiblen Daten entfernt werden, müssen Sie Ihre sensiblen Daten erst irgendwohin senden. Das kann für Ihre Organisation ein vertretbarer Handel sein – aber es sollte eine Entscheidung sein, kein Versehen.
Gegenüberstellung
Die Unterschiede, auf die es ankommt.
Verglichen wird die Kategorie, nicht die aktuelle Funktionsliste eines bestimmten Anbieters.
| Kriterium | Cloud-Schwärzungs-API | DataAnonymiser |
|---|---|---|
| Wo die Erkennung läuft | Auf den Servern des Anbieters, nachdem Ihr Text übertragen wurde | Auf Ihrem eigenen Gerät |
| Was der Anbieter erhält | Den vollständigen Rohtext oder das Dokument samt Identifikatoren | Nichts – für die Erkennung werden keine Inhalte übertragen |
| Neues Auftragsverarbeitungsverhältnis | Ja – der Schwärzungsanbieter wird Auftragsverarbeiter personenbezogener Daten | Kein neuer Auftragsverarbeiter für die Inhalte selbst |
| Funktioniert offline | Nein | Ja, sobald aktiviert und eingerichtet |
| Kostenmodell | Meist nach Dokument, Token oder API-Aufruf abgerechnet | Pauschales Abonnement, keine Abrechnung pro Dokument |
| Angriffsfläche bei einem Leck | Anbieter-Protokolle, Anfrageverlauf und gespeicherte Kopien | Nur Ihr Gerät |
Die Übertragung ist das Risiko
Ein Cloud-Schwärzungsdienst kann keinen Identifikator entfernen, den er nicht gesehen hat. Das heißt: Jedes Dokument, das Sie de-identifizieren wollen, muss zuerst vollständig zu einem Dritten reisen – und danach verlassen Sie sich auf dessen Aufbewahrungsrichtlinie, Protokollhygiene, Unterauftragsverarbeiter und Sicherheitsbilanz statt auf etwas, das Sie kontrollieren.
Für viele Arbeitslasten ist das in Ordnung, und Cloud-Anbieter betreiben ernsthafte Sicherheitsprogramme. Aber es bedeutet, dass der Schwärzungsschritt selbst ein Datenweitergabe-Ereignis ist – genau das, was viele Teams mit Schwärzung vermeiden wollen.
Was sich ändert, wenn die Erkennung lokal läuft
DataAnonymiser richtet sich nach der Aktivierung auf Ihrem Rechner ein. Texte, PDFs, Office-Dokumente und Bilder werden in der App verarbeitet, die Platzhalter lokal eingesetzt, und die Zuordnung, mit der Sie die Originalwerte später wiederherstellen, bleibt für die aktuelle Sitzung auf dem Gerät.
Die praktische Folge: Der Schwärzungsschritt ist keine Übermittlung mehr. Es gibt keinen Anfrage-Body mit Ihrem Dokument, keine anbieterseitige Protokollzeile und nichts, was später von unserer Seite beschlagnahmt oder geleakt werden könnte – weil wir es nie hatten.
Abrechnung nach Volumen gegen Pauschale
Cloud-Schwärzung wird typischerweise nach Volumen abgerechnet – pro API-Aufruf, pro Dokument oder pro tausend Tokens. Das schafft einen stillen Anreiz, weniger zu schwärzen, und macht die Kosten einer großen einmaligen Bereinigung schwer vorhersehbar.
Lokale Verarbeitung hat keine Grenzkosten pro Dokument. Ein Ordner-Scan über Tausende Dateien kostet so viel wie ein einzelnes Einfügen – erst das macht Massenarbeit überhaupt praktikabel.
Der ehrliche Zielkonflikt: Ihre Hardware macht die Arbeit
Lokales Arbeiten nutzt Ihren eigenen Rechner. Hinter einer Cloud-API steht praktisch unbegrenzte Hardware, sie kann bei sehr großen Stapeln schneller sein und braucht weder Installation noch Geräteverwaltung.
DataAnonymiser ist für gewöhnliche Laptops gebaut und läuft darauf komfortabel. Wenn Ihre Arbeitslast aber eine dauerhafte Server-Pipeline mit hohem Durchsatz ist statt einer Person, die mit Dokumenten arbeitet, ist ein serverseitiges Werkzeug die passendere Form.
Häufige Fragen
Fragen zu diesem Ablauf.
Ist lokale Schwärzung ungenauer als Cloud-Schwärzung?
Nicht grundsätzlich – die Genauigkeit hängt davon ab, wie gut die Erkennung ist, nicht davon, wo sie läuft. Richtig ist, dass ein Laptop weniger Leistung hat als ein Rechenzentrum. Die Erkennung von DataAnonymiser erfolgt so oder so nach bestem Bemühen, und sie erzeugt einen Restrisiko-Bericht, damit ein Mensch das Ergebnis vor dem Teilen prüfen kann.
Gilt die Nutzung einer Cloud-Schwärzungs-API als Datenübermittlung nach DSGVO?
Personenbezogene Daten an einen Drittdienst zu senden ist in der Regel eine Offenlegung gegenüber einem Auftragsverarbeiter, und liegt dieser Dienst außerhalb Ihrer Region, kann es zusätzlich eine Drittlandsübermittlung sein. Lokale Verarbeitung vermeidet, dieses Verhältnis für die Inhalte selbst zu begründen. Das ist allgemeine Information, keine Rechtsberatung – prüfen Sie Ihre eigenen Pflichten.
Kann ich beides nutzen?
Ja. Manche Teams schwärzen lokal an dem Punkt, an dem eine Person ein Dokument bearbeitet, und behalten ein serverseitiges Werkzeug für automatisierte Pipelines. Beide adressieren unterschiedliche Stellen im Datenfluss.
Verwandt
Wo das noch eine Rolle spielt.
DESKTOP VS. NUR BROWSER
Desktop-App vs. reine Browser-Erweiterung
Warum der Browser der richtige Ort ist, um ein Leck abzufangen, und der falsche, um die Schwärzung durchzuführen.
APP VS. BIBLIOTHEK
Fertige App vs. selbst gehostete Schwärzungs-Bibliothek
Open-Source-Toolkits sind kostenlos und flexibel. Hier stehen die Gesamtkosten des Betriebs einer fertigen lokalen App gegenüber.
SCHWÄRZUNG VS. EINSTELLUNGEN
Schwärzung vs. Vertrauen auf die Datenschutzeinstellungen des KI-Anbieters
Dem Training zu widersprechen ist ein Versprechen darüber, was mit Ihren Daten nach der Ankunft geschieht. Schwärzung ändert, was ankommt.