LOKAL VS. CLOUD

Lokale Schwärzung vs. Cloud-Schwärzungs-APIs

Im Kern der Cloud-Schwärzung steckt eine strukturelle Merkwürdigkeit: Damit Ihre sensiblen Daten entfernt werden, müssen Sie Ihre sensiblen Daten erst irgendwohin senden. Das kann für Ihre Organisation ein vertretbarer Handel sein – aber es sollte eine Entscheidung sein, kein Versehen.

Gegenüberstellung

Die Unterschiede, auf die es ankommt.

Verglichen wird die Kategorie, nicht die aktuelle Funktionsliste eines bestimmten Anbieters.

KriteriumCloud-Schwärzungs-APIDataAnonymiser
Wo die Erkennung läuftAuf den Servern des Anbieters, nachdem Ihr Text übertragen wurdeAuf Ihrem eigenen Gerät
Was der Anbieter erhältDen vollständigen Rohtext oder das Dokument samt IdentifikatorenNichts – für die Erkennung werden keine Inhalte übertragen
Neues AuftragsverarbeitungsverhältnisJa – der Schwärzungsanbieter wird Auftragsverarbeiter personenbezogener DatenKein neuer Auftragsverarbeiter für die Inhalte selbst
Funktioniert offlineNeinJa, sobald aktiviert und eingerichtet
KostenmodellMeist nach Dokument, Token oder API-Aufruf abgerechnetPauschales Abonnement, keine Abrechnung pro Dokument
Angriffsfläche bei einem LeckAnbieter-Protokolle, Anfrageverlauf und gespeicherte KopienNur Ihr Gerät

Die Übertragung ist das Risiko

Ein Cloud-Schwärzungsdienst kann keinen Identifikator entfernen, den er nicht gesehen hat. Das heißt: Jedes Dokument, das Sie de-identifizieren wollen, muss zuerst vollständig zu einem Dritten reisen – und danach verlassen Sie sich auf dessen Aufbewahrungsrichtlinie, Protokollhygiene, Unterauftragsverarbeiter und Sicherheitsbilanz statt auf etwas, das Sie kontrollieren.

Für viele Arbeitslasten ist das in Ordnung, und Cloud-Anbieter betreiben ernsthafte Sicherheitsprogramme. Aber es bedeutet, dass der Schwärzungsschritt selbst ein Datenweitergabe-Ereignis ist – genau das, was viele Teams mit Schwärzung vermeiden wollen.

Was sich ändert, wenn die Erkennung lokal läuft

DataAnonymiser richtet sich nach der Aktivierung auf Ihrem Rechner ein. Texte, PDFs, Office-Dokumente und Bilder werden in der App verarbeitet, die Platzhalter lokal eingesetzt, und die Zuordnung, mit der Sie die Originalwerte später wiederherstellen, bleibt für die aktuelle Sitzung auf dem Gerät.

Die praktische Folge: Der Schwärzungsschritt ist keine Übermittlung mehr. Es gibt keinen Anfrage-Body mit Ihrem Dokument, keine anbieterseitige Protokollzeile und nichts, was später von unserer Seite beschlagnahmt oder geleakt werden könnte – weil wir es nie hatten.

Abrechnung nach Volumen gegen Pauschale

Cloud-Schwärzung wird typischerweise nach Volumen abgerechnet – pro API-Aufruf, pro Dokument oder pro tausend Tokens. Das schafft einen stillen Anreiz, weniger zu schwärzen, und macht die Kosten einer großen einmaligen Bereinigung schwer vorhersehbar.

Lokale Verarbeitung hat keine Grenzkosten pro Dokument. Ein Ordner-Scan über Tausende Dateien kostet so viel wie ein einzelnes Einfügen – erst das macht Massenarbeit überhaupt praktikabel.

Der ehrliche Zielkonflikt: Ihre Hardware macht die Arbeit

Lokales Arbeiten nutzt Ihren eigenen Rechner. Hinter einer Cloud-API steht praktisch unbegrenzte Hardware, sie kann bei sehr großen Stapeln schneller sein und braucht weder Installation noch Geräteverwaltung.

DataAnonymiser ist für gewöhnliche Laptops gebaut und läuft darauf komfortabel. Wenn Ihre Arbeitslast aber eine dauerhafte Server-Pipeline mit hohem Durchsatz ist statt einer Person, die mit Dokumenten arbeitet, ist ein serverseitiges Werkzeug die passendere Form.

Häufige Fragen

Fragen zu diesem Ablauf.

Ist lokale Schwärzung ungenauer als Cloud-Schwärzung?

Nicht grundsätzlich – die Genauigkeit hängt davon ab, wie gut die Erkennung ist, nicht davon, wo sie läuft. Richtig ist, dass ein Laptop weniger Leistung hat als ein Rechenzentrum. Die Erkennung von DataAnonymiser erfolgt so oder so nach bestem Bemühen, und sie erzeugt einen Restrisiko-Bericht, damit ein Mensch das Ergebnis vor dem Teilen prüfen kann.

Gilt die Nutzung einer Cloud-Schwärzungs-API als Datenübermittlung nach DSGVO?

Personenbezogene Daten an einen Drittdienst zu senden ist in der Regel eine Offenlegung gegenüber einem Auftragsverarbeiter, und liegt dieser Dienst außerhalb Ihrer Region, kann es zusätzlich eine Drittlandsübermittlung sein. Lokale Verarbeitung vermeidet, dieses Verhältnis für die Inhalte selbst zu begründen. Das ist allgemeine Information, keine Rechtsberatung – prüfen Sie Ihre eigenen Pflichten.

Kann ich beides nutzen?

Ja. Manche Teams schwärzen lokal an dem Punkt, an dem eine Person ein Dokument bearbeitet, und behalten ein serverseitiges Werkzeug für automatisierte Pipelines. Beide adressieren unterschiedliche Stellen im Datenfluss.

Verwandt

Wo das noch eine Rolle spielt.

DESKTOP VS. NUR BROWSER

Desktop-App vs. reine Browser-Erweiterung

Warum der Browser der richtige Ort ist, um ein Leck abzufangen, und der falsche, um die Schwärzung durchzuführen.

APP VS. BIBLIOTHEK

Fertige App vs. selbst gehostete Schwärzungs-Bibliothek

Open-Source-Toolkits sind kostenlos und flexibel. Hier stehen die Gesamtkosten des Betriebs einer fertigen lokalen App gegenüber.

SCHWÄRZUNG VS. EINSTELLUNGEN

Schwärzung vs. Vertrauen auf die Datenschutzeinstellungen des KI-Anbieters

Dem Training zu widersprechen ist ein Versprechen darüber, was mit Ihren Daten nach der Ankunft geschieht. Schwärzung ändert, was ankommt.

Nutzen Sie jede KI. Behalten Sie Ihre Daten.