Anonymisierung und synthetische Daten — Methoden, Werkzeuge und Anwendungen
Ein eintägiger, praxisorientierter Workshop über den gesamten Bogen der Datenanonymisierung und synthetischer Daten — rechtliche Grundlagen, Identität und Risiko, die zentralen SDC-Techniken, praktische Arbeit mit sdcMicro, Nutzenmessung und moderne Generierung synthetischer Daten.
Lehrplan
Einführung & rechtliche Grundlagen
Warum Anonymisierung wichtig ist und in welchem rechtlichen Rahmen sie steht.
Das Konzept der Identität in der Anonymisierung
Was Identität und Wiedererkennung für Mikrodaten tatsächlich bedeuten.
Methodischer Gesamtüberblick
Die Landschaft der Methoden zur Anonymisierung und zu synthetischen Daten.
Zentrale Anonymisierungstechniken
Mikroaggregation, lokale Umkodierung, lokale Unterdrückung und klassische synthetische Daten.
Wiedererkennungsrisiko
Angreiferszenarien und Risikomasse, anhand von Beispielen durchgearbeitet.
Nutzenmasse
Allgemeiner und anwendungsspezifischer Nutzen — Konzepte und Beispiele.
Praxis mit sdcMicro
Zwei praktische Sessions, in denen die Methoden in R mit sdcMicro angewendet werden.
Generierung synthetischer Daten
Statistische vs. Deep-Learning- und LLM-Ansätze für synthetische Daten.
Dozierende Murat Sariyar (Berner Fachhochschule) · Matthias Templ (FHNW)