Recherche
Des méthodes ouvertes, des preuves vérifiables
Projets de recherche financés, publications évaluées par les pairs et logiciels open source — tout ce que nous affirmons peut être reproduit.
Anonymisation et pseudonymisation fondées sur le risque pour Nestlé
Exploiter les données événementielles et longitudinales dans l'industrie et le secteur de la santé grâce à des technologies préservant la confidentialité
Partage de données préservant la confidentialité pour la population synthétique des CFF
Ceci est une sélection. Liste complète des publications : Google Scholar · ORCID.
Paquets R open source sur CRAN — estimation du risque, anonymisation et méthodes de synthèse de populations.
Voir les statistiques de téléchargement CRAN · depuis2010
RecordLinkage
R package for probabilistic and deterministic record linkage — deduplication and entity resolution across data sources, with comparison, classification, and evaluation tools.
CRAN · depuis—
robSynth
Robust synthetic microdata generation when the training data are contaminated — a drop-in alternative to synthpop using MM-estimators, weighted logistic regression, and tree-based robust methods so outliers and coding errors don't propagate into the synthetic output.
CRAN · depuis2007
sdcMicro
R package for statistical disclosure control of microdata — risk estimation, anonymization methods, and utility measurement. Peer-reviewed in the Journal of Statistical Software.
CRAN · depuis2014
simPop
Simulation of synthetic populations from survey and census data.
CRAN · depuis—
synvey
Design-aware, robust synthetic data generation — the successor to robSynth. Replaces the conditional models in sequential synthesis with MM-estimators and Huber-weighted logistic regression, keeping the synthetic data close to the clean data-generating process even when the source is contaminated.