arXiv cs.CLSeptember 21, 2026
Conformal Privacy Auditing: Calibrated Re-identification Attacks with Statistical Guarantees
Excerpt
arXiv:2609.21340v1 Announce Type: cross Abstract: Empirical identity leakage from released text is increasingly driven by attackers that combine large language models (LLMs) with auxiliary knowledge to link documents to individuals. Existing audits typically report success rates for specific attack pipelines but lack finite-sample statistical guarantees, while training-time protections such as differential privacy are difficult to translate into release-time decisions for individual natural-lang