Privacy Leakage in Language Models

Latest papers 159

All topics
CardsList
  1. LACUNA: A Testbed for Evaluating Localization Precision for LLM Unlearning

    Jul 2, 2026Matteo Boglioni, Thibault Rousset, Siva Reddy +2Privacy Leakage in Language ModelsMachine Unlearning

  2. Recovering Input Text from Hidden States: Study of Gradient-Based Inversion of Decoder-Only Language Models

    Jul 1, 2026Mikołaj Słowikowski, Maciej Witold MajewskiDecoder-Only Language ModelsPrivacy Leakage in Language Models

  3. Probe Choice Changes Canary-Memorization Verdicts: Three Post-Hoc Disagreement Case Studies in a Text-Dominant LoRA-Tuned Autoregressive Testbed

    Jun 30, 2026Zhichao Fan, Zexin Zhuang, Yanhang LiMemorization in Language ModelsLLM Auditing

  4. ToolPrivacyBench: Benchmarking Purpose-Bound Privacy in Tool-Using LLM Agents

    Jun 26, 2026Shijing Hu, Liang Liu, Zhu Meng +1Privacy AuditingTool-Use Evaluation

  5. Agents That Know Too Much: A Data-Centric Survey of Privacy in LLM Agents

    Jun 25, 2026Nada Lahjouji, Ashwin Gerard ColacoPrivacy Leakage in Language ModelsInformation Flow Control

  6. Privacy-Preserving RAG via Multi-Agent Semantic Rewriting: Achieving Confidentiality Without Compromising Contextual Fidelity

    Jun 23, 2026Yuanhe Zhao, Tianyu Zhang, Huafei Xing +3Retrieval-Augmented GenerationPrivacy Leakage in Language Models

  7. GIF: Locally Sound Geometric Information Flow Control for LLMs

    Jun 22, 2026Adam Storek, Nikolaus Holzer, Zhuo Zhang +1Privacy Leakage in Language ModelsLLM Security

  8. MuPPET: A Benchmark for Contextual Privacy of LLM Assistants in Multi-Party Conversations

    Jun 22, 2026Elena Sofia Ruzzetti, Cornelius Emde, Sangdoo Yun +2Privacy Leakage in Language Models

  9. PrivacyAlign: Contextual Privacy Alignment for LLM Agents

    Jun 19, 2026Manveer Singh Tamber, Abhay Puri, Marc-Etienne Brunet +3Reward ModelingPrivacy Leakage in Language Models

  10. TRAP: Benchmark for Task-completion and Resistance to Active Privacy-extraction

    Jun 17, 2026Moon Ye-Bin, Nam Hyeon-Woo, Baek Seong-Eun +2Privacy-Preserving Language ModelsPrivacy Leakage in Language Models

  11. The Art of Mixology: Mixup-based Obfuscation for Privacy-Preserving Split Learning in Large Language Models

    Jun 15, 2026Chen Chen, Xiang Gao, Xianshun Wang +6Privacy-Preserving Language ModelsPrivacy Leakage in Language Models

  12. Privacy from Symmetry: Orthogonally Equivariant Transformers for LLM Inference

    Jun 15, 2026Alexander Yukhimchuk, Andrey Shulga, Mladen Kolar +1Privacy-Preserving Language ModelsLLM Inference

  13. Loss Landscape Poisoning: Targeted Extraction of Unseen Training Data from LLMs

    Jun 15, 2026Md Abdullah Al Mamun, Ngoc Phu Doan, Pedram Zaree +2Privacy Leakage in Language ModelsLLM Security

  14. VLALeaks: Membership Inference Attacks against Vision-Language-Action Models

    Jun 13, 2026Xukun Luan, Jinyan Liu, Xuesong Li +4Membership Inference AttacksPrivacy Leakage in Language Models

  15. From Prompts to Responses: Dual-Sided Data Leakage and Defense in Split Large Language Models

    Jun 12, 2026Zixuan Gu, Xiaojun Ye, Yang LiuPrivacy-Preserving Language ModelsPrivacy Leakage in Language Models

  16. The Vision Encoder as a Privacy Boundary: Visual-Token Side Channels in Encoder-Free Vision-Language Models

    Jun 10, 2026Chenyu Zhou, Qiliang Jiang, Shuning Wu +1Vision-Language ModelsAdversarial Attacks

  17. Advancing the State-of-the-Art in Empirical Privacy Auditing

    Jun 9, 2026Nicole Mitchell, Galen Andrew, Arun Ganesh +2Data LeakagePrivacy Auditing

  18. Alignment Defends LLMs from Property Inference Attacks

    Jun 8, 2026Pengrun Huang, Chhavi Yadav, Ruihan Wu +1LLM AlignmentPrivacy Leakage in Language Models

  19. Clinically Grounded Privacy Evaluation of Medical LMs

    Jun 8, 2026Sasha Ronaghi, Sana Tonekaboni, Lena Stempfle +6Data LeakageMemorization in Language Models

  20. Benchmarking Empirical Privacy Protection for Adaptations of Large Language Models

    Jun 8, 2026Bartłomiej Marek, Lorenzo Rossi, Vincent Hanke +4Privacy-Preserving Language ModelsMembership Inference Attacks

  21. Unveiling Privacy Risks in Multi-modal Large Language Models: Task-specific Vulnerabilities and Mitigation Challenges

    Jun 8, 2026Tiejin Chen, Pingzhi Li, Kaixiong Zhou +2Multimodal Large Language ModelsPrivacy Leakage in Language Models

  22. Auditing Training Data in Domain-adapted LLMs: LoRA-MINT

    Jun 5, 2026Gonzalo Mancera, Daniel DeAlcala, Aythami Morales +3Membership Inference AttacksLLM Auditing

  23. Is My Vision-Language Data in Your AI? Membership Inference Test (MINT) Demo 2

    Jun 5, 2026Daniel DeAlcala, Gonzalo Mancera, Julian Fierrez +3Membership Inference AttacksPrivacy Leakage in Language Models

  24. PromptPrint: Behavioral Biometrics Through Natural Language Prompting in LLMs

    Jun 4, 2026Shaiv Patel, Kartik Narayan, Vishal PatelBiometric IdentificationPrivacy Leakage in Language Models

  25. LLMs Can Leak Training Data But Do They Want To? A Propensity-Aware Evaluation of Memorization in LLMs

    Jun 4, 2026Gianluca Barmina, Peter Schneider-Kamp, Lukas Galke PoechData LeakageMemorization in Language Models