Privacy Leakage in Language Models

Latest papers 159

All topics
CardsList
  1. SharedRequest: Privacy-Preserving Model-Agnostic Inference for Large Language Models

    Jun 3, 2026Peihua Mai, Xuanrong Gao, Youlong Ding +3Privacy-Preserving Language ModelsLLM Inference

  2. Token Rankings are Unforgeable Language Model Signatures

    Jun 3, 2026Matthew Finlayson, Andreas Grivas, Xiang Ren +1Model Extraction AttacksLanguage Model Fingerprinting

  3. Ghost Tool Calls: Issue-Time Privacy for Speculative Agent Tools

    Jun 1, 2026Bardia Mohammadi, Lars Klein, Akhil Arora +1Data LeakageLLM Agent Security

  4. Hidden Thoughts Are Not Secret: Reasoning Trace Exposure in LLMs

    May 30, 2026Yu-An Lu, Ci-Yang Tsai, Yu-Lin Tsai +2LLM PromptingPrivacy Leakage in Language Models

  5. "I Strongly Suspect This Website Is a Scam": Benchmarking PII Leakage and Detection without Defense in Autonomous Web Agents

    May 30, 2026Soham Roy, Sarthakbrata Halder, Arya Bharaty +5Data LeakageLLM Agent Security

  6. VisualLeakBench: Reproducible Action-Boundary Propagation Failures in Vision-Language Agents

    May 29, 2026Youting Wang, Yuan Tang, Yitian Qian +1Data LeakageTool Use in VLMs

  7. PrivacyPeek: Auditing What LLM-Based Agents Acquire, Not Just What They Say

    May 29, 2026Mingxuan Zhang, Jiahui Han, Dadi Guo +5Data LeakagePrivacy Auditing

  8. MosaicLeaks:Privacy Risks in Querying-in-the-Open for Deep Research Agents

    May 29, 2026Alexander Gurung, Spandana Gella, Alexandre Drouin +3Data LeakageDeep Research Agents

  9. Diffusion Models Preferentially Memorize Prototypical Examples or: Why Does My Diffusion Model Love Slop?

    May 28, 2026Marta Aparicio Rodriguez, Anastasia Borovykh, Grigorios A. Pavliotis +1Privacy Leakage in Language ModelsMemorization in Generative Models

  10. AMNESIA: A Large Scale Medical Unlearning Benchmark Suite with Disease-Informed Analysis

    May 28, 2026Saeedeh Davoudi, Reihaneh Iranmanesh, Ophir Frieder +1HealthcarePrivacy Leakage in Language Models

  11. The Attentional White Bear Effect in Transformer Language Models

    May 27, 2026Rebecca Ramnauth, Brian ScassellatiTransformer InterpretabilityLLM Alignment

  12. When Helpful Context Leaks: Privacy Risks in Domain-Adapted ASR

    May 27, 2026Maike Züfle, Jan NiehuesData LeakageDomain Adaptation for ASR

  13. Got a Secret? LLM Agents Can't Keep It: Evaluating Privacy in Multi-Agent Systems

    May 26, 2026Aman Priyanshu, Supriti Vijay, Esha PahwaData LeakageMulti-Agent LLM Systems

  14. Vectors Are Not Neutral: Sensitive-Information Inference from Exported LLM Representations in Summarization

    May 26, 2026Weixin Liu, Bowen Qu, Juming Xiong +3LLM AuditingPrivacy Leakage in Language Models

  15. Reading the Finetuning Prior: Verbatim Content Recovery via Contrastive Decoding Diffing

    May 25, 2026Michał Brzozowski, Zuzanna Dubanowska, Enrico Cassano +1Language Model FingerprintingPrivacy Leakage in Language Models

  16. Extracting Training Data from Diffusion Language Models via Infilling

    May 22, 2026Yihan Wang, N. AsokanData LeakageMasked Diffusion Models

  17. What Does the Server See? Understanding Privacy Leakage from Large Language Models in Split Inference

    May 22, 2026Mingyuan Fan, Yu Liu, Fuyi Wang +1Privacy-Preserving Language ModelsAdversarial Attacks

  18. Hidden-State Privacy Has an Empty Middle

    May 21, 2026Alexander Okezue BellPrivacy-Preserving Language ModelsAdversarial Attacks

  19. LCGuard: Latent Communication Guard for Safe KV Sharing in Multi-Agent Systems

    May 21, 2026Sadia Asif, Mohammad Mohammadi Amiri, Momin Abbas +2Adversarial Representation LearningPrivacy-Preserving Language Models

  20. Boundary-targeted Membership Inference Attacks on Safety Classifiers

    May 21, 2026Anthony Hughes, Alexander Goldberg, Prince Jha +3Membership Inference AttacksPrivacy Leakage in Language Models

  21. A Survey of Large Audio Language Models: Generalization, Trustworthiness, and Outlook

    May 18, 2026Kaiwen Luo, Zhenhong Zhou, Leo Wang +31Privacy Leakage in Language ModelsAudio-Language Models

  22. An Empirical Study of Privacy Leakage Chains via Prompt Injection in Black-Box Chatbot Environments

    May 18, 2026Hongjang Yang, Hyunsik Na, Daeseon ChoiData LeakagePrivacy Leakage in Language Models

  23. ZeroUnlearn: Few-Shot Knowledge Unlearning in Large Language Models

    May 16, 2026Yujie Lin, Chengyi Yang, Zhishang Xiang +2Privacy Leakage in Language ModelsModel Editing

  24. Knowledge Beyond Language: Bridging the Gap in Multilingual Machine Unlearning Evaluation

    May 14, 2026Kyomin Hwang, Hyeonjin Kim, Sangyeon Cho +1Multilingual Language Model EvaluationPrivacy Leakage in Language Models