Privacy Leakage in Language Models

Latest papers 159

All topics
CardsList
  1. Cross-Lingual Transferability of Training Data Extraction Attacks to Recover Memorized PII

    Oct 5, 2026Alexandru Nazare, Agnese Profico, Nicolò Vania +6Multilingual Language ModelsCross-Lingual Representation Alignment

  2. AgentDoxx: Agentic Re-identification of Anonymized Text with Web Search

    Oct 4, 2026Jianing Wen, Tianshi LiPrivacy Leakage in Language ModelsAI Agent Security Benchmarks

  3. Hidden Risks of Jev: An Empirical Study of Security, Privacy, and Dual Use

    Oct 4, 2026Shang Wang, Tianqing Zhu, Huajie Chen +3LLM Backdoor AttacksModel Extraction Attacks

  4. The Innocent Courier: Covert Exfiltration Through Legitimate LLM Web Fetching

    Oct 1, 2026Alessandro Pegoraro, Daryan Merx, Phillip Rieger +1LLM Agent SecurityPrivacy Leakage in Language Models

  5. OverAct: Measuring and Mitigating Proactive Over-Authorization in LLM Tool-Calling Agents

    Oct 1, 2026Taolin Zhang, Jiuheng Wan, Hanyu Wang +2Privacy Leakage in Language ModelsAI Agent Security Benchmarks

  6. SparLeak: Privacy Leakage from Sparse Attention in LLM Inference on Shared GPUs

    Sep 30, 2026Fahao Chen, Linkang Du, Jinhao Zhou +2LLM InferencePrivacy Leakage in Language Models

  7. PrivMeSA: Privacy-Aware Self-Evolving Multi-Agent System for Medicine via Local-Remote LLM Collaboration

    Sep 29, 2026Dannong Wang, Yuran Zhang, Bian Sun +4Multi-Agent LLM SystemsPrivacy-Preserving Language Models

  8. "Nothing to See Here'': Unintended Disclosure through Revision Traces of LLM Deliverables

    Sep 28, 2026Yage Zhang, Yukun Jiang, Yang ZhangPrivacy-Preserving Language ModelsLLM Auditing

  9. EP-Mem: Elastic Privacy Memory for Social Relationship-Aware LLM Agents

    Sep 28, 2026Fengzhou Sun, Yuan Zhang, Xintong Yu +1LLM Agent MemoryPrivacy Leakage in Language Models

  10. Despite Instructions: Frontier Agents Improvise Covert Channels at Test Time

    Sep 26, 2026Jacob Dineen, Silei Ren, Muhao Chen +2AI Agent SecurityPrivacy Leakage in Language Models

  11. The Tokens Remember: When Tokenization Bypasses Knowledge Editing and Unlearning

    Sep 24, 2026Manit Baser, Aditya Nawal, Dinil Mon Divakaran +1Adversarial Attacks on LLMsPrivacy Leakage in Language Models

  12. GUARD: Natural Forgetting in Large Reasoning Models via Guided Answer-Reasoning Distillation

    Sep 18, 2026Zeyu Yan, Guanghao Zhou, Minghui Qiu +2Privacy Leakage in Language ModelsMachine Unlearning

  13. Cascade: Hierarchical Recoverability Control for Large Language Model Unlearning

    Sep 15, 2026Qingchen Yu, Shiying Duan, Xiaodong Li +5Privacy Leakage in Language ModelsMachine Unlearning

  14. RAG-CT: Mitigating Privacy Risks on Retrieval-Augmented Generation Systems via Scanning Prompt Distribution

    Sep 14, 2026Xingyu Lyu, Jiayimei Wang, Jianfeng He +3Privacy Leakage in Language ModelsRAG Security

  15. GraphProfiler: Source-Linked Sensitive Attribute Inference via Personal Knowledge Graphs

    Sep 14, 2026Ahmed Sohair Khan, Estrid He, Chenglong Ma +2Privacy AuditingPrivacy Leakage in Language Models

  16. K-Bench: A Benchmark for LLM Unlearning in Agentic Deployments

    Sep 11, 2026Guangsheng Yu, Yanna Jiang, Qin Wang +2LLM Agent EvaluationPrivacy Leakage in Language Models

  17. Privacy-Preserving Split Learning for Federated LLM Fine-Tuning

    Sep 9, 2026Heng Jin, Chaoyu Zhang, Hexuan Yu +2Privacy-Preserving Language ModelsSplit Federated Learning

  18. Extracting Forgotten Prompts from Targeted Unlearned Models

    Sep 3, 2026Au Ashley Hoi-Ting, Meghdad Kurmanji, William F. Shen +2Privacy Leakage in Language ModelsLLM Unlearning

  19. Embedded Conditional Independence Tests for Large Language Model Generated Text with an Application to German Parliament Speeches

    Sep 1, 2026Marco Simnacher, Georg Keilbar, Benjamin König +2LLM EvaluationPrivacy Leakage in Language Models

  20. Membership Inference in Fine-tuned Diffusion Language Models via Token-level Memorization Asymmetry

    Sep 1, 2026Shengfang Zhai, Leo Marchyok, Yuling Shi +4Memorization in Language ModelsMembership Inference Attacks

  21. Balancing Privacy, Utility, and Safety in LLM Alignment through Preference Optimization

    Aug 31, 2026Dishu Yang, Jingjing Liu, Jize LiLLM AlignmentMemorization in Language Models

  22. On the Recoverability of Private Information Unlearning in Large Language Models

    Aug 30, 2026Shicheng Hu, Runzhi Tian, Ziqiao Wang +1LLM AuditingPrivacy Leakage in Language Models

  23. Privacy-Preserving RAG by Concealing Sensitive Information from External LLMs

    Aug 13, 2026Saleh Almohaimeed, Saad Almohaimeed, Mousa Jari +2Retrieval-Augmented GenerationPrivacy Leakage in Language Models