Poisoning

Momentum

19 papers in the last four weeks, up 111% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 154

All topics
CardsList
  1. When Agents Remember Too Much: Memory Poisoning Attacks on Large Language Model Agents

    Jul 6, 2026George Torres, Sharad Shrestha, Satyajayant MisraAgentic MemoryLarge Language Model Agents

  2. !Imperio, smolVLA: The Implications of Data Poisoning on Open Source Robotics

    Jul 5, 2026Stefan Bühler, Mark SchuteraPoisoningAI Trustworthiness

  3. A Failure-Mode Benchmark for Polymorphic Sybil Poisoning in RAG

    Jul 4, 2026Donghyun Lee, Juntae KimPoisoningQuestion-Answering Benchmarks

  4. ElephantAgent: Contextual State Continuity in Agentic Systems

    Jul 2, 2026Jiankai Jin, Xiangzheng Zhang, Zhao Liu +4Production Agentic SystemsPersistent State

  5. Theory of Continual Learning Against Data Poisoning Attacks

    Jun 29, 2026Yiting Hu, Lingjie DuanReplay-Based Continual LearningPoisoning

  6. A Novel Latent-Class Attack and its Detection by Class Subspace Orthogonalization

    Jun 27, 2026Guangmingmei Yang, David J. Miller, George KesidisWhite-Box Spectral-Subspace-Guided AttackPoisoning

  7. Clustering Unsupervised Representations as Defense against Poisoning Attacks on Speech Commands Classification System

    Jun 27, 2026Thomas Thebaud, Sonal Joshi, Henry Li +4PoisoningLLM Defense Mechanisms

  8. ShareLock: A Stealthy Multi-Tool Threshold Poisoning Attack Against MCP

    Jun 25, 2026Liwei Liu, Tianzhu Han, Zijian Liu +2PoisoningModel Context Protocol

  9. MIRROR: Novelty-Constrained Memory-Guided MCTS Red-Teaming for Agentic RAG

    Jun 25, 2026Inderjeet Singh, Andrés Murillo, Motoyoshi Sekiya +2Multimodal Retrieval Augmented GenerationPoisoning

  10. Detect, Unlearn, Restore: Defending Text Summarization Models Against Data Poisoning

    Jun 24, 2026Poojitha Thota, Shirin NilizadehSummarizationPoisoning

  11. Tracing Target Answers in Poisoned Retrieval Corpora via Token Influence Attribution

    Jun 24, 2026Yan-Lun Chen, Pin-Yu Chen, Chia-Mu Yu +3PoisoningAgentic Retrieval-Augmented Generation Systems

  12. Backdoor Attacks on Speech Emotion Recognition via TTS-Generated Poisoning

    Jun 19, 2026Yongbin Huang, Xihao Xie, Jia ZhangPoisoning

  13. A Layered Security Framework Against Prompt Injection in RAG-Based Chatbots

    Jun 17, 2026Gulshan Saleem, Nisar Ahmed, Muhammad Imran Zaman +1Indirect Prompt InjectionPoisoning

  14. Giskard : Byzantine Robust and Confidential Aggregation for Large-Scale Decentralized Learning

    Jun 17, 2026Ousmane Touat, César Sabater, Mohamed Maouche +1Secure AggregationDecentralized Learning

  15. Stealthy World Model Manipulation via Data Poisoning

    Jun 17, 2026Yibin Hu, Xiaolin Sun, Zizhan ZhengWorld ModelsPoisoning

  16. Beyond Native Success: Auditing Deployment-Interface Exposure of CLIP Backdoors

    Jun 16, 2026Kunlan Xiang, Haomiao Yang, Wenbo JiangContrastive Language-Image Pre-Training ModelPoisoning

  17. Loss Landscape Poisoning: Targeted Extraction of Unseen Training Data from LLMs

    Jun 15, 2026Md Abdullah Al Mamun, Ngoc Phu Doan, Pedram Zaree +2Attacker Large Language ModelPoisoning

  18. Rapid Poison: Practical Poisoning Attacks Against the Rapid Response Framework

    Jun 15, 2026David Huang, Jaewon Chang, Avidan Shah +2PoisoningJailbreak Success Rates

  19. SkillVetBench: LLM-as-Judge for Multi-Dimensional Security Risk Evaluation in Open-Source LLM Agent Skills

    Jun 14, 2026Ismail Hossain, Sai Puppala, Md Jahangir Alam +2Security EvaluationLarge Language Model Safety

  20. MemVenom: Triggered Poisoning of Multimodal Memories in Web Agents

    Jun 9, 2026Yv Zhang, Hao Sun, Hao Fang +5PoisoningMultimodal Memory

  21. When Poison Fails After Retrieval: Revisiting Corpus Poisoning under Chunking and Reranking Pipelines

    Jun 9, 2026Xi Nie, Hongwei Li, Shenghao Wu +3PoisoningAgentic Retrieval-Augmented Generation Systems

  22. Game-Theoretic Multi-Agent Control for Robust Contextual Reasoning in LLMs

    Jun 9, 2026Saeid Jamshidi, Amin Nikanjam, Arghavan Moradi Dakhel +2Model Context ProtocolMulti-Turn Interactions

  23. Safe-RULE: Safe Reinforcement UnLEarning

    Jun 8, 2026Shixiong Jiang, Taozheng Zhu, Fanxin KongModel-Based Reinforcement LearningUnsafe

  24. Model Poisoning Against Federated Model Adaptation with Chain of Bit-Flips

    Jun 8, 2026Bastien Vuillod, Kevin Hector, Pierre-Alain Moellic +2Federated LearningPoisoning

  25. Securing Self-supervised Data Curation for Foundation Models Robustness

    Jun 8, 2026Sandeep Gupta, Roberto PasseroneSelf-Supervised LearningWireless Foundation Models

  26. Targeting World Models to Compromise Robot Learning Pipelines

    Jun 8, 2026Ethan Rathbun, Ahmed Agha, Saaduddin Mahmud +3Scalable Robot LearningRobot Policies

  27. POISE: Position-Aware Undetectable Skill Injection on LLM Agents

    Jun 6, 2026Haochang Hao, Dehai Min, Zhifang Zhang +4PoisoningMalicious Agents

  28. Model Multiplicity for Adversarial Detection in Small Language Model Training on Edge Devices

    Jun 5, 2026Stefan Behfar, Richard MortierModel-Agnostic DefenseEdge Devices

  29. GITCO: Gated Inference-Time Context Optimization in TSFMs

    Jun 3, 2026Manya Pandey, Dhruv Kumar, Murari Mandal +1Time Series Foundation ModelsZero-Shot Forecasting

  30. Sequential Data Poisoning in LLM Post-Training

    Jun 3, 2026Jack Sanderson, Yihan Wang, Xiaoqian Lu +2PoisoningAttacker Large Language Model

  31. From Untrusted Input to Trusted Memory: A Systematic Study of Memory Poisoning Attacks in LLM Agents

    Jun 3, 2026Pritam Dash, Tongyu Ge, Aditi Jain +2PoisoningAttacker Large Language Model

  32. Characterizing Detectability in 3DGS Poisoning: A Stage-wise Benchmark

    Jun 2, 2026Quoc-Anh Bui-Huynh, Thanh Duc Ngo, Xue Geng +4Dynamic 3D Gaussian SplattingPoisoning

  33. MemPoison: Bypassing Selective Memory Mechanisms to Plant Backdoors in LLM Agents

    May 28, 2026Hongtao Wang, Se Yang, Yu Chen +1PoisoningAttacker Large Language Model

  34. Poison with Style: A Practical Poisoning Attack on Code Large Language Models

    May 26, 2026Khang Tran, Yazan Boshmaf, Issa Khalil +3Attacker Large Language ModelPoisoning

  35. Cordon-MAS: Defending RAG against Knowledge Poisoning via Information-Flow Control

    May 26, 2026Zhe Yu, Wenpeng Xing, Gaolei Li +4PoisoningInformation-Flow Control

  36. Cordyceps: Covert Control Attacks on LLMs via Data Poisoning

    May 26, 2026Zedian Shao, Charles Fleming, Teodora BalutaAttacker Large Language ModelPoisoning

  37. Building an Adversarial Malware Dataset by Family and Type: Generation, Evasion, and Poisoning Evaluation

    May 25, 2026David Košťál, Martin JurečekMalwarePoisoning

  38. When the Manual Lies: A Realistic Benchmark to Evaluate MCP Poisoning Attacks for LLM Agents

    May 22, 2026Shi Liu, Xuehai Tang, Xikang Yang +4Attacker Large Language ModelPoisoning

  39. PoisonForge: Task-Level Targeted Poisoning Benchmark for Instruction-Tuned LLMs

    May 22, 2026Luze Sun, Anshuman Suri, Harsh Chaudhari +2Attacker Large Language ModelPoisoning

  40. EnCAgg: Enhanced Clustering Aggregation for Robust Federated Learning against Dynamic Model Poisoning

    May 21, 2026Tianyun Zhang, Zhen Yang, Haozhao Wang +2Federated LearningGradient-Based Attacks

  41. Adversarial Trust Poisoning in Vehicular Collaborative Perception

    May 21, 2026Yutong Liu, Chenyi Wang, Ming F. Li +1Collaborative PerceptionPoisoning

  42. When Critics Disagree: Adaptive Reward Poisoning Attacks in RIS-Aided Wireless Control System

    May 19, 2026Deemah H. Tashman, Soumaya CherkaouiWireless CommunicationsLearning-Based Control

  43. Token by Token, Compromised: Backdoor Vulnerabilities in Unified Autoregressive Models

    May 19, 2026Tobias Braun, Jonas Henry Grebe, Hossein Shakibania +2Multimodal GenerationPoisoning

  44. OEP: Poisoning Self-Evolving LLM Agents via Locally Correct but Non-Transferable Experiences

    May 18, 2026Kaixiang Wang, Jiong Lou, Zhaojiacheng Zhou +1PoisoningAttacker Large Language Model

  45. Mental Damage: Caption Poisoning Attacks on Retrieval-Augmented Text-to-Music Generation

    May 18, 2026Yizhu Wen, Shuhao Zhang, Nan Zhang +2Text-To-MusicDance-To-Music Generation

  46. Trust No Tool: Evaluating and Defending LLM Agents under Untrusted Tool Feedback

    May 17, 2026Lecheng Yan, Ruizhe Li, Xicheng Han +5Untrusted ContentLarge Language Model Safety

  47. Hidden in Memory: Sleeper Memory Poisoning in LLM Agents

    May 14, 2026Sidharth Pulipaka, Stanislau Hlebik, Leonidas Raghav +4PoisoningAttacker Large Language Model

  48. The Misattribution Gap: When Memory Poisoning Looks Like Model Failure in Agentic AI Systems

    May 12, 2026Tanzim Ahad, Ismail Hossain, Md Jahangir Alam +3Poisoning