Poisoning

Momentum

19 papers in the last four weeks, up 111% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 154

All topics
CardsList
  1. Knowledge Poisoning Attacks on Medical Multi-Modal Retrieval-Augmented Generation

    May 11, 2026Peiru Yang, Haoran Zheng, Tong Ju +6Multimodal Retrieval Augmented GenerationMultimodal Clinical Data

  2. Oracle Poisoning: Corrupting Knowledge Graphs to Weaponise AI Agent Reasoning

    May 10, 2026Ben Kereopa-Yorke, Guillermo Diaz, Holly Wright +3PoisoningKnowledge Graphs

  3. ShadowMerge: A Novel Poisoning Attack on Graph-Based Agent Memory via Relation-Channel Conflicts

    May 9, 2026Yang Luo, Zifeng Kang, Tiantian Ji +4Graph-Structured MemoriesPoisoning

  4. Narrow Secret Loyalty Dodges Black-Box Audits

    May 7, 2026Alfie Lamerton, Fabien RogerRealistic Threat ModelPoisoning

  5. Towards Security-Auditable LLM Agents: A Unified Graph Representation

    May 7, 2026Chaofan Li, Lyuye Zhang, Jintao Zhai +9Security EvaluationProduction Agentic Systems

  6. When Routine Chats Turn Toxic: Unintended Long-Term State Poisoning in Personalized Agents

    May 7, 2026Xiaoyu Xu, Minxin Du, Qipeng Xie +3PoisoningPersonalized Large Language Model Agents

  7. LoopTrap: Termination Poisoning Attacks on LLM Agents

    May 7, 2026Huiyu Xu, Zhibo Wang, Wenhui Zhang +4Large Language Model AgentsPoisoning

  8. Gray-Box Poisoning of Continuous Malware Ingestion Pipelines

    May 6, 2026Jan Dolejš, Martin Jureček, Róbert LórenczMalwarePoisoning

  9. MEMSAD: Gradient-Coupled Anomaly Detection for Memory Poisoning in Retrieval-Augmented Agents

    May 5, 2026Ishrith GowdaPoisoningLLM Defense Mechanisms

  10. When Agents Handle Secrets: A Survey of Confidential Computing for Agentic AI

    May 4, 2026Javad Forough, Marios Kogias, Hamed HaddadiPoisoningAI Trustworthiness

  11. Efficient Preference Poisoning Attack on Offline RLHF

    May 4, 2026Chenye Yang, Weiyu Xu, Lifeng LaiBacktranslation Augmented Direct Preference OptimizationReinforcement Learning From Human Feedback

  12. Fight Poison with Poison: Enhancing Robustness in Few-shot Machine-Generated Text Detection with Adversarial Training

    May 4, 2026Wenjing Duan, Qi Zhou, Yuanfan LiMachine-Generated Text DetectionAdversarial Training

  13. Adversarial Update-Based Federated Unlearning for Poisoned Model Recovery

    May 4, 2026Wenwei Zhao, Xiaowen Li, Yao Liu +1Federated LearningAdversarial Training

  14. Repurposing and Evaluating the (In)Feasibility of Dataset Poisoning enabled Watermarking for Contrastive Learning

    May 3, 2026Zhiyang Dai, Yansong Gao, Boyu Kuang +5Contrastive LearningWatermarking

  15. Toward Polymorphic Backdoor against Semantic Communication via Intensity-Based Poisoning

    Apr 25, 2026Xiao Yang, Yuni Lai, Gaolei Li +4Fewer Surprising BackdoorsWhite-Box Spectral-Subspace-Guided Attack

  16. RouteGuard: Internal-Signal Detection of Skill Poisoning in LLM Agents

    Apr 24, 2026Wenjie Xiao, Xuehai Tang, Biyu Zhou +2Malicious AgentsPoisoning

  17. Sharpness-Aware Poisoning: Enhancing Transferability of Injective Attacks on Recommender Systems

    Apr 24, 2026Junsong Xie, Yonghui Yang, Pengyang Shao +1Poisoning

  18. PermaFrost-Attack: Stealth Pretraining Seeding(SPS) for planting Logic Landmines During LLM Training

    Apr 23, 2026Harsh Kumar, Rahul Maity, Tanmay Joshi +4Attacker Large Language ModelPoisoning

  19. CSC: Turning the Adversary's Poison against Itself

    Apr 23, 2026Yuchen Shi, Xin Guo, Huajie Chen +3Clean Label Backdoor AttackModel-Agnostic Defense

  20. PoInit-of-View: Poisoning Initialization of Views Transfers Across Multiple 3D Reconstruction Systems

    Apr 17, 2026Weijie Wang, Songlong Xing, Zhengyu Zhao +23D ReconstructionKeypoint Detection

  21. When Can You Poison Rewards? A Tight Characterization of Reward Poisoning in Linear MDPs

    Apr 11, 2026Jose Efraim Aguilar Escamilla, Haoyang Hong, Jiawei Li +4Markov Decision ProcessesPoisoning

  22. Detecting Data Poisoning in Code Generation LLMs via Black-Box, Vulnerability-Oriented Scanning

    Mar 17, 2026Shenao Yan, Shan Jin, Shimaa Ahmed +4Vulnerable CodeAttacker Large Language Model

  23. Communication-Efficient Byzantine-Robust Federated Conformal Prediction via Partial Sharing

    Feb 20, 2026Ehsan Lari, Reza Arablouei, Stefan WernerOnline Conformal PredictionFederated Learning

  24. Hidden State Poisoning Attacks against Mamba-based Language Models

    Jan 5, 2026Alexandre Le Mercier, Chris Develder, Thomas DemeesterHybrid Mamba-Transformer ModelAttacker Large Language Model

  25. Eyes-on-Me: Scalable RAG Poisoning through Transferable Attention-Steering Attractors

    Oct 1, 2025Yen-Shan Chen, Sian-Yao Huang, Cheng-Lin Yang +1Agentic Retrieval-Augmented Generation SystemsPoisoning

  26. Are Targeted Data Poisoning Attacks as Effective as We Think?

    Sep 8, 2025William Xu, Chenyu Zhang, Yihan Wang +5PoisoningHard

  27. Tight Stability Bounds for Robust Distributed Learning: Byzantine Failures Hurt Generalization More than Data Poisoning

    Jun 22, 2025Thomas Boudou, Batiste Le Bars, Nirupam Gupta +1Byzantine AttacksLearnability

  28. How to Backdoor Image Knowledge Distillation

    Apr 30, 2025Qian Ma, Chen Wu, Prasenjit Mitra +1Knowledge DistillationFewer Surprising Backdoors

  29. FedNIA: Noise-Induced Activation Analysis for Mitigating Data Poisoning in Federated Learning

    Feb 23, 2025Ehsan Hallaji, Roozbeh Razavi-Far, Mehrdad SaifFederated LearningPoisoning

  30. SynGhost: Invisible and Universal Task-agnostic Backdoor Attack via Syntactic Transfer

    Feb 29, 2024Pengzhou Cheng, Wei Du, Zongru Wu +4Clean Label Backdoor AttackAttacker Large Language Model

  31. FedReview: Review and Dispose Poisoned Updates without Validation Datasets or Historic Knowledge

    Feb 26, 2024Tianhang Zheng, Yanlu Li, Bohan Deng +1Federated LearningPoisoning

  32. Kick Bad Guys Out! Conditionally Activated Anomaly Detection in Federated Learning with Zero-Knowledge Proof Verification

    Oct 6, 2023Shanshan Han, Wenxuan Wu, Baturalp Buyukates +4Federated LearningModel-Agnostic Defense