Untrusted Content

Momentum

2 papers in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 30

All topics
CardsList
  1. Hiding in Plain Sight: Decoupling Pretext from Actuation for Skill Poisoning in LLM Agents

    Sep 30, 2026Wenxin Wu, Lingyong Yan, Lei Sha +2PoisoningMalicious Agents

  2. Semantic-TVM: Structure-Preserving Trustworthy Virtual Memory for Memory-Augmented and Tool-Using Agents

    Sep 14, 2026Yu Li, Qikun Cai, Tao Huang +1Peak MemoryUntrusted Content

  3. When Detection Does Not Guarantee Resistance: Reasoning and Poisoned Context in RAG

    Aug 17, 2026Mehrdad Ghassabi, Audrina Ebrahimi, Sadra Hakim +3PoisoningDeliberation

  4. PIPES: Securing Agent Perception with Provenance and Priors

    Aug 13, 2026Sanjay Kariyappa, Severin Klingler, G. Edward SuhUntrusted ContentGeneration Provenance

  5. SlotGuard: Stop Oversharing Private Local Context in LLM Agent Transcri

    Jul 19, 2026Haocheng Xia, Yongjoo ParkData LeakageUntrusted Content

  6. From ambiguous utterances to governed reuse classes: canonicalization, quotient invariance, and conditional decidability

    Jul 11, 2026Cosimo Spera, Ray GarciaReuseTractability

  7. Prismata: Confining Cross-Site Prompt Injection in Web Agents

    Jul 9, 2026Corban Villa, Alp Eren Ozdarendeli, Sijun Tan +1Web AgentsUntrusted Content

  8. Untrusted Content Masking for Web Agents with Security Guarantees

    Jul 6, 2026Kristina Nikolić, Egor Zverev, Javier Rando +3Untrusted ContentWeb Agents

  9. DualView: Preventing Indirect Prompt Injection in Personal AI Agents

    Jul 4, 2026Juhee Kim, Woohyuk Choi, Taehyun Kang +2Indirect Prompt InjectionUntrusted Content

  10. Security--Fidelity Tradeoffs: The Hidden Cost of Prompt Injection Defense

    Jun 29, 2026Mitchell Hermon, Rahul Gupta, Weitong Ruan +2Prompt-Injection DetectorsLarge Language Model Safety

  11. GIF: Locally Sound Geometric Information Flow Control for LLMs

    Jun 22, 2026Adam Storek, Nikolaus Holzer, Zhuo Zhang +1Information-Flow ControlData Leakage

  12. Minim: Privacy-Aware Minimal View for Agents via Trusted Local Sanitization

    Jun 11, 2026Hexuan Yu, Chaoyu Zhang, Heng Jin +4PrivacyData Leakage

  13. From Untrusted Input to Trusted Memory: A Systematic Study of Memory Poisoning Attacks in LLM Agents

    Jun 3, 2026Pritam Dash, Tongyu Ge, Aditi Jain +2PoisoningAttacker Large Language Model

  14. Trust No Tool: Evaluating and Defending LLM Agents under Untrusted Tool Feedback

    May 17, 2026Lecheng Yan, Ruizhe Li, Xicheng Han +5Untrusted ContentLarge Language Model Safety

  15. SLEIGHT-Bench: A Benchmark of Evasion Attacks Against Agent Monitors

    May 15, 2026Elle Najt, Colin Toft, Tyler Tracy +2EvasionUntrusted Content

  16. MemLineage: Lineage-Guided Enforcement for LLM Agent Memory

    May 14, 2026Ciyan Ouyang, Rui HouUntrusted ContentLLM Defense Mechanisms

  17. The Granularity Mismatch in Agent Security: Argument-Level Provenance Solves Enforcement and Isolates the LLM Reasoning Bottleneck

    May 11, 2026Linfeng Fan, Ziwei Li, Yuan Tian +3Untrusted ContentAgentic Deployments

  18. PragLocker: Protecting Agent Intellectual Property in Untrusted Deployments via Non-Portable Prompts

    May 7, 2026Qinfeng Li, Yuntai Bao, Jianghui Hu +5Untrusted ContentPrompt Engineering

  19. Trace-Level Analysis of Information Contamination in Multi-Agent Systems

    Apr 30, 2026Anna Mazhar, Huzaifa Suri, Sainyam GalhotraMulti-Agent WorkflowsAgentic Workflow Design

  20. SUDP: Secret-Use Delegation Protocol for Agentic Systems

    Apr 27, 2026Xiaohang Yu, Hejia Geng, Xinmeng Zeng +1DelegationUntrusted Content

  21. Interactive proofs for verifying (quantum) learning and testing

    Oct 31, 2024Matthias C. Caro, Jens Eisert, Marcel Hinsche +3Quantum LearningPost-Quantum Cryptography