Deception

Momentum

9 papers in the last four weeks, up 50% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 94

All topics
CardsList
  1. Before Agent Tells The Lie: Has Deception Already Been Represented?

    Oct 5, 2026Xinling Li, Dadi Guo, Qingyu Liu +5DeceptionArtificial Intelligence Detection

  2. Universal Cross-Prompt Adversarial Attacks on Promptable Concept Segmentation

    Sep 30, 2026Ziqi Zhou, Yifan Hu, Yufei Song +5Segment Anything ModelBlack-Box Adversarial Attacks

  3. Unlearning Deceptive Behaviors in LLMs with Contrastive Forget Sets

    Sep 30, 2026Haoran Tang, Rajiv KhannaLarge Language Model UnlearningDeception

  4. DecoyTrace: Toxic Decoys for Active Defense in Decentralized Federated Learning

    Sep 28, 2026Pedro Beltrán-López, Enrique Tomás Martínez Beltrán, Pantaleone Nespoli +2Federated LearningModel-Agnostic Defense

  5. Before Acting, Change the State: Prospective State Intervention for Web Agents under Deceptive Interfaces

    Sep 28, 2026Ruozhao Yang, Mingfei Cheng, Xiaofei XieWeb AgentsAgentic Deployments

  6. Posterior Regimes and Latent Deception: Variational Bayesian Inference in Hidden Markov Models for Sequential Fraud Detection in Financial Transactions

    Sep 27, 2026Joseph Uririoghene Obukofe, Anthony O'Hare, Chioma Sandra DikeFraud DetectionHidden Markov Models

  7. How does Adversarial Influence Scale in Multi-Agent Systems?

    Sep 24, 2026Addison J. Wu, Jasin Cekinmez, Michel Liao +2DeceptionConformity

  8. Detecting Deceptive Recruitment: A Signal-theoretic Machine Learning Framework for Early Identification of Labour Exploitation

    Sep 17, 2026Sajid Siraj, Mahnaz Hosseinzadeh, Amin Vafadarnikjoo +1JobsArtificial Intelligence Detection

  9. Detecting AI Impostors: How Do Middle Schoolers Identify LLM Agents in a Live Collaborative Setting?

    Aug 31, 2026Dan Schumacher, Pragathi Durga Rajarajan, Haven Kotara +6Artificial Intelligence DetectionDeception

  10. Lies We Can See: Joint Verbal and Non-Verbal Deception by VLM Agents in Embodied Social Interactions

    Aug 31, 2026Jaewoo Ahn, Junseo Kim, Hyunseo Kim +4DeceptionNonverbal Cues

  11. Theory-Guided Deception Detection: A RAG-Based Artificial Intelligence Exploration

    Aug 9, 2026David M. Markowitz, Timothy R. LevineDeceptionArtificial Intelligence Models

  12. Sweet Little Lies: Strategic Deception in AI Emotional Support Chatbots

    Aug 2, 2026Aseem Pahuja, Zhiling Guo, Tahir Abbas SyedDeceptionEmotional Support Conversation Task

  13. Semantics of Subterfuge: Benchmarking Legal Deception Detection Against General-domain State-of-the-Art

    Jul 31, 2026Theekshana Samaradiwakara, Nisansa de Silva, George C. LobbDeceptionNatural Language Processing

  14. Can Agents Deceive? Evaluating Reasoning and Deception in ParliamentBench using a Social Deduction Game

    Jul 30, 2026Niklas Bauer, Lars Benedikt Kaesberg, Akiko Aizawa +3DeceptionSocial Reasoning

  15. Even More Deception: Objective Misalignment in Mixed-Motive LLM Multi-Agent Systems

    Jul 28, 2026Marylou Fauchard, Florian Carichon, Margarida Carvalho +1Multi-Agent Large Language Model SystemsDeception

  16. Agentic Cloud Decoys: A Deception-Driven Framework for Autonomous Intrusion Investigation

    Jul 27, 2026Mohan Manivannan, Dalal AlharthiMultivariate Telemetry DataIntrusion Detection

  17. The Chronos Vulnerability: A Taxonomy of Temporal Persistence and Memory-Based Deception in Agentic AI

    Jul 20, 2026Om Narayan, Ramkinker Singh, Praveen BaskarRealistic Threat ModelLLM Defense Mechanisms

  18. DecoyFace: Beyond Obfuscation via Controllable and Imperceptible Identity Misdirection for Privacy-Preserving Face Recognition

    Jul 20, 2026Zhihan Ren, Lijun He, Xinyao Wang +2Face Recognition ModelObfuscation

  19. Transcoders for Investigating Deception in Language Models

    Jul 16, 2026Darius Lim, Nathan Leow, Xin Wei ChiaDeceptionMechanistic Interpretability

  20. An Explainable Agentic System for Detection of Conversational Scams with Summary-Based Memory

    Jul 13, 2026Ahmed Omar Salim Adnan, Yogananda Manjunath, Shivanjali KhareArtificial Intelligence DetectionConversational Artificial Intelligence

  21. Scaling Trends for Lie Detector Oversight in Preference Learning

    Jul 2, 2026Oskar J. Hollinsworth, Ann-Kathrin Dombrowski, Sam Adam-Day +2DeceptionPreference Learning

  22. LLM Semantic Signaling Game and Mechanism Design: Systematic Blindness, Awareness Shaping, and Mindset Dynamics

    Jun 27, 2026Quanyan ZhuDeceptionHuman-Ai Interaction

  23. Is Lying an Emergent Behaviour in LLMs? Evidence from Gaslighting AI agents in a Sustainability Game

    Jun 26, 2026Subhendu Bhandary, Federico Carucci, Christos Charalambous +6DeceptionMulti-Agent Simulations

  24. Empirical Software Engineering TerraProbe: A Layered-Oracle Framework for Detecting Deceptive Fixes in LLM-Assisted Terraform

    Jun 25, 2026Manar Alsaid, Chimdumebi Nebolisa, Faris AbbasRemediationDeception

  25. Radical AI Interpretability

    Jun 25, 2026Daniel A. Herrmann, Benjamin A. LevinsteinTrustworthy Artificial IntelligenceMechanistic Interpretability

  26. Probing the Misaligned Thinking Process of Language Models

    Jun 23, 2026Kaiwen Zhou, Constantin Venhoff, Jonathan Michala +2Large Language Model AlignmentDeception

  27. Catching Lies Without Sending the Video: Privacy-Preserving Multimodal Deception Detection

    Jun 21, 2026Nikita Sharma, Pranav Sara, Karan SinglaDeceptionConfabulation

  28. Privacy-Preserving Federated Temporal Graph Learning with Digital Twin--Guided Adaptive Deception for Cyber-Resilient IoMT

    Jun 19, 2026Syed Zeeshan Haider, Anwar Shah, Muneeb Arif +2Internet Of ThingGeneralist Graph Anomaly Detection

  29. Federated Temporal Attention Intelligence for Cyber-Resilient IoMT: Lightweight Digital Twins and PPO-Driven Honeypot Deception

    Jun 19, 2026Syed Zeeshan Haider, Anwar Shah, Muneeb Arif +2Internet Of ThingCognitive Digital Twins

  30. Honeyquest for LLMs: Rethinking Cyber Deception for AI Attackers

    Jun 19, 2026Kerri Prinos, Lilianne Brush, Cameron DentonDeceptionAttacker Large Language Model

  31. ThinkDeception: A Progressive Reinforcement Learning Framework for Interpretable Multimodal Deception Detection

    Jun 17, 2026Jinhao Song, Shan Liang, Yiqun Yue +2DeceptionMultimodal Reasoning

  32. A Variational Framework for LLM Generator-Regulator Games

    Jun 16, 2026Quanyan ZhuKullback-Leibler RegularizationLarge Language Model Generation

  33. Escape from Delusional Echo Trap: Symmetry Breaking, Stochastic Dynamics and Mathematical Mitigation Strategies for Algorithmic Sycophancy

    Jun 16, 2026Sayantari Ghosh, Saumik Bhattacharya, Partha Pratim ChakrabartiSycophancyDeception

  34. Decoding Hidden Deception in Reasoning LLMs: Activation Explainers for Deception Auditing

    Jun 16, 2026Kexin Chen, Yi Liu, Haonan Zhang +3DeceptionLLM Reasoning Strategies

  35. RogueAI: A Reverse Turing Test for Detecting Licensed AI Deception in Dialogue

    Jun 11, 2026Sara Candussio, Emanuele Ballarin, Lorenzo Bonin +2DeceptionTrustworthy Artificial Intelligence

  36. DeceptionX: Explainable Deception Detection with Multimodal Large Language Models

    Jun 9, 2026Jiayu Zhang, Shuo Ye, Jiajian Huang +7DeceptionMultimodal Large Language Models

  37. Janus: A Benchmark for Goal-Conditioned Information Distortion in LLMs

    Jun 9, 2026Polydoros Giannouris, Mohsinul Kabir, Sophia AnaniadouDeceptionImplicit

  38. Sycophancy Towards Researchers Drives Performative Misalignment

    Jun 7, 2026David D. Baek, Xinnuo Li, Anay Gupta +4SycophancyArtificial Intelligence Alignment

  39. Building Comparative Motivation Profiles with Instrumental Interventions

    Jun 6, 2026David Vella Zarb, Rustem Turtayev, Taywon Min +2Artificial Intelligence AlignmentDeception

  40. Do Coding Agents Deceive Us? Detecting and Preventing Cheating via Capped Evaluation with Randomized Tests

    Jun 5, 2026Thanawat Lodkaew, Johannes Ackermann, Soichiro Nishimori +3Coding AgentsAgentic Evaluations

  41. IDO: Incongruity-aware Distribution Optimization for Multimodal Fake News Detection

    Jun 2, 2026Hengyang Zhou, Rongman Hong, Yuxuan Zhou +2Fake News DetectionCross-Modal Conflicts

  42. SPADE-Bench: Evaluating Spontaneous Strategic Deception in Agents via Plan-Action Divergence

    Jun 1, 2026Yuyan Bu, Haowei Li, Qirui Zheng +7DeceptionAutonomous Agents

  43. "I Strongly Suspect This Website Is a Scam": Benchmarking PII Leakage and Detection without Defense in Autonomous Web Agents

    May 30, 2026Soham Roy, Sarthakbrata Halder, Arya Bharaty +5Web AgentsData Leakage

  44. When LLMs Learn to Be Consistently Wrong: A Multi-Model Study of Linear Representations of Synthetic Deception

    May 28, 2026Vahideh ZolfaghariDeceptionLayer-Wise

  45. Evolving and Detecting Multi-Turn Deception using Geometric Signatures

    May 26, 2026Surender Suresh Kumar, Mary L. CummingsDeceptionLarge Language Model Safety

  46. Voluntary Collusion with Secret Tools in Competing LLM Agents

    May 26, 2026Xijie Zeng, Frank RudziczCollusionLarge Language Model Agents

  47. QUACK: Questioning, Understanding, and Auditing Communicated Knowledge in Multimodal Social Deduction Agents

    May 26, 2026Ye Yuan, Rui Song, Weien Li +12Multimodal AgentsDeception

  48. PocketAgents: A Manifest-Driven Library of Autonomous Defense Agents

    May 20, 2026Sidnei Barbieri, Ágney Lopes Roth Ferraz, Lourenço Alves Pereira JúniorAgentic DeploymentsDeception

  49. DECOR: Auditing LLM Deception via Information Manipulation Theory

    May 19, 2026Linyue Cai, Samuel Yeh, Jwala Dhamala +2DeceptionEmotional Manipulation