Large Language Model Agents

Latest papers 875

All topics
CardsList
  1. Automated Membership Inference Attacks (AutoMIA): Discovering MIA Signal Computations using LLM Agents

    Mar 19, 2026Toan Tran, Olivera Kotevska, Li XiongMembership Inference AttacksAgentic Inference

  2. Retrieval-Augmented LLM Agents: Learning to Learn from Experience

    Mar 18, 2026Thomas Palmeira Ferraz, Romain Deffayet, Vassilina Nikoulina +2Large Language Model AgentsMemory-Augmented Framework

  3. AgentWorm: Self-Propagating Attacks Across LLM Agent Ecosystems

    Mar 16, 2026Yihao Zhang, Zeming Wei, Xiaokun Luan +7Multi-Llm AgentsLarge Language Model Agents

  4. Catalyst-Agent: Autonomous heterogeneous catalyst screening with an LLM Agent

    Mar 1, 2026Achuth Chandrasekhar, Janghoon Ock, Amir Barati FarimaniHeterogeneous CatalysisMaterials Science

  5. Evaluating Test-Time Scaling of General LLM Agents

    Feb 22, 2026Xiaochuan Li, Ryan Ming, Pranav Setlur +6Test-Time ScalingLarge Language Model Agents

  6. Evaluating Collective Behaviour of Hundreds of LLM Agents

    Feb 18, 2026Richard Willis, Jianing Zhao, Yali Du +1Multi-Agent SimulationsCollective Behaviors

  7. TSR: Trajectory-Search Rollouts for Multi-Turn RL of LLM Agents

    Feb 12, 2026Aladin Djuhera, Swanand Kadhe, Farhan Ahmed +3Multi-Turn Reinforcement LearningAutoregressive Rollout

  8. ReplicatorBench: Benchmarking LLM Agents for Replicability in Social and Behavioral Sciences

    Feb 11, 2026Bang Nguyen, Dominik Soós, Qian Ma +8ReproducibilityAgentic Benchmarks

  9. Pushing Forward Pareto Frontiers of Proactive Agents with Behavioral Agentic Optimization

    Feb 11, 2026Yihang Yao, Zhepeng Cen, Haohong Lin +6Multi-Llm AgentsLarge Language Model Agents

  10. Evaluating Memory Structure in LLM Agents

    Feb 11, 2026Alina Shutova, Alexandra Olenina, Ivan Vinogradov +1Agentic MemoryLarge Language Model Agents

  11. Demonstration-Free Robotic Control via LLM Agents

    Jan 28, 2026Brian Y. Tsui, Alan Y. Fang, Tiffany J. HwuRobotic ManipulationEmbodied Agents

  12. AstroAgentBench: Evaluating Agentic Planning on Space Mission Planning Tasks

    Jan 16, 2026Weiyi Wang, Xinchi Chen, Jingjing Gong +2SpacecraftHuman-Centric Mission Planning

  13. VLM-CAD: VLM-Optimized Collaborative Agent Design Workflow for Analog Circuit Sizing

    Jan 12, 2026Guanyuan Pan, Shuai Wang, Yugui Lin +4Analog DesignMultimodal Reasoning

  14. Beyond Static Summarization: Proactive Memory Extraction for LLM Agents

    Jan 8, 2026Chengyuan Yang, Zequn Sun, Wei Wei +1Large Language Model AgentsSummarization

  15. Auditable Context-Aware HFMD Forecasting with Structured LLM Agents

    Nov 28, 2025Joongwon Chae, Runming Wang, Chen Xiong +5Data-Driven ForecastingEpidemiological Models

  16. Communication and Verification in LLM Agents towards Collaboration under Information Asymmetry

    Oct 29, 2025Run Peng, Ziqiao Ma, Amy Pang +5Large Language Model AgentsCollaboration

  17. Check Yourself Before You Wreck Yourself: Selectively Quitting Improves LLM Agent Safety

    Oct 18, 2025Vamshi Krishna Bonagiri, Ponnurangam Kumaragurum, Khanh Nguyen +1Large Language Model AgentsLarge Language Model Safety

  18. Why Do LLM Agents Fail in Exploring New Environments? A World-Modeling Perspective

    Oct 16, 2025Shiqi Chen, Tongyao Zhu, Zian Wang +8Large Language Model AgentsNext-State Prediction

  19. Domain-Specific Agents for Cherenkov Telescope Array Control Software and Gamma-Ray Data Analysis

    Oct 1, 2025Dmitriy Kostunin, Elisa Jones, Vladimir Sotnikov +3Data Science AgentsCanada-France-Hawaii Telescope Data

  20. BuildBench: Benchmarking LLM Agents on Compiling Real-World Open-Source Software

    Sep 27, 2025Zehua Zhang, Ati Priya Bajaj, Divij Handa +14Large Language Model AgentsOpen-Source

  21. Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions

    Jul 7, 2025Yuanzhe Hu, Yu Wang, Julian McAuleyAgentic MemoryLarge Language Model Agents

  22. AgentMisalignment: Measuring the Propensity for Misaligned Behaviour in LLM-Based Agents

    Jun 4, 2025Akshat Naik, Emma Gouné, Patrick Quinn +4Large Language Model AgentsMisalignment Persona

  23. AgentRM: Enhancing Agent Generalization with Reward Modeling

    Feb 25, 2025Yu Xia, Jingru Fan, Weize Chen +7Large Language Model AgentsReward Functions

  24. LLM Agents Grounded in Self-Reports Enable General-Purpose Simulation of Individuals

    Nov 15, 2024Joon Sung Park, Carolyn Q. Zou, Jonne Kamphorst +8User SimulationLarge Language Model Agents

  25. Agent-OM: Leveraging LLM Agents for Ontology Matching

    Dec 1, 2023Zhangcheng Qiang, Weiqing Wang, Kerry TaylorOntologyLarge Language Model Agents

  26. Clearing the Fog: Towards Installing and Refining Proactive Exploration Capabilities in LLM Agents

    Date pendingZhizhao Guan, Chen Huang, Ziming Liu +5Large Language Model AgentsExploration