LLM Agents

LLM: Large Language Model

Latest papers 433

All topics
CardsList
  1. SkillFuzz: Fuzzing Skill Composition for Implicit Intents Discovery in Open Skill Marketplaces

    Jul 2, 2026Jinwei Hu, Yi Dong, Youcheng Sun +1LLM AgentsAgent Skill Security Auditing

  2. AgenticSTS: A Bounded-Memory Testbed for Long-Horizon LLM Agents

    Jul 2, 2026Xiangchen Cheng, Yunwei Jiang, Jianwen Sun +7LLM Agent MemoryLong-Horizon Agent Evaluation

  3. Skills Are Not Islands: Measuring Dependency and Risk in Agent Skill Supply Chains

    Jul 1, 2026Changguo Jia, Tianqi Zhao, Runzhi He +1LLM AgentsAgent Skill Security Auditing

  4. Can Agents Generalize to the Open World? Unveiling the Fragility of Static Training in Tool Use

    Jul 1, 2026Song-Lin Lv, Weiming Wu, Rui Zhu +2Fine-TuningDistribution Shift

  5. A Tutorial on Autonomous Fault-Tolerant Control Using Knowledge-Grounded LLM Agents

    Jun 30, 2026Javal Vyas, Milapji Singh Gill, Artan Markaj +2Language Model-Based ControlFault-Tolerant Control

  6. LLM Agents Are Latent Context Managers: Eliciting Self-Managed Context via State Proprioception

    Jun 29, 2026Binyan Xu, Haitao Li, Kehuan ZhangTool-Augmented Language Model AgentsLLM Agent Memory

  7. DuoMem: Towards Capable On-Device Memory Agents via Dual-Space Distillation

    Jun 29, 2026Peyman Hosseini, Ondrej Bohdal, Ahmed Alajrami +6LLM AgentsLLM Agent Training

  8. Where Do CoT Training Gains Land in LLM based Agents?

    Jun 25, 2026Jingyu Liu, Zhiwen Wang, Yuxin Jing +2CoT ReasoningLLM Agents

  9. Diagnosing Task Insensitivity in Language Agents

    Jun 25, 2026Jingyu Liu, Xiaopeng Wu, Kehan Chen +2OOD GeneralizationLLM Agents

  10. Agents That Know Too Much: A Data-Centric Survey of Privacy in LLM Agents

    Jun 25, 2026Nada Lahjouji, Ashwin Gerard ColacoPrivacy Leakage in Language ModelsInformation Flow Control

  11. The Interplay of Harness Design and Post-Training in LLM Agents

    Jun 24, 2026Kyungmin Kim, Youngbin Choi, Seoyeon Lee +3Agent Harness OptimizationLLM Agents

  12. DeepBD: A Grounded Agentic Workflow for Variant Prioritization and Diagnosis of Genetic Birth Defects

    Jun 23, 2026Shiyu Li, Ziqi Yan, Zhihao Wu +7Rare Disease DiagnosisLLM Agents

  13. Escaping the Self-Confirmation Trap: An Execute-Distill-Verify Paradigm for Agentic Experience Learning

    Jun 23, 2026Shiding Zhu, Yudi Qi, Yajie Wang +6LLM AgentsSelf-Evolving Agents

  14. CLI-Universe: Towards Verifiable Task Synthesis Engine for Terminal Agents

    Jun 22, 2026Zhanbo Hua, Yifan Yao, Weihao Xie +14LLM Agent Trajectory SynthesisLLM Agents

  15. Harness-MU: A Safe, Governed, and Effective Harness for Multi-User LLM Agents

    Jun 20, 2026Wangxuan Fan, Xiaoyu Nie, Zhongxiang DaiPrivacy-Preserving Language ModelsLLM Agent Security

  16. Autonomous Event-Driven Multi-Agent Orchestration for Enterprise AI at Scale

    Jun 18, 2026Harsh Rao Dhanyamraju, Leonidas Raghav, Aaron LeeMulti-Agent OrchestrationAI Agent Evaluation

  17. Uncertainty Decomposition for Clarification Seeking in LLM Agents

    Jun 17, 2026Gregory MatsnevLLM AgentsLLM Uncertainty Estimation

  18. LegalWorld: A Life-Cycle Interactive Environment for Legal Agents

    Jun 17, 2026Songhan Zuo, Shengbin Yue, Tao Chiang +4Agent EvaluationLLM Agents

  19. WEQA: Wearable hEalth Question Answering with Query-Adaptive Agentic Reasoning

    Jun 16, 2026Yuwei Zhang, Tong Xia, Bianca Emmerich +5Biomedical QAWearable Sensing

  20. Environment-Grounded Automated Prompt Optimization for LLM Game Agents

    Jun 16, 2026Rean Clive Fernandes, Lukas Fehring, Theresa Eimer +2Multi-Agent LLM SystemsGame-Playing Agents

  21. FinAcumen: Financial Multimodal Reasoning via Self-Evolving Experience Memory Harness

    Jun 16, 2026Pianran Guo, Pengcheng Zhou, Yucheng Jian +3Multimodal ReasoningLLM Agents

  22. Beyond the GUI Paradigm: Do Mobile Agents Need the Phone Screen?

    Jun 16, 2026Li Gu, Zihuan Jiang, Linqiang Guo +6Mobile GUI AutomationAI Coding Agents

  23. ACCORD: Action-Conditioned Contextual Grounding for Language Agents

    Jun 15, 2026Lai Jiang, Cheng Qian, Zhenhailong Wang +3LLM GroundingTool-Augmented Language Model Agents

  24. Agentic Publication Protocol: An Attempt to Modernize Scientific Publication

    Jun 15, 2026Sirui Lu, Xiao-Liang QiAI-Assisted Scientific ResearchScientific Communication

  25. From Question Answering to Task Completion: A Survey on Agent System and Harness Design

    Jun 14, 2026Jianyuan Guo, Zhiwei Hao, Chengcheng Wang +14LLM Agent EvaluationLLM Agents