LLM Agents

LLM: Large Language Model

Latest papers 433

All topics
CardsList
  1. Narrow and Deep: An Ontology Tower as the Knowledge of an LLM Agent for an Industrial Equipment System

    Oct 8, 2026Younghwan Joo, Sung-il KimLLM AgentsLLM Agent Evaluation

  2. Curating Always-Loaded Context for LLM Agents: A Capacitated Assortment Model with Censored Feedback

    Oct 7, 2026Zexuan Liu, Yuning Yang, Tiancheng ZhaoLLM Context ManagementLLM Agents

  3. SkillForge: Co-Evolving Skills and Agents via Dynamic Skill Lifecycles

    Oct 7, 2026Yuyao Ge, Yiwei Wang, Yuchen He +5LLM Agent Skill LearningLLM Agents

  4. From Uncertainty to Action: Learning to Steer LLM Agents

    Oct 6, 2026Hanwen Li, Jinhao Duan, Guanhua Zhu +4Language Model SteeringLLM Agents

  5. Do I Need the Cloud? Uncertainty-Aware Step-Level Handoff for Small Language Model Agents

    Oct 6, 2026Abolfazl YounesiSmall Language ModelsLLM Agents

  6. ANT: A Multi-Granularity Network Traffic Dataset and Benchmark for Agents Behavior Auditing

    Oct 5, 2026Fan Li, Xiangyu Gao, Zixuan Liu +4AI Agent AuditingAI Agent Security Benchmarks

  7. RAISED: Self-Distillation for Robustness to Prompt Injection in LLM Agents

    Oct 5, 2026Mohamed Dhouib, Clement Elliker, Alexi Canesse +5Prompt Injection DefenseLLM Agents

  8. Mining Agent Skills from Production Traces

    Oct 5, 2026Yue Ran Kang, Colton Mikolajczyk, Chhaya Methani +4LLM AgentsAgent Skill Learning

  9. Auditing Action Settlement in LLM Agent Environments: Order, Progress, and Replay

    Oct 1, 2026Haotian Chen, Bowen Ye, Yuning Zhang +1Multi-Agent LLM SystemsAI Agent Auditing

  10. Empty Commitments: When Agents Promise What They Cannot Deliver

    Oct 1, 2026Jiaqi Tang, Bingyu Shen, Lan Wei +6AI Agent ReliabilityLLM Agent Evaluation

  11. Before Agents Decide: Epistemic Action in LLM-Based Systems

    Sep 30, 2026Yizhi Liu, Balaji Padmanabhan, Siva ViswanathanLLM Decision-MakingLLM Agents

  12. Mid-Harness: Scaling Actions Between Model and Harness for Terminal Agents

    Sep 30, 2026Minki Kang, Ryo Hachiuma, Shaokun Zhang +8Terminal AgentsTest-Time Scaling

  13. Thinking Outside the Box: Can Language Models Rely on External Guidance Selectively?

    Sep 30, 2026Minghan Wang, Boyuan Wang, Jinhang Zuo +2LLM Agent ReliabilityLLM Agents

  14. Does This Action Still Explain the Task? Reverse Scoring for Diffusion Language Model Agents

    Sep 29, 2026Jiacheng Qiu, Christopher E. Mower, Jan Peters +2Diffusion Language Model DecodingLLM Agents

  15. Do LLM Agents Execute the Plans They Declare? From Planning-Mode Declaration to Pattern-Specific Execution

    Sep 29, 2026Subba Reddy Oota, Francisco Herrera, Jordi Cabot Sagrera +2LLM AgentsLong-Horizon LLM Agents

  16. SimpleEvol: An Agent-Loop Framework for LLM-Driven Automated Heuristic Design with Minimal Human Priors

    Sep 29, 2026Jianghan Zhu, Cong Zhang, Rongjie Zhu +2Automated Heuristic DesignLarge Language Model-Guided Optimization

  17. AnyAct: Universal Action for Self-Evolving Agents

    Sep 29, 2026Lingrui Xu, Yangqin Jiang, Jiachang Zhang +2LLM Agent OrchestrationLLM Tool Use

  18. The Default Trap: Rethinking Plan Evaluation in Tool-Using LLM Agents

    Sep 29, 2026Xueqi Li, Jingjie Ning, Yibo KongLLM Agent EvaluationTool-Using Agents

  19. SafeCoEvo: Co-Evolving Safety Harnesses and Guards for LLM Agents at Test-Time

    Sep 29, 2026Yu Cheng, Yongkang Hu, Shuaijie Ma +12Continual Test-Time AdaptationLLM Agents

  20. Engineering Simplicity: Simple Mechanism Interfaces Steer LLM Agents

    Sep 28, 2026Kehang Zhu, Anand Shah, David ParkesLLM Decision-MakingLLM Agents

  21. Scaling Long-Form Story Generation via Narrative State Tracking

    Sep 28, 2026Zhennan Wan, Jianfei ChenLong-Form Document GenerationLLM Agents

  22. Towards Communication-Efficient Social Intelligence in Language Agents

    Sep 28, 2026Linxiao Gong, Yijie Xu, Tianfu Wang +7LLM AgentsLLM Agent Training

  23. LLMs are General Asynchronous Agents

    Sep 28, 2026George Yakushev, Denis Mazur, Vladimir Bartenev +4LLM AgentsLLM Agent Harnesses

  24. Planarian: Managing Agent State with Statepoints

    Sep 28, 2026Jinnan Guo, Hao Mark Chen, Kapil Vaswani +2LLM AgentsState Tracking

  25. TMCS: Tool-Grounded Multi-Agent Reasoning for Compositional Chemical Problem Solving

    Sep 28, 2026Shengqin Wang, Jie Jin, Yu Cheng +4Molecular OptimizationTool-Augmented Language Model Agents