LLM Agents

LLM: Large Language Model

Latest papers 433

All topics
CardsList
  1. Fewer Assumptions by Design: A Reusable Skill for LLM-Assisted Verus Verification

    Sep 28, 2026Andrada-Livia Antoneac, Dorel Lucanu, Dragoş Teodor GavriluţFormal VerificationLLM Agent Skill Learning

  2. VehicleArena: A Realistic Urban Environment for Multi-Agent Driving

    Sep 28, 2026Jie Yang, Jiajun Chen, Jiazheng Zhou +4Autonomous Driving BenchmarksAutonomous Driving

  3. SGG-ReflAct: Sub-Goal Guided ReflAct with Structured Planning for Reliable Long-Horizon Reasoning

    Sep 28, 2026Jaeho Jung, Sung Hoon JungLLM AgentsLong-Horizon LLM Agents

  4. StateGuard: Analytical-State Management with Validity-Aware Intervention for Long-Horizon Data Agents

    Sep 28, 2026Wenle Liao, Zhao Wang, Jingchao Zhang +3LLM Agent VerificationGraph-Based Agent Memory

  5. UOPD: Uncertainty-Aware Intervention for On-Policy Distillation of Multi-Turn Agents

    Sep 27, 2026Wenbo Zhang, Pengcheng Xu, Weizhi Du +2LLM AgentsUncertainty-Aware Knowledge Distillation

  6. AgentBoundary: Counterfactual Evaluation of Safety in Tool-Using LLM Agents

    Sep 27, 2026Tianzhuo Yang, Zirui Mi, Yantao Huang +4LLM Agent EvaluationLLM Agents

  7. LLM Parkinsonism: Executive-Control Failure, Token-Inefficient Persistence, and an Uncertainty-Aware Global Executive Control Architecture for Autonomous Language-Model Agents

    Sep 25, 2026Dongsheng Xiao, Zeyuan Wang, Xuzhe Xia +2Overthinking in Language ModelsLLM Agents

  8. ASIRF: An Agentic Framework for Context-Dependent Sensitive Information Redaction

    Sep 24, 2026Sudha Priyadarshini, Mohamed Chahine GhanemPrivacy-Preserving Language ModelsLLM Agents

  9. PFArena: Benchmarking Language Models for Protein Modification

    Sep 24, 2026Yawen Ouyang, Xinbo Zhang, Ziyuan Ma +15Protein Fitness PredictionProtein Language Models

  10. Live Assistant: Learning Whether, When, and Whom to Assist in Real-World Live Social Streams

    Sep 23, 2026Shujian Gao, Jiamei Yan, Yuchen Yang +6Human-AI InteractionProactive Assistance

  11. TimeEvo: Failure-Driven Self-Evolution of a Time Series Agent

    Sep 23, 2026Jie Yang, Yan Zheng, Jiarui Sun +8Time Series QALLM Agent Self-Improvement

  12. UniDataAgent: An Ontology-Grounded Agent for Enterprise Question-to-Report Automation

    Sep 23, 2026Yutai Duan, Yahui Zhao, Zhangti Li +5Tool-Using AgentsLLM Agents

  13. Harness as a Language: A Minimalist Agent Framework With Maximal Expressivity

    Sep 22, 2026Zhening Li, Joshua Liu, Mateja Vukelic +7LLM Agent MemoryLLM Agent Self-Improvement

  14. REFLEX with Jev for Efficient Selective Control in LLM Agents

    Sep 22, 2026Tiantong Wu, Wei Yang Bryan LimLLM Inference EfficiencyLLM Agent Evaluation

  15. Qwen-Audio-3.1-Realtime: Towards Reliable Agentic Voice Interaction

    Sep 21, 2026Lujia Bao, Qian Chen, Luyao Cheng +15Tool-Augmented Language Model AgentsSpeech Foundation Models

  16. Data Agents: Agentic Data Systems

    Sep 21, 2026Guoliang Li, Peiyao Zhou, Xuanhe Zhou +3LLM AgentsData Analysis Agents

  17. Cognitive Extensions for Dual-Process Language Agents: Memory and Self-Reflection in Interactive Environments

    Sep 16, 2026João Meneses dos Santos, Arlindo L. OliveiraCognitive Architectures for AI AgentsRuntime Enforcement for AI Agents

  18. Interpreting and Steering LLM Agents for Social Simulations

    Sep 14, 2026Jiayue Gaveal Fan, Arul Murugan, Shreyas Krishnan +1LLM InterpretabilityHuman Behavior Simulation

  19. Cheap Talk Stabilizes Strategic Interaction in LLM Agents

    Sep 14, 2026Nunzio Lorè, Hongan Zhu, Babak HeydariRepeated GamesLLM Agents

  20. Enabling Creative Exploration for Vibe Design Agents

    Sep 14, 2026Yifan Zhang, Nghi D. Q. Bui, Georgios Evangelopoulos +1Agentic Code GenerationLLM Agents

  21. The average-farmer illusion in language-model simulations of agricultural decisions

    Sep 14, 2026Zhanliang Zhu, Ziwei Li, Yuchen Liu +5Synthetic Data GenerationLLM Agents

  22. GTA: Graph Theory Agent and Benchmark for Algorithmic Graph Reasoning with LLMs

    Sep 14, 2026Zixiang Xu, Yanbo Wang, Chenxi Wang +6LLM Reasoning with GraphsLLM Agents

  23. Do LLMs Trust the Accuser or the Accusation? Measuring Belief Shifts in Werewolf

    Sep 14, 2026Yu-Yu Yang, Ti-Rong Wu, Hung Guei +2Social Deduction GamesPragmatic Reasoning in Language Models

  24. AgentKV: Phase-Aware KV Eviction for Agentic LLMs

    Sep 14, 2026Taowen Tony Liu, Jeffrey T. H. Wong, Can Xiao +3KV CachingKV-Cache Eviction