LLM Agents

LLM: Large Language Model

Latest papers 433

All topics
CardsList
  1. Towards Agentic Agent-based Models: Feasibility, Performance, and Statistical Model Checking

    Jul 20, 2026Stefano Blando, Emanuele Guerrazzi, Riccardo Porcedda +3Agent-Based ModelingLLM Agents

  2. EvolvingWorld: An Open-Schema Framework for Co-Evolving Role-Play Agents and World Model in Interactive Literary World

    Jul 19, 2026Qing Zong, Yue Guo, Mengxin Yang +2Long-Horizon Agent EvaluationLLM Agents

  3. SlotGuard: Stop Oversharing Private Local Context in LLM Agent Transcri

    Jul 19, 2026Haocheng Xia, Yongjoo ParkLLM Agent SecurityPrivacy Leakage in Language Models

  4. Lomekwi: Resource-Bounded Tool Discovery in LLM Agents

    Jul 18, 2026Roshan Klein-Seetharaman, Daniel Wang, Andrew XuLanguage Model Scaling LawsLLM Agent Evaluation

  5. SkillCorpus: Consolidating and Evaluating the Open Skill Ecosystem for Real-World LLM Agents

    Jul 17, 2026Yanze Wang, Pengfei Yao, Tianyi Sun +7LLM Agent EvaluationLLM Agent Skill Retrieval

  6. MCPEvol-Bench: Benchmarking LLM Agent Performance Across Dynamic Evolutions of MCP Servers

    Jul 16, 2026Huanxi Liu, Kun Hu, Jiaqi Liao +6Tool-Use EvaluationAI Agent Benchmarks

  7. Multi-Head Latent Control: A Unified Interface for LLM Agent Decision Making

    Jul 15, 2026Amirhosein Ghasemabadi, Ruichen Chen, Bahador Rashidi +1Multi-Agent LLM SystemsLanguage Model-Based Control

  8. MyAG: A Graph-Based Framework for Designing and Analyzing Composable LLM Agent Systems

    Jul 15, 2026Zhisong ZhangLLM Agent OrchestrationLLM Agents

  9. Towards Reliable AI-Assisted Analog Design: Template-Constrained LLM Agents for SAR ADC Generation

    Jul 15, 2026Dimple Vijay Kochar, Hae-Seung Lee, Anantha P. ChandrakasanElectronic Design AutomationLLM Agents

  10. Do AI Agents Know When a Task Is Simple? Toward Complexity-Aware Reasoning and Execution

    Jul 14, 2026Junjie Yin, Xinyu FengSoftware Engineering AgentsLLM Agent Evaluation

  11. PalmClaw: A Native On-Device Agent Framework for Mobile Phones

    Jul 14, 2026Hongru Cai, Yongqi Li, Ran Wei +1Tool-Using AgentsLLM Agents

  12. TerraLogic: A Benchmark for Hierarchical Geospatial Reasoning in Earth Observation

    Jul 14, 2026Yuhang Yan, Linchao Mou, Bokang Yang +1Spatial Reasoning BenchmarksHierarchical Planning

  13. Fin-Analyst at FinMMEval 2026 Task 3: A Live Hybrid Trading Agent with LLM Specialists and Rule-Based Signals

    Jul 14, 2026Mohotarema Rashid, Lingzi Hong, Junhua Ding +1Multi-Agent LLM SystemsLLM Agent Evaluation

  14. How Do Practitioners Build SE Agents? Insights from a Mixed-Methods Study

    Jul 12, 2026Yunbo Lyu, David Williams, Jieke Shi +5Software Engineering AgentsLLM Agent Evaluation

  15. Imaging-101: Benchmarking LLM Coding Agents on Scientific Computational Imaging

    Jul 12, 2026Siyi Chen, Jiahe Ying, Yixuan Jia +9AI Agents for Scientific DiscoveryComputational Imaging

  16. Can Agentic Trading Systems Pay for Their Own Intelligence?

    Jul 11, 2026Qiqi Duan, Changlun Li, Chen Wang +10LLM Agent EvaluationAgent Evaluation

  17. ProofCouncil: An LLM Agent for Solving Open Mathematical Problems

    Jul 10, 2026Johannes Schmitt, Tim Gehrunger, Jasper Dekoninck +4LLM AgentsMulti-Agent LLMs

  18. Tool-Making and Self-Evolving LLM Agents in Low-Latency Systems

    Jul 9, 2026Kalle Kujanpää, Ning Liu, Shahnawaz Alam +4LLM Inference EfficiencyLLM Agent Self-Improvement

  19. SkillCenter: A Large-Scale Source-Grounded Skill Library for Autonomous AI Agents

    Jul 8, 2026Tianming Sha, Yue Zhao, Lichao Sun +1LLM GroundingLLM Agent Skill Learning

  20. Learning social norms enhances compatibility in dynamic human-AI coordination

    Jul 8, 2026Yi Yang, Siyuan Liu, Xin Gao +4Multi-Agent CoordinationHuman-AI Interaction

  21. Demonstrating TOFFEE: A Learned System for Synthesizing Data Agent Trajectories at Scale

    Jul 7, 2026Ziting Wang, Yin Li, Zuhao Yang +3LLM Agent Trajectory SynthesisLLM Agents

  22. AgoraSim: A Hybrid Agent-Based Modeling Framework

    Jul 7, 2026Chung-Chi ChenHuman Behavior SimulationLLM Agent Orchestration

  23. Norm Enforcement for AI Agents: Robustly Shaping Behavior in Multi-Agent Systems

    Jul 7, 2026Yaowen Ye, Jacob SteinhardtLLM AgentsMulti-Agent Systems

  24. CoACT: Action-Preserving Observation Compression for Coding Agents

    Jul 3, 2026Haorui Chen, Yuancheng Zhu, Yitong Zhang +1AI Coding AgentsLLM Agents

  25. What LLM Agents Say When No One Is Watching: Social Structure and Latent Objective Emergence in Multi-Agent Debates

    Jul 2, 2026Arman Ghaffarizadeh, Danyal Mohaddes, Aliakbar Izadkhah +1LLM Agent EvaluationMulti-Agent Debate