User Simulation

Latest papers 76

All topics
CardsList
  1. Beyond Borrowed Histories: Person-Aligned User Simulation for Interactive Role-Playing Evaluation

    Jul 30, 2026Yuhang Zhu, Mingxuan Du, Benfeng Xu +3LLM EvaluationLarge Language Model-Based Role-Play Simulation

  2. Instruction-Tuned Language Models Cannot Sample from Distributions They Can Describe

    Jul 28, 2026Chaemin Jang, Dongman Lee, Jihee KimLanguage Model DecodingLLM Prompting

  3. A Diffusion-Model Subpopulation Digital Twin for Mobile Health Deployment: A Case Study on the HeartSteps Intervention

    Jul 23, 2026Ziping Xu, Yuyi Chang, Chenshun Ni +5Digital TwinsUser Simulation

  4. SenWorld: A Digital-Twin Simulation for Generating Context-Rich Evaluation Data

    Jul 22, 2026Zenghui Zhou, Xiaoyang Li, Xiaoxuan Qiao +2Synthetic Data GenerationAgent Evaluation

  5. Autonomous Information Seeking: A Roadmap for Agentic Recommender Systems

    Jul 5, 2026Xinyu Lin, Yashar Deldjoo, Sunhao Dai +7LLM Agent EvaluationRecommender Systems

  6. SIMAX: A Scalable and Interpretable Framework for Multi-Fidelity and Annotated Clinician-Patient Dialogue Simulation

    Jun 29, 2026Zhuhan Bao, Rui Yang, Bohao Yang +16Human Behavior SimulationControllable Speech Generation

  7. Cognitive World Models for Process-Level Social Influence Evaluation

    Jun 28, 2026Minghui Ma, Bin Guo, Han Wang +4LLM EvaluationCognitive Modeling

  8. Learning User Simulators with Turing Rewards

    Jun 17, 2026Yingshan Susan Wang, Cedegao E. Zhang, Linlu Qiu +5Reward ModelingRL for Language Models

  9. Dialogue SWE-Bench: A Benchmark for Dialogue-Driven Coding Agents

    Jun 12, 2026Brendan King, Jeffrey FlaniganCoding AgentsLLM Agent Evaluation

  10. VISTA: A Versatile Interactive User Simulation Toolkit for Agent Evaluation

    Jun 9, 2026Yunan Lu, Ryan Shea, Yusen Zhang +1Human Behavior SimulationAI Agent Evaluation

  11. Does Persona Make LLMs K-pop Fans? A Pilot Study of LLM-Based Online Concert Audience Agents

    Jun 5, 2026Kirak Kim, Hyojin Kim, Yejin Son +2Multi-Agent LLM SystemsLLM Agent Evaluation

  12. PerceptUI: LLM Agents as Human-Aligned Synthetic Users for UI/UX Evaluation

    Jun 4, 2026Nicolas Bougie, Xiaotong Ye, Gian Maria Marconi +1User ModelingUser Simulation

  13. When Clients Stop Following: A Cognitive Conceptualization Diagram-driven Framework for Strategic Counseling

    Jun 3, 2026Yihao Qin, Junyi Zhao, Changsheng Ma +4Mental Health CounselingCognitive Modeling

  14. Who Am I? History-Aware Profiles for Student Simulation in Tutoring Dialogues

    May 28, 2026Zhangqi Duan, Shuyan Huang, Alexander Scarlatos +3Large Language Model-Based Role-Play SimulationIntelligent Tutoring Systems

  15. When Seekers Are Hard to Help: Evaluating Emotional Support Dialogue Systems in Worst-Case Interactions

    May 27, 2026Jiajie Yang, Yangchun Li, Guanyi Chen +3Emotional Support ConversationUser Simulation

  16. Recon: Reconstruction-Guided Reasoning Synthesis for User Modeling

    May 26, 2026Alan Zhu, Mihran Miroyan, Carolyn Wang +4CoT ReasoningUser Modeling

  17. Simulating Human Memory with Language Models

    May 25, 2026Qihan Wang, Nicholas Tomlin, Michael Hu +2LLM EvaluationMemory-Augmented Language Models

  18. Toward a Benchmark for Controllable Simulation of Imperfect Students with Large Language Models

    May 25, 2026Alexander Apartsin, Omri Sason, Yehudit ApersteinLLM EvaluationLanguage Model-Based Control

  19. Unlocking Proactivity in Task-Oriented Dialogue

    May 21, 2026Azure Zhang, Ning Gao, Yuqin Dai +7LLM Post-TrainingConversational Agents

  20. SimGym: A Framework for A/B Test Simulation in E-Commerce with Traffic-Grounded VLM Agents

    May 19, 2026Han Li, Vibhor Malik, Zahra Zanjani Foumani +17Tool-Using Vision-Language AgentsA/b Testing

  21. Beyond Cooperative Simulators: Generating Realistic User Personas for Robust Evaluation of LLM Agents

    May 13, 2026Harshita Chopra, Kshitish Ghate, Aylin Caliskan +3Human Behavior SimulationLLM Agent Evaluation

  22. PrivacySIM: Evaluating LLM Simulation of User Privacy Behavior

    May 12, 2026James Flemings, Murali AnnavaramLLM EvaluationUser Modeling