LLM Decision-Making

LLM: Large Language Model

Momentum

28 papers in the last four weeks, up 460% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 126

All topics
CardsList
  1. TypedBench: A Benchmark for Calibration, Framing Sensitivity, and Cost in System One Decision Models

    Oct 8, 2026Rahul Sharma, Andrew B. Ducan, Gaétan Marceau Caron +1LLM Decision-MakingLanguage Model Calibration

  2. System Switch: When Should a Fast Decision Model Stop and Think?

    Oct 7, 2026Gian Luca BailoLLM Decision-MakingSelective Prediction

  3. InsClaimBench: Benchmarking Insurance Claim Adjudication Across the Decision Chain

    Oct 7, 2026Linqi Zhang, Chong Qi, Yan Cheng +4AI-Assisted Decision MakingLLM Evaluation

  4. How Do Agentic LLMs Decide to Call Tools? A Tool-Call Vector Shaped by Suppression

    Oct 7, 2026Xijie Gong, Tingxu Han, Jiahao Zhang +5LLM Tool UseLLM Decision-Making

  5. Training Language Models To Be Coherent Decision-Makers

    Oct 6, 2026Khurram Yamin, Xavier Fernandes, Paul Koch +2LLM Decision-MakingDecision-Making under Uncertainty

  6. Do LLMs Act on What They Know? From Partner Representations to Cooperative Actions

    Oct 6, 2026Yuhwan Jeong, Jinnyeong Yang, Kuk-Jin YoonMulti-Agent LLM SystemsLLM Interpretability

  7. On Open-Ended Information Seeking for Information Elicitation Agents

    Oct 5, 2026Victor De Lima, Grace Hui YangValue of InformationLLM Decision-Making

  8. Code Owns the Simulation, Jev Owns the Evaluation

    Oct 1, 2026Yaodong Yang, Hongyao Tang, Yi Ma +4AI Agent EvaluationRobotic Policy Evaluation

  9. AnyJev Technical Report

    Sep 30, 2026Jiamu Zhang, Tianze Yang, Yucheng Shi +6Multiple-Choice Question AnsweringLanguage Model Calibration

  10. Before Agents Decide: Epistemic Action in LLM-Based Systems

    Sep 30, 2026Yizhi Liu, Balaji Padmanabhan, Siva ViswanathanLLM Decision-MakingLLM Agents

  11. When the Right Answer Is Missing: An Arithmetic-Dependent Rejection Bottleneck in Jev

    Sep 30, 2026Jike Zhong, Ming Li, Yuxiang LaiNumerical Reasoning in Language ModelsSelective Prediction

  12. StreamDecisionBench: Evaluating Decisions in Force on Evolving Language Streams

    Sep 29, 2026Jhen-Ke Lin, Chung Chun WangLLM EvaluationLLM Inference

  13. Benchmarking System One decision models against trained classifiers and language models for automated decision gates

    Sep 29, 2026Amir Rafe, Subasish DasLLM Decision-MakingLLM Evaluation

  14. Diagnosing and Improving Probabilistic Reasoning in Large Language Models

    Sep 29, 2026Huaman Sun, Dingcheng Wang, Jason Hartline +1RL for Language Model ReasoningLLM Decision-Making

  15. Can a Cacheable Decision Model Follow Rules?

    Sep 29, 2026Dushyant Rajput, Nirdesh Chauhan, Siddharth KosarajuLLM Inference AccelerationLLM Decision-Making

  16. EnterpriseBench: Benchmarking LLM Agents on Enterprise-Level Strategic Reasoning and Decision-Making

    Sep 29, 2026Min Yang, Yichen Pan, Jinghua Piao +3AI-Assisted Decision MakingLLM Agent Evaluation

  17. Rational Clarification by Assistive Agents via Value-of-Information Reasoning

    Sep 29, 2026T. Duy Nguyen-Hien, Yee Whye Teh, Wee Sun Lee +1Value of InformationClarification Question Generation

  18. Chinese-Jev: Bringing System One Model to Chinese-Language Tasks

    Sep 29, 2026Zexiao Wang, Zihao Zhang, Xudong Wang +5LLM Decision-MakingEfficient Language Model Inference

  19. Engineering Simplicity: Simple Mechanism Interfaces Steer LLM Agents

    Sep 28, 2026Kehang Zhu, Anand Shah, David ParkesLLM Decision-MakingLLM Agents

  20. RGDT-Bench: Benchmarking LLM Reasoning for Rule-Governed Decisions and Their Justifications

    Sep 28, 2026Jianpeng Zhao, Haihua Xu, Haoyang Zhang +7LLM Safety BenchmarksLLM Decision-Making

  21. Over-Personalization Is a Decision Failure: Generation-Induced Apply Bias in LLMs

    Sep 28, 2026Haeun Jang, Yonghyun Jun, Hwanhee LeePersonalized Language ModelsLLM Decision-Making

  22. JevOut: Natural Context Can Flip Decision Models

    Sep 24, 2026Zixiang Xu, Zirui Song, Chiyu Zhang +4Adversarial Attacks on LLMsLLM Decision-Making