Elicitation

Momentum

13 papers in the last four weeks, up 117% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 78

All topics
CardsList
  1. Learning Steganography Is Easy, Learning Steganographic Reasoning Is Hard

    Sep 30, 2026Julian Schulz, Lukas Fülle, Rieke FruengelSteganographyChain-of-Thought Reasoning

  2. Diagnosing and Improving Probabilistic Reasoning in Large Language Models

    Sep 29, 2026Huaman Sun, Dingcheng Wang, Jason Hartline +1LLM Reasoning StrategiesProbabilistic Model

  3. From Judgment Quality to Downstream Utility: Rethinking LLM-as-a-Judge for Open-Ended Tasks

    Sep 29, 2026Zheng Zhang, Lufei Li, Xinyue Tan +4Llm-As-A-JudgeDownstream Reasoning

  4. Elicitation and Decision Geometry in Single-Index Bandits

    Sep 28, 2026Sakshi Arya, Cheng Soon OngMonotonicityReward Functions

  5. How Much Imprecision is Enough Imprecision in my Classifier? A Practical Elicitation Procedure

    Sep 27, 2026Victor F. Lopes de Souza, Sébastien Destercke, Abdelhak ImoussatenElicitationClassifier

  6. SeeQ: Training Generalist Value Functions for Long-Horizon Robotic Manipulation

    Sep 18, 2026Saksham Singh, Zheyuan Hu, Max Sobol Mark +3Robot PoliciesRobotic Manipulation

  7. Corrupt Plans, Clean Traces: Evading Chain-of-Thought Monitoring with Plan Injection

    Sep 14, 2026Keertana Chidambaram, Andrew Ilyas, Vasilis SyrgkanisAdversarial RobustnessChain-of-Thought Reasoning

  8. GUIDE: Generative Utility Inference and Decision Engine

    Sep 14, 2026Anagha Tiwari, Alexander G. Gray, Nick Feamster +3Preference Alignment LearningElicitation

  9. Scored vs. Generated Readouts in Behavioral Language Models: An Empirical Study of Elicitation Format

    Sep 9, 2026Touchapon Kraisingkorn, Krittin Pachtrachai, Wachiravit ModecruaFree-Form Textual RationalesReadout

  10. Navigating the digital spectrum: Assessing political bias, stability, and downstream fairness in Large Language Models

    Sep 8, 2026Luka Debevc, Nishan Chatterjee, Antoine Doucet +2Large Language Model BiasHate Speech Detection

  11. LEAP: Likelihood Elicitation and Aggregation for LLM-based Probabilistic Forecasting

    Sep 1, 2026Yufei Chen, Yiran Zhao, Xiaogang Xu +3Large Language Model ForecastingProbabilistic Forecasting

  12. DualStake: Dual-Path Confidence Calibration in Deep Research Agents

    Sep 1, 2026Yinuo Xu, Yuwei Liang, Jianjie Cheng +4Confidence CalibrationDeep Research

  13. BLOOM-WILT: Logit Tilting for Behaviour Elicitation in Automated LLM Auditing

    Aug 31, 2026Adrians Skapars, Edoardo ManinoLarge Language Model EvaluationModel Auditing

  14. Improving Information Extraction with Learned Queries

    Aug 31, 2026Omar Sharif, Soroush Vosoughi, Nikhil SinghInformation ExtractionQueries

  15. R2^2A: Learning Persona Policies Through Persona Representation Learning and Runtime Alignment

    Aug 30, 2026Mohan Zhang, Chengsong You, Xiaoyu Cao +4Behavioral Foundation ModelsArtificial Intelligence Alignment

  16. Scale-to-Dialogue: Low-Burden Elicitation of Daily Premenstrual Symptom Ratings with Small Language Models

    Aug 9, 2026Yifan WangElicitationPatients

  17. SABRE: Scalable and Automated Benchmarking of VLMs under Stress

    Aug 7, 2026Zixuan Lan, Luzhe Sun, Matthew R. Walter +1Vision-Language Foundation ModelsDouble-Edged Sword

  18. Personalized Deep Research Query Refinement with Graph-Scaffolded Evidence Grounding

    Aug 6, 2026Soojin Yoon, Dongha LeeDeep ResearchAgentic Search

  19. AI-assisted Script Management for Requirements Elicitation Interviews

    Aug 3, 2026Anmol Singhal, Paulo Carvalho, Travis BreauxInterviewsElicitation

  20. SpecFirst: Behavioral Specification Elicitation as a First-Class Step in Agent-Based Program Synthesis from Scratch

    Jul 29, 2026Yihao Chen, Shi Chang, Feng Lin +4Llm-Driven Code SynthesisCoding Agents

  21. From Dyad to Triad: Eliciting XAI Requirements in Stroke Rehabilitation

    Jul 28, 2026Param Rajpura, Yogesh Kumar MeenaRehabilitationXai

  22. Elicitation without Backpropagation: Steering Model Behavior by Optimizing the Latent Posterior

    Jul 21, 2026Garrett Baker, Vinayak Pathak, Daniel Murfet +1PosteriorTransformer Architectures

  23. ReqGenX: An Empirical Study of Atomic Decomposition, Artifact Regeneration, and Reconstruction for Legacy SRS Documents

    Jul 18, 2026Ragib Shahariar Ayon, Rayed Fahmi, Sumon Biswas +1Empirical StudyElicitation

  24. Retrieval is Enough: Training-Free Interpretability with a Tool-Using Agent

    Jul 17, 2026Sriram Balasubramanian, Soheil FeiziInterpretabilityModel Activations

  25. PACE: Persona Adaptation through Conversational Elicitation in Human-Robot Interaction

    Jul 17, 2026Peizhen Li, Longbing Cao, Megani Rajendran +3Human-Robot InteractionPersona Consistency

  26. Evaluating RE Practices for Explainability: Synthesizing Insights from Daimler Truck into an Explainable RE Framework Proposal

    Jul 13, 2026Umm-e- Habiba, Lucas Mauser, Jonas Fritzsch +2ExplainabilityElicitation

  27. NeuReasoner: Theory-grounded Mapping of Reasoning Elicitation Boundaries

    Jun 29, 2026Aydin Javadov, Shyngys Aitkazinov, Tobias Hoesli +3Reasoning SkillsElicitation

  28. Fuzzing Large Language Models to Elicit Hidden Behaviours

    Jun 28, 2026Mohammed Abu Baker, Lakshmi Babu-SaheerFuzzingElicitation

  29. Probing the Misaligned Thinking Process of Language Models

    Jun 23, 2026Kaiwen Zhou, Constantin Venhoff, Jonathan Michala +2Large Language Model AlignmentDeception

  30. Zero-Shot Active Feature Acquisition via LLM-Elicitation

    Jun 17, 2026Binyamin Perets, Natalie Mendelson, Shiran Vainberg +3Pool-Based Active LearningFeature Engineering

  31. IntElicit: Eliciting and Assessing Contextualized Creativity via Dialogue Policy Optimization

    Jun 10, 2026Mingjia Li, Jin Wu, Hong Qian +7CreativityComputerized Adaptive Testing

  32. Knowing When to Ask: Self-Gated Clarification for Hierarchical Language Agents

    Jun 9, 2026Aijing Gao, Yiming Kang, Mengdie Flora Wang +1ClarificationElicitation

  33. ττ-Rec: A Verifiable Benchmark for Agentic Recommender Systems

    Jun 8, 2026Bharath Sivaram Narasimhan, Karthik R NarasimhanAgentic BenchmarksDialogue Benchmarks

  34. Scaffold Effects on GAIA: A Controlled Comparison

    Jun 7, 2026Jason StaraceScaffoldsOpenai

  35. A Model of Multi-turn Human Persuadability Using Probabilistic Belief Tracing

    Jun 3, 2026Jared Moore, Noah Goodman, Nick Haber +1PersuasionSocial Reasoning

  36. Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data

    Jun 3, 2026XiuYu Zhang, Yi Shan, Junfeng Fang +1Self-EvaluationElicitation

  37. Large Language Models Are Overconfident in Their Own Responses

    Jun 2, 2026Mario Sanz-Guerrero, Manuel Mager, Katharina von der WenseInstruction-Tuned ModelsOverconfidence

  38. On Wednesdays, We Ask Questions: Optimizing "Active Listening" in Automated Legal Triage and Referral

    May 29, 2026Quinten Steenhuis, Jacqueline HarveyLegal Reasoning TasksLegal Domain

  39. Code as a Weapon: A Consensus-Labeled Prompt Bank for Measuring Coding-Model Compliance with Malicious-Code Requests

    May 27, 2026Richard J. Young, Gregory D. MoodyCode QualityLarge Language Model Safety

  40. SNARE: Adaptive Scenario Synthesis for Eliciting Overeager Behavior in Coding Agents

    May 27, 2026Yubin Qu, Yi Liu, Gelei Deng +4Coding AgentsSynthetic Environments

  41. The Communication Complexity of Instant-Runoff Voting

    May 22, 2026Élie de Panafieu, François Durand, Jérôme LangMajority VotingMaximum Independent Set

  42. Smoothed Elicitation Complexity for Approximate ΓΓ-calibration of Discrete Classification Tasks

    May 21, 2026Jessica Finocchiaro, Victor Ganson, Drona KhuranaElicitationApproximation

  43. Efficient Elicitation of Collective Disagreements

    May 19, 2026Mohamed Ouaguenouni, Felipe Garrido-Lucero, Umberto Grandi +2DisagreementMajority Voting

  44. LLM-Based Persuasion Enables Guardrail Override in Frontier LLMs

    May 13, 2026Rodrigo Nogueira, Thales Sales Almeida, Giovana Kerche Bonás +7Argumentation FrameworksElicitation

  45. The Mechanism of Weak-to-Strong Generalization: Feature Elicitation from Latent Knowledge

    May 13, 2026Ryoya Awano, Taiji SuzukiFeature LearningStochastic Gradient Descent

  46. When to Ask a Question: Understanding Communication Strategies in Generative AI Tools

    May 11, 2026Charlotte Park, Kate Donahue, Manish RaghavanGenerative Artificial IntelligenceElicitation

  47. On Distinguishing Capability Elicitation from Capability Creation in Post-Training: A Free-Energy Perspective

    May 8, 2026Yuhao Li, Shengchao LiuPost-TrainingSupervised Finetuning

  48. Elicitation Matters: How Prompts and Query Protocols Shape LLM Surrogates under Sparse Observations

    May 6, 2026Ge Lei, Samuel J. CooperLarge Language Model UncertaintyElicitation