Psychometric Validation

Momentum

3 papers in the last four weeks, against 1 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 48

All topics
CardsList
  1. Measuring Psychological States Through Semantic Projection: A Theory-Driven Approach to Language-Based Assessment

    May 6, 2026Maria Luongo, Davide Marocco, Nicola MilanoPsychometric ValidationClinical NLP

  2. Towards Self-Referential Analytic Assessment: A Profile-Based Approach to L2 Writing Evaluation with LLMs

    May 5, 2026Stefano Bannò, Kate Knill, Mark GalesLLM EvaluationAutomated Essay Scoring

  3. The Hitchhikers Guide to Rubric Quality Understanding and Enrichment

    Apr 1, 2026Ankit Aich, Zhengyang Qi, Charles Dickens +7Agent EvaluationPsychometric Validation

  4. The Ultimate Tutorial for AI-driven Scale Development in Generative Psychometrics: Releasing AIGENIE from its Bottle

    Mar 30, 2026Lara Russell-Lasalandra, Hudson Golino, Luis Eduardo Garrido +1Psychometric Validation

  5. Falsifying Discriminant Validity of Predictive Algorithms

    Jan 23, 2026Amanda CostonAlgorithmic AuditingPsychometric Validation

  6. Psychometric Comparability of LLM-Based Digital Twins

    Dec 22, 2025Yufei Zhang, Zhihao MaLLM EvaluationPersonality Modeling in Language Models

  7. Adaptive Testing for LLM Evaluation: A Psychometric Alternative to Static Benchmarks

    Oct 26, 2025Peiyu Li, Xiuxiu Tang, Si Chen +4LLM EvaluationPsychometric Validation

  8. Human Psychometric Questionnaires Mischaracterize LLM Behavior

    Sep 12, 2025Woojung Song, Dongmin Choi, Yoonah Park +3Personality Modeling in Language ModelsPsychometric Validation

  9. Automatic Item Generation for Personality Situational Judgment Tests with Large Language Models

    Dec 10, 2024Chang-Jin Li, Jiyuan Zhang, Yun Tang +1Psychometric ValidationAutomated Test Generation

  10. Interpretable factorization of clinical questionnaires to identify latent factors of psychopathology

    Dec 12, 2023Ka Chun Lam, Francisco Pereira, Bridget W Mahony +1Latent Variable ModelsNon-Negative Matrix Factorization

  11. "Mirror" Large Language Model Evaluations of Depression are Criterion Contaminated

    Date pendingTong Li, Rasiq Hussain, Mehak Gupta +1Depression DetectionMental Health

  12. Measurement Without Validity: The Compounding Reliability Problem in Agentic AI Evaluation

    Date pendingWilliam CabanInter-Rater ReliabilityAI Agent Evaluation