Language Model Robustness

Latest papers 338

All topics
CardsList
  1. Is a Document Educational or Just Wikipedia-Style? -- Pitfalls of Classifier-Based Quality Filtering

    May 21, 2026Mateusz Klimaszewski, Piotr AndruszkiewiczLanguage Model PretrainingTraining Data Curation

  2. Do as I Say, Not as I Do: Instruction-Induction Conflict in LLMs

    May 19, 2026Carolina Camassa, Derek ShillerLLM EvaluationLanguage Model Self-Assessment

  3. Generalization or Memorization? Brittleness Testing for Chess-Trained Language Models

    May 17, 2026Ethan TangLLM EvaluationLanguage Modeling

  4. Towards Robust Argumentative Essay Understanding via TIDE: An Interactive Framework with Trial and Debate

    May 17, 2026Zheqin Yin, Yupei Ren, Yadong Zhang +2Argument MiningAutomated Essay Scoring

  5. Stop Drawing Scientific Claims from LLM Social Simulations Without Robustness Audits

    May 17, 2026Jinyi Ye, Lei Cao, Ding Chen +1Human Behavior SimulationAgent-Based Modeling

  6. Multi-LLM Systems Exhibit Robust Semantic Collapse

    May 16, 2026Weiyi Kong, Shiyang Lai, Jinghua Piao +1Multi-Agent LLM SystemsLanguage Model Robustness

  7. Evaluation Drift in LLM Personality Induction: Are We Moving the Goalpost?

    May 16, 2026Prateek Rajput, Yewei Song, Iyiola E. Olatunji +2Personality Modeling in Language ModelsLLM Post-Training

  8. Reasoners or Translators? Contamination-aware Evaluation and Neuro-Symbolic Robustness in Tax Law

    May 15, 2026Parisa Kordjamshidi, Samer Aslan, Madhavan Seshadri +2Data Contamination in Language ModelsNeuro-Symbolic Reasoning

  9. Judge Circuits Explain Format-Induced Inconsistency in LLM-as-a-Judge

    May 15, 2026Nils Feldhus, Tanja Baeumel, Elena Golimblevskaia +10LLM-as-a-JudgeLLM Interpretability

  10. LPDS: Evaluating LLM Robustness Through Logic-Preserving Difficulty Scaling

    May 14, 2026Philipp Mondorf, Samuel J. Bell, Jesse Dodge +1LLM EvaluationNeural Network Robustness

  11. Does RAG Know When Retrieval Is Wrong? Diagnosing Context Compliance under Knowledge Conflict

    May 14, 2026Yihang Chen, Pin Qian, Su Wang +4Retrieval-Augmented GenerationKnowledge Conflicts in Language Models

  12. Fine-tuning with Hierarchical Prompting for Robust Propaganda Classification Across Annotation Schemas

    May 13, 2026Lukas Stähelin, Veronika Solopova, Max Upravitelev +6LLM PromptingLLM Fine-Tuning

  13. LIFT: Last-Mile Fine-Tuning for Table Explicitation

    May 13, 2026Divij Khaitan, Ashish TiwariSupervised Fine-TuningFine-Tuning

  14. GateKD: Confidence-Gated Closed-Loop Distillation for Robust Reasoning

    May 13, 2026Kasidit Sermsri, Teerapong PanboonyuenCoT DistillationLanguage Model Distillation

  15. Precision Tracked Transformer via Kalman Filtering, Kriging and Process Noise

    May 12, 2026Bo Long, Deepak Agarwal, Jelena Markovic-Voronov +2Bayesian FilteringTransformer

  16. Early Data Exposure Improves Robustness to Subsequent Fine-Tuning

    May 12, 2026Lawrence Feng, Gaurav R. Ghosal, Jacob Mitchell Springer +2Language Model PretrainingContinual Learning for LLMs

  17. LGMT: Logic-Grounded Metamorphic Testing for Evaluating the Reasoning Reliability of LLMs

    May 12, 2026Zenghui Zhou, Man Li, Xiaoke Fang +3LLM EvaluationAutomated Software Testing

  18. Metaphor Is Not All Attention Needs

    May 12, 2026Olga Sorokoletova, Francesco Giarrusso, Giacomo De Luca +6Adversarial Attacks on LLMsJailbreak Attacks

  19. SAGE: Scalable Automated Robustness Augmentation for LLM Knowledge Evaluation

    May 12, 2026Xiaoyuan Li, Yuzhe Wang, Moxin Li +6LLM EvaluationBenchmark Construction

  20. Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization

    May 12, 2026Xu Chu, Guanyu Wang, Zhijie Tan +4Language Model Robustness

  21. ROMER: Expert Replacement and Router Calibration for Robust MoE LLMs on Analog Compute-in-Memory Systems

    May 12, 2026Wenyong Zhou, Yuannuo Feng, Yizhe Chen +6Compute-in-MemoryMixture-of-Experts Language Models

  22. PRISM: A Geometric Risk Bound for Decomposing Drift into Scale, Shape, and Head

    May 12, 2026Chieh-Yen Lin, Shao-Hua SunLLM QuantizationLLM Evaluation

  23. Targeted Tests for LLM Reasoning: An Audit-Constrained Protocol

    May 12, 2026Hongmin LiPrompt SensitivityLanguage Model Robustness

  24. CPEMH: An Agentic Framework for Prompt-Driven Behavior Evaluation and Assurance in Foundation-Model Systems for Mental Health Screening

    May 11, 2026Giuliano Lorenzoni, Ivens Portugal, Paulo Alencar +1LLM AuditingPrompt Optimization