Factual Knowledge in Language Models

Latest papers 117

All topics
CardsList
  1. MoRFI: Monotonic Sparse Autoencoder Feature Identification

    Apr 29, 2026Dimitris Dimakopoulos, Shay B. Cohen, Ioannis KonstasLLM Hallucination MitigationLLM Interpretability

  2. Programming with Data: Test-Driven Data Engineering for Self-Improving LLMs from Raw Corpora

    Apr 27, 2026Chenkai Pan, Xinglong Xu, Yuhang Xu +6LLM EvaluationKnowledge Augmentation for Language Models

  3. Revisiting Non-Verbatim Memorization in Large Language Models: The Role of Entity Surface Forms

    Apr 23, 2026Yuto Nishida, Naoki Shikoda, Yosuke Kishinami +4LLM EvaluationMemorization in Language Models

  4. Tracing Relational Knowledge Recall in Large Language Models

    Apr 21, 2026Nicholas Popovič, Michael FärberLinear ProbingFactual Knowledge in Language Models

  5. Structure Guided Retrieval-Augmented Generation for Factual Queries

    Apr 21, 2026Miao Xie, Xiao Zhang, Yi Li +1Graph Retrieval-Augmented GenerationFactual Knowledge in Language Models

  6. KnowledgeBerg: Evaluating Systematic Knowledge Coverage and Compositional Reasoning in Large Language Models

    Apr 19, 2026Xiao Zhang, Qianru Meng, Yongjian Chen +2LLM EvaluationCompositional Reasoning

  7. One Mask to Rule Them All: On Hidden Facts after Editing and How to Find Them

    Apr 18, 2026Ali Holmov, Paul Youssef, Nandi Schoots +1Knowledge EditingTransformer Interpretability

  8. BAGEL: Benchmarking Animal Knowledge Expertise in Language Models

    Apr 17, 2026Jiacheng Shen, Masato Hagiwara, Milad Alizadeh +9LLM EvaluationQuestion Answering

  9. World Properties without World Models: Distributional Associations and the Interpretation of Decoding Results from Language Models

    Mar 4, 2026Elan BarenholtzLLM World ModelsWord Embeddings

  10. Probing for Knowledge Attribution in Large Language Models

    Feb 26, 2026Ivo Brink, Alexander Boer, Dennis UlmerLLM InterpretabilityHallucination in Language Models

  11. MAPLE: Metadata Conditioned LLM Pretraining for Locale-Aware Question Answering

    Jan 21, 2026Anjishnu Mukherjee, Ziwei Zhu, Antonios AnastasopoulosLanguage Model PretrainingLLM Evaluation

  12. Relational Linearity is a Predictor of Hallucinations

    Jan 16, 2026Yuetian Lu, Yihong Liu, Sebastian Gerstner +3LLM InterpretabilityHallucination in Language Models

  13. Reinforcement Learning Improves Traversal of Parametric Knowledge in LLMs

    Nov 8, 2025Renfei Zhang, Manasa Kaniselvan, Rylan Schaeffer abd Niloofar MireshghallahRL for Language Model ReasoningFactual Knowledge in Language Models

  14. Multi-Step Knowledge Interaction Analysis via Rank-2 Subspace Disentanglement

    Nov 3, 2025Sekh Mainul Islam, Pepa Atanasova, Isabelle AugensteinDisentangled Representation LearningLLM Grounding

  15. Zoom In Disparities in Healthcare LLM Q&A

    Oct 20, 2025Ipek Baris Schlicht, Burcu Sayin, Zhixue Zhao +5Multilingual Language Model EvaluationKnowledge Augmentation for Language Models

  16. What and Whose Knowledge? Measuring Epistemic Diversity in Large Language Models

    Oct 5, 2025Dustin Wright, Sarah Masud, Jared Moore +5LLM EvaluationCultural Bias in Language Models

  17. LMEnt: A Suite for Analyzing Knowledge in Language Models from Pretraining Data to Representations

    Sep 3, 2025Daniela Gottesman, Alon Gilae-Dotan, Ido Cohen +4Language Model PretrainingKnowledge Editing

  18. GPTKB v1.5: A Massive Knowledge Base for Exploring Factual LLM Knowledge

    Jul 8, 2025Yujia Hu, Tuan-Phong Nguyen, Shrestha Ghosh +2KG ConstructionLLM Information Extraction

  19. Language Specific Knowledge: Do Models Know Better in X than in English?

    May 21, 2025Ishika Agarwal, Nimet Beyza Bozdag, Dilek Hakkani-TürMultilingual Language ModelsMultilingual QA

  20. Continual Memorization of Factoids in Language Models

    Nov 11, 2024Howard Chen, Jiayi Geng, Adithya Bhaskar +2Continual Learning for LLMsMemorization in Language Models

  21. All Entities are Not Created Equal: Examining the Long Tail for Ultra-Fine Entity Typing

    Date pendingAdvait Deshmukh, Ashwin Umadi, Dananjay Srinivas +1Language Model PretrainingLong-Tail Learning

  22. KoSimpleQA: A Korean Factuality Benchmark with an Analysis of Reasoning LLMs

    Date pendingDonghyeon Ko, Kyubyung Chae, Yeguk Jin +6Multilingual Language Model EvaluationLLM Evaluation