Representation Geometry in Language Models

Latest papers 221

All topics
CardsList
  1. Semantic Alignment of AI Models: Concept Collapse, Checkpoint Dynamics, and Cross-Lingual Transfer

    Aug 3, 2026Tyler Ashoff, Jordan RoduMultilingual Language Model EvaluationRepresentation Geometry in Language Models

  2. Cloud-ScPO: Hidden-State Geometry for Semi-Supervised Preference Optimization in LLM Reasoning

    Aug 2, 2026Yuzhou Liu, Xiyang HuPreference OptimizationSemi-Supervised Learning

  3. Isotropy Cliffs: The Geometric Signature of Decision-Making in Large Language Models

    Aug 1, 2026Okan S. Coskun, Florian Rottach, Carsten Eickhoff +1Multiple-Choice Question AnsweringLLM Decision-Making

  4. Metaphor Tracer: A Theory-Informed Analysis of Hidden States

    Jul 30, 2026Marc Heimann, Roxana Assadi Moghaddam, Olga Brovkina +2LLM InterpretabilityRepresentation Geometry in Language Models

  5. Beyond Geometric Complementarity: Coherent Overlap in Sparse Mixture-of-Experts Routing

    Jul 30, 2026Huiyuan Tian, Bonan Xu, Shijian LiSparse Mixture-of-ExpertsExpert Routing

  6. RepBench: Compiling Benchmarks into Capability Representations for Large Language Models

    Jul 30, 2026Yanshi Li, Xueru Bai, Shuman Liu +1LLM EvaluationLLM Interpretability

  7. STEREODISCO: Discovering Stereotypicality in LLMs

    Jul 30, 2026Farane Jalali Farahani, Corina Dima, Mojtaba Nayyeri +2Social Bias in Language ModelsRepresentation Geometry in Language Models

  8. Sky sphere representation in language models

    Jul 29, 2026Aleksandr Berdnikov, Yevgeny LiokumovichFactual Knowledge in Language ModelsRepresentation Geometry in Language Models

  9. Relation Geometry in Semantic Space of Language Models

    Jul 29, 2026Zhihan Cao, Hiroaki Yamada, Simone Teufel +4Representation Geometry in Language Models

  10. Probing the Origins of Reasoning Performance: Representational Quality for Mathematical Problem-Solving in RL vs. SFT Fine-Tuned Models

    Jul 28, 2026Antyabha Rahman, Akshaj Gurugubelli, Omar Ankit +2Numerical Reasoning in Language ModelsLLM Interpretability

  11. D-Score: A Spectral Hidden-State Signal for Hallucination Detection in Large Language Models

    Jul 27, 2026Bianca Raimondi, Davide Evangelista, Maurizio Gabbrielli +1Language Model Error DetectionHallucination in Language Models

  12. The JEPA Paradox in Language: The Geometry of Linguistic Alternatives

    Jul 26, 2026Anh Trac Duc Dinh, Khang Nhat Hoang VoRepresentation CollapseMasked Language Modeling

  13. Through the Bottleneck: How Multi-head Latent Attention Separates Content from Position in Language Models

    Jul 25, 2026Dhruvil S, Fenil Sojitra, Ravirajsinh ChauhanTransformer InterpretabilityLow-Rank Attention

  14. Reading and Steering Representations of Materials-Science Mechanisms in an Open-Weight Language Model

    Jul 22, 2026Markus J. BuehlerMechanistic InterpretabilityScientific Reasoning in Language Models

  15. Geometric Configurations of Perturbed Jailbreak Prompts

    Jul 22, 2026Lynn Delcon, Andres Algaba, Vincent GinisJailbreak AttacksLLM Jailbreak Attacks

  16. How Does Alignment Tuning Shape Representations of Sycophancy and Related Cue-Induced Biases in LLMs?

    Jul 20, 2026Prakhar Gupta, Terry Jingchen Zhang, Florent Draye +2LLM SycophancyLLM Alignment

  17. Regularize or Localize: When Training-Time KV-Cache Geometry Pays Under Quantization

    Jul 19, 2026Libo Sun, Po-Wei Harn, Zewei Zhang +2KV CachingAttention Quantization

  18. Similarity All The Way Up: Multilingual Generalization in LLMs Relies on Language-Level Similarity Structures

    Jul 18, 2026Supantho Rakshit, Adele Goldberg, Henry ConklinMultilingual Language Model EvaluationCross-Lingual Reasoning in Language Models

  19. CAMMAR: Culture-Aware Matryoshka for Metaphorical Arabic Representations

    Jul 17, 2026Suzan Awinat, Alfonso Ortega del PuenteFigurative Language UnderstandingArabic NLP

  20. Linear representations of grammaticality in neural language models

    Jul 16, 2026Jane Li, Najoung KimLanguage ModelingRepresentation Geometry in Language Models