Representation Geometry in Language Models

Latest papers 221

All topics
CardsList
  1. Decomposing how prompting steers behavior

    Jun 2, 2026Fan L. Cheng, Nikolaus KriegeskorteLLM PromptingLLM Interpretability

  2. Geometric Latent Reasoning Induces Shorter Generations in LLMs

    Jun 1, 2026Shashi Kumar, Yacouba Kaloga, Petr Motlicek +2Efficient Language Model ReasoningContinuous Latent Reasoning

  3. MENTIS: What Belief Changes Under Alignment? Measuring Multi-Scale Latent Torsion in Language Models

    May 31, 2026Partha Pratim Saha, Samarth Raina, Mayur Parvatikar +4LLM InterpretabilityPreference Alignment

  4. Representation Collapse in Sequential Post-Training of Large Language Models

    May 28, 2026Yichen Liu, Mingyu Chen, Hao Wang +7Continual Learning for LLMsRepresentation Collapse

  5. Geometry of Human Perceptual Domains Emerges Transiently in LLM Representations

    May 27, 2026Simardeep Singh, Paras ChopraNeural Representation GeometryLLM Interpretability

  6. Riemannian-Manifold Steering: Geometry-Aware Generative Autoencoders for Label-Free Steering

    May 24, 2026Narmeen Oozeer, Shivam Raval, Philip Quirke +4Language Model SteeringRepresentation Steering

  7. Word-Class and Construction-Like Structure Emerges in Neural Successor Representations Trained on Natural Language

    May 23, 2026Mathis Immertreu, Achim Schilling, Thomas Kinfe +1Predictive Representation LearningRepresentation Geometry in Language Models

  8. Convergence Without Understanding: When Language Models Agree on Representations but Disagree on Reasoning

    May 22, 2026Muhammad Usama, Dong Eui ChangRepresentational Similarity AnalysisLLM Interpretability

  9. Beyond Temperature: Hyperfitting as a Late-Stage Geometric Expansion

    May 21, 2026Meimingwei Li, Yuanhao Ding, Esteban Garces Arias +1LLM InterpretabilityLLM Fine-Tuning

  10. Reading Calibrated Uncertainty from Language Model Trajectories

    May 19, 2026Aliai Eusebi, Alexander Herzog, Xiaoyu Liang +3Confidence Estimation in Language ModelsLLM Reliability

  11. Large language models reorganize representational geometry during in-context learning

    May 16, 2026Hua-Dong Xiong, Li Ji-An, Robert C. Wilson +2Neural Representation GeometryRepresentation Disentanglement

  12. Scale Determines Whether Language Models Organize Representation Geometry for Prediction

    May 16, 2026Weilun XuLanguage Model PretrainingNeural Representation Geometry

  13. Reasoning Models Don't Just Think Longer, They Move Differently

    May 14, 2026Anders Gjølbye, Lars Kai Hansen, Sanmi KoyejoLLM InterpretabilityRepresentation Geometry in Language Models

  14. Representation Without Reward: A JEPA Audit for LLM Fine-Tuning

    May 14, 2026Biswa SenguptaLLM AuditingLLM Fine-Tuning

  15. Tracing Persona Vectors Through LLM Pretraining

    May 13, 2026Viktor Moskvoretskii, Dominik Glandorf, Jorge Medina Moreira +2Language Model PretrainingLLM Interpretability

  16. Layer-wise Representation Dynamics: An Empirical Investigation Across Embedders and Base LLMs

    May 12, 2026Jingzhou Jiang, Yi Yang, Kar Yan TamText EmbeddingsLLM Pruning

  17. Invariant Features in Language Models: Geometric Characterization and Model Attribution

    May 7, 2026Agnibh Dasgupta, Abdullah Tanvir, Xin ZhongNeural Representation GeometryInvariant Representation Learning

  18. The Cylindrical Representation Hypothesis for Language Model Steering

    May 3, 2026Lang Gao, Jinghui Zhang, Wei Liu +7Language Model SteeringLLM Interpretability

  19. Reasoning emerges from constrained inference manifolds in large language models

    May 2, 2026Yanbiao Ma, Fei Luo, Linfeng Zhang +10LLM InferenceLLM Interpretability