Representation Geometry in Language Models

Latest papers 221

All topics
CardsList
  1. Geometry of Divergence: Tracking Hidden-State Trajectories for Adaptive Multi-Turn Reasoning

    Aug 31, 2026Jie Liang, Zhengxin Yu, Hamid Nasiri +1Long-Horizon LLM AgentsRepresentation Geometry in Language Models

  2. Context Staircase: Signature-Aligned Dynamics of Token Embeddings under Small Initialization

    Aug 31, 2026Junjie Yao, Liangkai Hang, Zhi-Qin John XuLanguage Model PretrainingWord Embeddings

  3. Learning Representations through Token Prediction: Geometry, Approximation, and Downstream Guarantees

    Aug 30, 2026Shulei WangLanguage Model PretrainingNext-Token Prediction

  4. Falsehood and Impossibility Are Different Directions in an AI's Representation of Language

    Aug 13, 2026Yoon Pyo LeeRepresentation Geometry in Language Models

  5. GCPO: Diagnosing and Constraining Subspace Geometry in Rollout RL for LLMs

    Aug 12, 2026Kai Yang, Jingwei Xu, Wanyu Wang +4RL for Language Model ReasoningConstrained RL

  6. Beyond a Bag of Features: Set-Level Instability in Sparse Autoencoders

    Aug 11, 2026Nikolai Bolik, Lennart Stöpler, Artur AndrzejakRepresentation LearningLLM Interpretability

  7. Mapping and Measuring the Behavioral Evolution of Large Language Models

    Aug 11, 2026Dong Qiao, Chris Ding, Jicong FanLLM EvaluationRepresentation Geometry in Language Models

  8. Off-Axis, On Purpose: Where a Transformer Computes Concepts and Why it Does So

    Aug 10, 2026Mark OskinTransformer InterpretabilityTransformer Attention

  9. One Adapter Pair per Model: A Universal Activation Interface for Language Models

    Aug 10, 2026Su-Hyeon Kim, Jiwan Mun, Yo-Sub HanRepresentation Geometry in Language ModelsLanguage Model Probing

  10. HoloAegis: Frozen Representation, Topological Inference --- Minimally Parametric Safety Manifolds and Their Capability Boundaries for LLM Guardrails

    Aug 9, 2026Tak Ho Alex Li, Kaijie Liu, Lik-Hang Lee +3Language Model Safety EvaluationLLM Guardrails

  11. Preserving Item Semantics for Free: Rethinking Token Initialization in LLM-Based Generative Recommendation

    Aug 7, 2026Donald Loveland, Liam Collins, Bhuvesh Kumar +2Large Language Model-Based RecommendationRepresentation Geometry in Language Models

  12. Transformers Struggle to Use Their Emergent World Models: Revisiting the Tower of Hanoi, and the Illusion of Thinking

    Aug 7, 2026Devin Pereira, Willem ZuidemaLLM World ModelsLLM Planning

  13. Lost in Interpolation: Why Predictive Feedback Fails in Diffusion Language Models

    Aug 6, 2026Lavanya Nigam, Ishaan Bansal, Aryan Sood +2Masked Diffusion ModelsDiffusion Language Model Decoding

  14. Reasoning Errors Have a Region and a Direction in the Residual-Stream Trajectory of LLMs

    Aug 6, 2026Hamed Damirchi, Ignacio Meza De la Jara, Damith Ranasinghe +2Language Model Error DetectionLLM Interpretability

  15. Scaling Inherently Interpretable Language Models

    Aug 6, 2026Guide Labs Team, Andreas Madsen, Aya Abdelsalam Ismail +7Language Model SteeringLLM Interpretability

  16. Logic Before Language: Pre-pretraining on Formal Derivations Fosters Skill Acquisition and Compressibility

    Aug 4, 2026Jo-Ku Cheng, Nikolaos Aletras, Marco ValentinoLanguage Model PretrainingRepresentation Geometry in Language Models

  17. Language Models Encode the Contextual Truth of Propositions

    Aug 4, 2026Rupak Sarkar, Pritika Ramu, Rachel RudingerLLM SycophancyKnowledge Conflicts in Language Models

  18. A Graph Signal Processing Perspective on Numerical Sequence Representations in LLM In-Context Learning

    Aug 4, 2026Jiajun Bao, Zihao Qi, Toni J. B. Liu +4Numerical Reasoning in Language ModelsIn-Context Learning

  19. ChaosProbe: A Neurochaotic Lens on Frozen Transformer Input-Embedding Spaces

    Aug 3, 2026Kunal Kumar Pant, Nithin NagarajLanguage Model FingerprintingRepresentation Probing

  20. Rewriting or Reweighting? A Geometric Account in Language Models

    Aug 3, 2026Juntong Wang, Shengkun Yang, Xiyuan Wang +1Language Model Post-TrainingRepresentation Geometry in Language Models

  21. Divergent large language model predictions from convergent representations in ambiguous word pairs

    Aug 3, 2026K. Jack Scott, Narun Pat, Veronica LiesaputraTransformer InterpretabilityDecoder-Only Language Models