Representation Geometry in Language Models

Latest papers 221

All topics
CardsList
  1. Search for Truth from Reasoning: A Dynamic Representation Editing Framework for Steering LLM Trajectories

    Jun 26, 2026Tianlong Wang, Yuhang Wang, Weibin Liao +5Language Model SteeringRepresentation Geometry in Language Models

  2. Where Do Models Find Happiness? Emotion Vectors in Open-Source LLMs

    Jun 25, 2026Sinie van der Ben, Raphaël Baur, Yannick Metz +1LLM InterpretabilityValence-Arousal Modeling

  3. Structure Before Collapse: Transient semantic geometry in next-token prediction

    Jun 25, 2026Yize Zhao, Isabel Papadimitriou, Christos ThrampoulidisAutoregressive Language ModelingNext-Token Prediction

  4. Evidence for feature-specific error correction in LLMs

    Jun 23, 2026Francisco Ferreira da Silva, Stefan HeimersheimLLM InterpretabilityLanguage Model Robustness

  5. Do LLM Embedding Spaces Recover Expert Structure?

    Jun 22, 2026Yixuan Zhu, Zhenke Duan, Fanghen LiLLM Fine-TuningMental Health

  6. Abstract representational geometry supports inference in large language models

    Jun 22, 2026Yunan Zeng, Yuwang WangLLM InferenceLLM Interpretability

  7. Orthogonal Representation Editing: Decoupling Semantic Entanglement in Batch Knowledge Editing of LLMs

    Jun 21, 2026Wenhao Yu, Zhicong Lu, Bo Lv +4Knowledge EditingModel Editing

  8. ROMEVA: Geometry-Preserving Vocabulary Expansion for Roman Urdu Language Models

    Jun 21, 2026Mahnoor Khan, Afsheen Asif, Milhan Afzal Khan +2Multilingual Language ModelsWord Embeddings

  9. From Texts to Scores: Tracing the Emergence of Essay Quality Representations in Large Language Models

    Jun 18, 2026Jiaxu Zuo, Mu You, Kaixin Lan +5LLM InterpretabilityAutomated Essay Scoring

  10. What Makes Effective Supervision in Latent Chain-of-Thought: An Information-Theoretic Analysis

    Jun 18, 2026Xinghao Chen, Chak Tou Leong, Wenjin Guo +3Continuous Latent ReasoningProcess Supervision

  11. Code-Switching Reveals Language Anchoring in Multilingual LLMs

    Jun 18, 2026Jeonghyun Park, Seunghyun Yoon, Yonghyun Jun +1Multilingual Language ModelsCode-Switching

  12. Tracking Representation Dynamics in Large Language Models with Persistent Homology

    Jun 17, 2026Naman Malhotra, Jay Ambadkar, Abhinav Gupta +4LLM AlignmentLLM Fine-Tuning

  13. RepSelect: Robust LLM Unlearning via Representation Selectivity

    Jun 15, 2026Filip Sondej, Yushi Yang, Adam MahdiLLM SafetyRepresentation Geometry in Language Models

  14. Data-Driven Decoding of Russell's Circumplex Model of Affect

    Jun 15, 2026Amdjed Belaref, Samir Sadok, Zineb Noumir +1Multimodal EmbeddingRepresentation Geometry in Language Models

  15. High-Dimensional Random Projection for Activation Steering in Language Models

    Jun 13, 2026Minh-Hieu Pham, Bach Do, Laziz Abdullaev +2Language Model SteeringRepresentation Geometry in Language Models

  16. A Low-Rank Subspace Analysis of LLM Interventions

    Jun 12, 2026Angira Sharma, Christian Schroeder de Witt, Philip Torr +2LLM InterpretabilityLLM Refusal Behavior

  17. When Language Representations Interact: Separability and Cross-Lingual Effects in LLMs

    Jun 12, 2026Boris Marinov, Angira Sharma, Christian Schroeder de Witt +3Multilingual Language ModelsLLM Interpretability

  18. The Holistic Storage of Verb+Up Phrases in Text-based and Audio-based Language Models

    Jun 12, 2026Zachary Nicholas Houghton, Yu Zhou, Dan Pluth +2Memorization in Language ModelsKnowledge Representation

  19. Adversarial Concept Search: Predicting Compositional Errors From Feature Geometry

    Jun 11, 2026Jennifer Meng Lu, Ruochen Zhang, Isabelle Lee +3LLM InterpretabilityRepresentation Geometry in Language Models

  20. ICA Lens: Interpreting Language Models Without Training Another Dictionary

    Jun 10, 2026Sida Liu, Feijiang HanIndependent Component AnalysisLLM Interpretability

  21. Trajectory Geometry of Transformer Representations Across Layers

    Jun 8, 2026Vishal Pandey, Gopal Singh, Yacine MahdidTransformer InterpretabilityNeural Representation Geometry

  22. Generative Criticality in Large Language Model Temperature Scaling

    Jun 4, 2026Huajian Ruan, Jinyang Li, Xingyu Guo +1LLM InferencePhase Transitions

  23. Rotate2Think: Geometric Priming via Orthogonal Rotation to Improve Language Model Reasoning

    Jun 2, 2026Aditya Sharma, Christopher J. Pal, Amal ZouaqNeural Representation GeometryRepresentation Geometry in Language Models