Representational Collapse

Latest papers 39

All topics
CardsList
  1. Analysis of Quantized and Efficiently Adapted Protein Language Models

    Sep 30, 2026Ilan Yaniv Zeisler, Sebastian Clancy, Pouriya Bayat +8Large Language Model QuantizationLanguage Modeling

  2. Aligned Data Can Induce Misalignment via Context Confusion

    Sep 29, 2026Yavuz Bakman, Duygu Nur Yaldiz, Baris Askin +4Large Language Model AlignmentTraining-Inference Mismatch

  3. Early Learning Shapes Later Directions Of Representation Change In Continual Learning

    Sep 28, 2026Yuantao Deng, Jinnuo Liu, Kaizhen Tan +1Neural Network RepresentationsContinual Learning

  4. λλ-JEPA Spectral Anti-Collapse Regularization for Self-Supervised Learning

    Sep 28, 2026Berker Demirel, Clémentine Dominé, Valentino Maiorca +3Self-Supervised LearningRegularization

  5. Comparing Latent Concept Formation in State Space Models and Transformers via Sparse Autoencoders

    Sep 21, 2026Rithin Nagaraj, Rupa Laalasa Oruganti, Prerna Subhashchandra Kunder +1Transformer ArchitecturesTransformer Attention

  6. Misaligned Clinical Risk Classification and Cost Asymmetry in Open-Weight Large Language Models

    Sep 21, 2026Star S. D. Liu, Xiyu Ding, Robert B. Barrett +3RiskTrade-Off

  7. How Perturbations Propagate: A Multi-Level Analysis of Robustness in Large Language Models

    Sep 3, 2026Dun Li Chan, Emily Liu, Niyathi Allu +1Representational Collapse

  8. Representational separation between unitary and channel quantum generative models via shared classical randomness at shallow depth

    Aug 5, 2026Arunava Majumder, Marius Krumm, Hendrik Poulsen Nautrup +1Quantum CircuitsQuantum Processor

  9. Isotropy Cliffs: The Geometric Signature of Decision-Making in Large Language Models

    Aug 1, 2026Okan S. Coskun, Florian Rottach, Carsten Eickhoff +1Multiple-Choice QuestionsRepresentational Collapse

  10. Do Unified Multimodal Models Think in One Space? A Lens Through Cross-Branch Steering

    Jul 29, 2026Yu Wang, Sharon LiMultimodal ModelRepresentational Collapse

  11. Probing the Origins of Reasoning Performance: Representational Quality for Mathematical Problem-Solving in RL vs. SFT Fine-Tuned Models

    Jul 28, 2026Antyabha Rahman, Akshaj Gurugubelli, Omar Ankit +2Large Reasoning ModelsSupervised Finetuning

  12. What CLIP Knows but Cannot Say: Recovering Negation from Frozen Intermediate Features

    Jul 25, 2026Chen-Yi Lu, Yueh-Shao Chen, Somali ChaterjiNegationRepresentational Collapse

  13. What Does a Chemical Language Model Know About Molecules?

    Jun 22, 2026Christian Kenneth, Etowah Adams, Liam Bai +1MoleculesLanguage Modeling

  14. Detecting Explanatory Insufficiency in Learned Representations: A Framework for Representational Vigilance

    Jun 11, 2026Jacques Raynal, Pierre Slangen, Elsa Raynal +1Representation LearningRepresentational Collapse

  15. Bootstrap Theory of Representational Emergence: Explanatory Insufficiency as a Driver of Representation Learning and World Models

    Jun 5, 2026Jacques Raynal, Pierre Slangen, Elsa Raynal +1Representational CapacityRepresentational Collapse

  16. Trajectory Dynamics in Language Model Hidden States Predict Human Processing Costs Beyond Surprisal

    Jun 3, 2026Elan BarenholtzSurprisalLanguage Modeling

  17. Real Images, Worse Judgments: Evaluating Vision-Language Models on Concreteness and Imagery

    May 26, 2026Yifan Jiang, Ruoxi Ning, Sheng Yao +1Representational CollapseRelevance

  18. TextReg: Mitigating Prompt Distributional Overfitting via Regularized Text-Space Optimization

    May 20, 2026Lucheng Fu, Ye Yu, Yiyang Wang +4OverfittingText-Driven

  19. Mechanistic Interpretability of EEG Foundation Models via Sparse Autoencoders

    May 13, 2026William Lehn-Schiøler, Magnus Ruud Kjær, Rahul Thapa +10Electroencephalography Foundation ModelsImproving Sparse Autoencoders

  20. Towards Visually Grounded Multimodal Summarization via Cross-Modal Transformer and Gated Attention

    May 12, 2026Abid Ali, Diego Molla-Aliod, Usman NaseemCross-Modal AttentionSummarization

  21. XTinyU-Net: Training-Free U-Net Scaling via Initialization-Time Sensitivity

    May 10, 2026Alvin Kimbowa, Moein Heidari, David Liu +1U-NetRepresentational Collapse

  22. Mechanistic Analysis of Alignment Algorithms in Language Models

    May 9, 2026Aarush Sinha, Ishan Garg, Veeraraju Elluru +2Large Language Model AlignmentPreference Alignment Learning

  23. Formalizing Latent Thoughts: Four Axioms of Thought Representation in LLMs

    May 7, 2026Fahd Seddik, Fatemeh FardLatent ThoughtsReasoning Skills

  24. AHPA: Adaptive Hierarchical Prior Alignment for Diffusion Transformers

    May 5, 2026Ruibin Min, Yexin Liu, Aimin Pan +5Diffusion AlignmentDiffusion Transformers

  25. Lost in State Space: Probing Frozen Mamba Representations

    Apr 30, 2026Bhagyashree Wagh, Akash SinghToken EmbeddingsRecurrent State

  26. When 2D Tasks Meet 1D Serialization: On Serialization Friction in Structured Tasks

    Apr 29, 2026Chung-Hsiang Lo, Lu Li, Diji Yang +4Structured ContextIntrinsic Dimensionality

  27. Rank, Head-Channel Non-Identifiability, and Symmetry Breaking: A Precise Analysis of Representational Collapse in Transformers

    Apr 26, 2026Giansalvo CirrincioneMulti-Head AttentionTransformer Architectures

  28. REZE: Representation Regularization for Domain-adaptive Text Embedding Pre-finetuning

    Apr 19, 2026Seungmin Lee, Jeonghwan Lee, Hyunkuk Lim +2Domain-Adapted DiffusionRegularization

  29. Can Fine-Tuning Erase Your Edits? On the Fragile Coexistence of Knowledge Editing and Adaptation

    Nov 8, 2025Yinjie Cheng, Paul Youssef, Christin Seifert +2Multimodal Knowledge EditingModel Fine-Tuning