Hidden States

Latest papers 125

All topics
CardsList
  1. Erased, Rerouted, or Rescaled? Post-Training and the Causal Quotient of a Language Model's Belief State

    Oct 4, 2026Weihan Li, Tianshi Zheng, Junhao Wu +1Reinforcement Learning Post-TrainingHidden States

  2. Looping Beyond Twice: A Scalable Recipe for Looped Mixture-of-Experts

    Oct 1, 2026Di He, Pengxiang Li, Da Chang +3Mixture-Of-Experts Large Language ModelsMixture-Of-Experts

  3. Reinforcement Learning with Complex (valued) Memories

    Sep 29, 2026Sathya Kamesh Bhethanabhotla, Efstratios Gavves, André BiedenkappRecurrent Neural NetworksOffline Reinforcement Learning

  4. Predictive Geometry of Hidden Trajectories in Transformers

    Sep 29, 2026Timur Mudarisov, Mikhail Burtsev, Tatiana Petrova +1Transformer EncoderTransformer Architectures

  5. Scaling Video Generation for Reasoning: At What Cost?

    Sep 29, 2026Weihang Guo, Xiaoyu Wu, Yifei Wang +2Generative Video ModelsLong Video Generation

  6. Language Models Act on Hidden Valence

    Sep 28, 2026Cameron Berg, Caspar KaiserHidden StatesLanguage Model Computes

  7. TULIP: Targeted LLM Unlearning at Layers Identified Per-Input

    Sep 28, 2026Yejin Kim, William F. Shen, Seokwon Jung +2Large Language Model UnlearningHidden States

  8. Admissible Diffusion for Multimodal Interventional Trajectories

    Sep 28, 2026Xing Han, Shravan Chaudhari, Jiarui Shao +2Patient TrajectoriesLatent Dynamics

  9. Dynamical Parameters: An Interpretability Framework for Time-Series Foundation Models

    Sep 28, 2026Kang Yang, Gaofeng Dong, Liying Han +1Time Series Foundation ModelsHidden States

  10. Over-Personalization Is a Decision Failure: Generation-Induced Apply Bias in LLMs

    Sep 28, 2026Haeun Jang, Yonghyun Jun, Hwanhee LeeLarge Language Model PersonalizationLarge Language Model Bias

  11. Coherence-Aware Distributional Evaluation of Open-Ended Text Generation

    Sep 28, 2026Jinnuo Liu, Junhao Zhu, Weifeng Jiang +2DiversityHidden States

  12. Finite Probes Suffice: Identifiability and Universality for Weight-Space Learning

    Sep 27, 2026Soutrik Sarangi, Yonatan Sverdlov, Adir Dayan +2Neural NetworkHidden States

  13. When Does the Concept of "Dog" Emerge in an Audio LLM?

    Sep 27, 2026Zhe Wang, Shiqi Liu, Ruiyun Zhong +2Large Audio Language ModelsAudio Understanding

  14. Controlling Backchannels in Streamable Full-duplex Models

    Sep 24, 2026Maike Züfle, Peter Polák, Sefik Emre Eskimez +3Full-Duplex Speech ModelsSpeech Language Models

  15. Reasoning-Preserving Fine-Tuning of Post-RL LLMs with Null-Basis LoRA

    Sep 22, 2026Wenzhi Fang, Nicholas Tzou, Lazar Valkov +1Model Fine-TuningPost-Training

  16. Reading Emotions in the Token Space: Discriminative Adaptation of SpeechLLMs for Emotion Recognition

    Sep 17, 2026Hasindri Watawana, Sergio Burdisso, Esaú Villatoro-Tello +4Emotion RecognitionSpeech Language Models

  17. High-Performance Tensor Formulation of the Viterbi Algorithm for Hidden Semi-Markov Models

    Sep 15, 2026Lorenzo Piarulli, Elia Belli, Daniele De SensiHidden Markov ModelsHidden States

  18. Register Tokens for Bounded-State Reasoning in Diffusion Language Models

    Sep 14, 2026Albert Ge, Chandan Singh, Yufan Zhuang +3Diffusion Language ModelsMasked Diffusion Language Models

  19. Reference-Based Bias Detection in LLMs via Relative Representations of Hidden States

    Sep 9, 2026Marek Jeliński, Jan Dubiński, Maciej Chrabaszcz +1Large Language Model BiasModel Auditing

  20. Investigating Linear Probe Robustness to Linguistic Register, Medical Specialty, and Corpus Shifts in Medical QA

    Sep 1, 2026Nishant Mishra, Ameen Abu-Hanna, Iacer CalixtoMultilingual Healthcare Q&AText Corpora

  21. StateSwap: Probing Support-Elimination Hidden States in Multiple-Choice Questions

    Sep 1, 2026Chao Gao, Haijiang Liu, Qiyuan Li +3Multiple-Choice QuestionsHidden States

  22. Verbalizing Multi-Token Concepts in LLMs

    Aug 31, 2026Xijie Gong, Zimeng Huang, Tonghan WangCompact Latent Sensor TokensHidden States

  23. Can Video World Models Track Unobserved World States?

    Aug 31, 2026Joonghyuk Shin, Yicong Hong, Jaesik Park +1Video World ModelsHidden States

  24. TRAPSBench: Vision-Language Models Encode but Fail to Express Epistemic Restraint

    Aug 13, 2026Fnu Pramono, John Cai, Sourabh KulkarniVisual EvidenceAbstention

  25. Interpreting Language Model Hidden States at Scale

    Aug 10, 2026Jordan Pettyjohn, Mansi Sakarvadia, Nathaniel Hudson +3Model ActivationsHidden States

  26. Archer: Adaptive Reuse of Cached Hidden States for Efficient Rollback in Diffusion Language Models

    Aug 8, 2026Xuning He, Zinan Sheng, Yongding Tao +4Diffusion Language ModelsDiffusion Models

  27. Vision-Language Model Confidence Is Not a Property of the Answer

    Aug 6, 2026Reza Khanmohammadi, Erfan Miahi, Ivan Brugere +4Confidence CalibrationVision-Language Foundation Models

  28. TruthLens: Object Hallucination Detection via Self-Evaluating Truthfulness Scores in LVLMs

    Aug 6, 2026Yanqi Wu, Runhe Lai, Xinhua Lu +5Citation Hallucination DetectionObject Hallucination

  29. TransMem: Transforming Hidden States into Memory for Large Language Models

    Jul 31, 2026Haodong Lei, Junming Liu, Yirong Chen +4Large Language Model MemoryLarge Language Model Agents

  30. Metaphor Tracer: A Theory-Informed Analysis of Hidden States

    Jul 30, 2026Marc Heimann, Roxana Assadi Moghaddam, Olga Brovkina +2Hidden StatesMetaphors

  31. Hidden APIs in Language Models: Discovering Reusable Causal Interfaces from Forked Futures

    Jul 30, 2026SiYuan Ma, Yiqin Luo, Zhangji +8Hidden StatesApplication Programming Interfaces

  32. Same Evidence, Different Target: Decoding How Diagnostic Evidence Bears on Causal Questions from Language-Model States

    Jul 29, 2026Weiyi Kong, Zhuoran LiDiagnosisEvidence Conflict

  33. Emergent Latent-State Computation under Stochastic Volatility

    Jul 28, 2026Xiaoyu Huang, Lulu WangLatent StatesIntermediate Latent States

  34. Interpretable GOHR Agents via Sparse Autoencoders

    Jul 27, 2026Shiwei Tan, Yusong Zhao, Weiyi Qin +6Autonomous AgentsHidden States

  35. D-Score: A Spectral Hidden-State Signal for Hallucination Detection in Large Language Models

    Jul 27, 2026Bianca Raimondi, Davide Evangelista, Maurizio Gabbrielli +1Hallucination DetectionHallucination Rate

  36. Try Once, Then Optimal: De-Redundified Procedure Memory for Cross-Episode Exploration Amortization

    Jul 26, 2026Haizhou Ge, Haochen Ouyang, Zhixing Chen +6Episodic MemoryExploration

  37. J-CoT: Chain-of-Thought in J-Space

    Jul 24, 2026Junde Wu, Jiayuan Zhu, Fengling Liu +2Chain-of-Thought ReasoningHidden States

  38. Reading and Steering Representations of Materials-Science Mechanisms in an Open-Weight Language Model

    Jul 22, 2026Markus J. BuehlerMaterials ScienceHidden States

  39. ASK-NN: An Asymmetric Nearest-Neighbor Test that detects Distribution Drifts in Natural Language

    Jul 17, 2026Sergey Zakharov, Rodion Oblovatny, Alexey ZaytsevLarge Language Model HallucinationMachine-Generated Text Detection

  40. Depth-Dependent Hidden-State Collapse in Dynamical System Autoencoders for LiDAR Point-Cloud Classification

    Jul 16, 2026Patricia Medina, Hy P. G. LamLight Detection And Ranging Point CloudsAutoencoder Architectures

  41. SPARK: Susceptibility-Guided Profiling and Steering of Latent Reasoning States in Large Language Models

    Jul 11, 2026Dongxu Zhang, Yiding Sun, Zihao Guo +5LLM Reasoning StrategiesHidden States

  42. TypeProbe: Recovering Type Representations from Hidden States of Pre-trained Code Models

    Jul 9, 2026Giuliano Gorgone, Fausto CarcassiInterpretabilityHidden States

  43. TF-Engram: A Train-Free Engram with SSD-Backed Memory for Large Language Models

    Jul 8, 2026Yutang Ma, Kecheng Huang, Xikun Jiang +1Large Language Model MemoryLLM Inference Optimization

  44. Tensorized algorithms and scalable filtering methods for hidden Markov and factorial hidden Markov models

    Jul 8, 2026Roxana Barrios, Ioannis SgouralisHidden Markov ModelsTensor Decomposition

  45. Empirical Minimal-Realisation Compression of Deep Neural Networks via Controllability-Observability Tests

    Jul 5, 2026Anis Hamadouche, Amir HussainNeural NetworkTask-Aware Compression

  46. Revealing Hidden Model Behaviors with Task-Specific Self-Reports

    Jul 3, 2026Taras Kutsyk, Bartosz ZielińskiIntrospection AdaptersAgent Behavior Modeling

  47. When Geometry Aligns: Dihedral Hidden-State Transformations in UNet, ViT, and DiT Architectures

    Jul 3, 2026Mojtaba Faramarzi, Alex Lamb, Irina RishDiffusion TransformersU-Net

  48. Recovering Input Text from Hidden States: Study of Gradient-Based Inversion of Decoder-Only Language Models

    Jul 1, 2026Mikołaj Słowikowski, Maciej Witold MajewskiHidden StatesDiffusion Inversion

  49. When Latent Agents Lie: KV-Cache Integrity in Multi-Agent LLM Collaboration

    Jun 27, 2026Luís Brito, Carlos BaqueroLarge Language Model AgentsHidden States

  50. Event-Conditioned Diagnostics of Kinematic, Contact, and Object-Permanence Fields in Passive Object-State World Models

    Jun 26, 2026Yang Liu, Yuming ChenIntermediate Latent StatesWorld Models