Attention Head Analysis

Momentum

11 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 53

All topics
CardsList
  1. Finding the Heads and the Neurons Responsible for Network Information Retrieval in Language Models

    Oct 6, 2026Md Abdul Kadir, Md Mohasin Hossain, Daniel SonntagAttention Head AnalysisLLM Interpretability

  2. Spectral Geometry of Attention: From Information Routing to Uncertainty

    Oct 5, 2026Giulio Viganò, Simone Melzi, Maks OvsjanikovAttention Head AnalysisAttention Sinks

  3. Attention Function as an Intrinsic Inductive Bias: How Models' Behavior Diverges in Novel Contexts

    Sep 30, 2026Dong Gyun Kang, Megha Thukral, Kwangsoo KimAttention Head AnalysisOOD Generalization

  4. Which Attention Heads are like the Human Head? Not the Ones that Compute

    Sep 29, 2026Christopher Pinier, Gustaw Opiełka, Hannes Rosenbusch +3Attention Head AnalysisCross-Modal Alignment

  5. A mechanistic study of language model introspection

    Sep 28, 2026Jiahong Zou, Xiangkun Sun, Lingkai Kong +1Attention Head AnalysisLLM Interpretability

  6. When Can Attention Heads Be Statically Defined?

    Sep 28, 2026Weixian Waylon Li, Yintao Tai, Marcio Fonseca +1Attention Head AnalysisEfficient Attention

  7. Rethinking Contextualization by Reinterpreting Attention Head Channels

    Sep 27, 2026Hakaze Cho, Haolin Yang, Zhun Sun +3Attention Head AnalysisRepresentation Geometry in Language Models

  8. Scaling Attention Head Analysis via Gradient-Based Attribution in Context-Aware Machine Translation

    Sep 23, 2026Paweł Mąka, Yusuf Can Semerci, Jan Scholtes +1Gradient-Based AttributionAttention Head Analysis

  9. Global Ranks Survive, Selected Heads Shift: BOS-Sink Topology under 4-bit Weight-Only Quantization

    Sep 20, 2026Kuanlin Chen, Chen-Wei Kuo, Cheng-En OuAttention Head Analysis4-Bit Quantization

  10. Attention Mean Fields Predict Average Representation Dynamics and Reveal Context-Specific Computation

    Sep 14, 2026Micah Adler, John W. Byers, Mark CrovellaAttention Head AnalysisIn-Context Learning

  11. Temporal-Attention Head Specialization During Video Diffusion Training

    Sep 14, 2026Taewoo Ha, Shafayat Mowla Anik, Dae Yeol Lee +2Video Diffusion ModelsAttention Head Analysis

  12. Scaled Idempotence in Transformer Attention: Paired OV Geometry and Shared-Value Algebras

    Sep 1, 2026Jiming Feng, Junliang LiAttention Head AnalysisTransformer Attention

  13. Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry

    Aug 7, 2026Yehan Yang, Junyuan Shang, Yang Li +3Attention Head AnalysisLLM Inference Acceleration

  14. Interpretability-Guided Soft Pruning of Attention Heads in Vision Transformers

    Jul 31, 2026Kamil Książek, Piotr Suszyński, Michał Jan Włodarczyk +2Transformer InterpretabilityAttention Head Analysis

  15. Role-Break in Attention Heads: Understanding and Detecting Hallucinations in VLMs

    Jul 31, 2026Mingyu Wang, Weilin Jin, Wenbo Li +5Hallucination Detection in VLMsAttention Head Analysis

  16. Through the Bottleneck: How Multi-head Latent Attention Separates Content from Position in Language Models

    Jul 25, 2026Dhruvil S, Fenil Sojitra, Ravirajsinh ChauhanTransformer InterpretabilityLow-Rank Attention

  17. A Multi-Dimensional Evaluation of Explainability in Media Bias Detection

    Jul 22, 2026Ting Chen, Raina Zhang, Benjamin M. Ampel +1Attention Head AnalysisMechanistic Interpretability

  18. Logit-Contribution Scoring Identifies Non-Literal Retrieval Heads

    Jul 1, 2026Aryo Pradipta Gema, Beatrice Alex, Pasquale MinerviniLong-Context RetrievalAttention Head Analysis

  19. Robust Harmful Features Under Jailbreak Attacks: Mechanistic Evidence from Attention Head Specialization in Large Language Models

    Jun 26, 2026Yanchen Yin, Dongqi Han, Linghui LiAttention Head AnalysisJailbreak Attacks

  20. Explaining Attention with Program Synthesis

    Jun 17, 2026Amiri Hayes, Belinda Z Li, Jacob AndreasTransformer InterpretabilityAttention Head Analysis

  21. Rethinking the Role of Efficient Attention in Hybrid Architectures

    Jun 13, 2026Ziqing Qiao, Yinuo Xu, Chaojun Xiao +6Attention Head AnalysisLong-Context Modeling

  22. Where Computation Lives Inside TabPFN: Causal Localisation of Attention Head Function

    Jun 11, 2026Atharva Gupta, Dhruv Kumar, Murari Mandal +1Tabular Foundation ModelsAttention Head Analysis

  23. Positional versus Symbolic Attention Heads: Learning Dynamics, RoPE Geometry, and Length Generalization

    May 29, 2026Felipe Urrutia, Juan José Alegría, Cinthia Sanchez Macias +3Rotary Positional EmbeddingsAttention Head Analysis

  24. Revealing Algorithmic Deductive Circuits for Logical Reasoning

    May 27, 2026Phuong Minh Nguyen, Tien Huu Dang, Naoya InoueAttention Head AnalysisLLM Interpretability

  25. Stable Attention Response for Reliable Precipitation Nowcasting

    May 13, 2026Penghui Wen, Zexin Hu, Sen Zhang +6Precipitation ForecastingAttention Head Analysis

  26. The Routing and Filtering Structure of Attention

    May 12, 2026Shafayeth Jamil, Rehan KapadiaAttention Head AnalysisSelf-Attention

  27. Dissecting Jet-Tagger Through Mechanistic Interpretability

    May 11, 2026Saurabh Rai, Sanmay GangulyTransformer InterpretabilityAttention Head Analysis

  28. A Game Theoretic Free Energy Analysis of Higher Order Synergy in Attention Heads of Large Language Models

    May 10, 2026Djamel BouchaffraLLM PruningAttention Head Analysis

  29. When and Why Grouping Attention Heads Accelerates Muon Optimization

    May 9, 2026Hongtao Zhang, Wenjie Zhou, Wei Chen +1Attention Head AnalysisMuon Optimizer

  30. Learning to Route Queries to Heads for Attention-based Re-ranking with Large Language Models

    Apr 27, 2026Yuxing Tian, Fengran Mo, Zhiqi Huang +2Attention Head AnalysisLearning to Rank

  31. HeadRank: Decoding-Free Passage Reranking via Preference-Aligned Attention Heads

    Apr 19, 2026Juyuan Wang, Chenxing Wang, Yuchen Fang +8Attention Head AnalysisSelf-Attention

  32. Compressed Sensing for Capability Localization in Large Language Models

    Feb 11, 2026Anna Bair, Yixuan Even Xu, Mingjie Sun +1Attention Head AnalysisLLM Interpretability

  33. Garbage Attention in Large Language Models: BOS Sink Heads and Sink-aware Pruning

    Jan 11, 2026Jaewon Sok, Jewon Yeom, Seonghyeon Park +2LLM PruningAttention Head Analysis

  34. Performance-Efficiency Tradeoffs in Transformers: An Approximation Theory Perspective

    Oct 4, 2025Ruoxi Yu, Haotian Jiang, Jingpu Cheng +3Softmax AttentionAttention Head Analysis