Transformer

Momentum

26 papers in the last four weeks, up 44% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 351

All topics
CardsList
  1. Marformer: A Transformer for Predicting Missing Data Distributions

    Oct 8, 2026Prabhav Singh, Xiheng Tom Wang, Haojun Shi +1Learning with Missing DataConditional Distribution Estimation

  2. Causal-fate dynamics of unrealized influence

    Oct 8, 2026Yiwei Liu, Luwei Yang, Shunbo LeiLatent Dynamics ModelingCausal Inference

  3. How Do Transformers Learn to Represent Symmetries?

    Oct 7, 2026Eduardo Santos-Escriche, Valerie Engelmayer, Ya-Wei Eileen Lin +1Invariant Representation LearningTransformer

  4. Leaner Transformers Can Easily Learn to Cluster

    Oct 7, 2026Charlotte Park, Kenneth L. Clarkson, Lior Horesh +2TransformerClustering

  5. LayerRoPE: Dynamic Depth-wise Magnitude & Angular Superposition

    Oct 6, 2026Shikhar Srivastava, Christopher KananTransformerPositional Encoding

  6. No Transformer Beats Six Covariates: Long-Horizon Prediction of Depressive Symptoms from Childhood Essays

    Oct 6, 2026Daniel Kua, Emrul Hasan, John-Jose Nunez +1TransformerDepression Detection

  7. Stability of Measure-to-Measure Transformers on Sub-Gaussian Data

    Oct 6, 2026Frank Cole, Nicholas H. Nelsen, Takashi FuruyaTransformerStatistical Learning Theory

  8. Exact-Solution Volume and Length Generalization in Transformers

    Oct 6, 2026Yijia Jessica Zhu, David ChiangTransformer ExpressivityTransformer

  9. Deep Learning for Sleep Heart Rate Estimation from Accelerometers: Toward Population-Scale Cardiac Insight Without Optical Sensors

    Oct 5, 2026Tanbin Islam Rohan, Pranjol Sen Gupta, Tanusree Debi +1TransformerWearable Sensing

  10. MatrixFormer: A Foundation Model for Matrix Completion

    Oct 5, 2026Dwaipayan Saha, Jacob Feitelberg, Kyuseong Choi +2Incomplete Data ImputationTransformer

  11. MIRT: Transformers for Truthful Generative Auctions with Whole-feed Permutation Externalities

    Oct 5, 2026Ali Elahi, Ermis Soumalias, Jason Cheuk Nam Liang +2TransformerLearning to Rank

  12. A Physics-Guided Transformer Framework for Electromigration Analysis in Multi-Segment Interconnects

    Oct 5, 2026Pavlos Stoikos, Anuj Pathania, George FlorosNeural Surrogate ModelingTransformer

  13. SO(3)-RoPE for Spherical Transformers

    Oct 5, 2026Christian Libner, Chase van de Geijn, Alexander S. Ecker +1Rotary Positional EmbeddingsTransformer

  14. Faynt: Scaling and Optimizing Policies for Competitive Melee

    Oct 1, 2026Ali Janati, Nikita Kuzmin, Rohit Swamy +1Reinforcement LearningSelf-Play RL

  15. Universal interpolation for deep residual self-attention networks

    Oct 1, 2026Sibylle Marcotte, Joan BrunaSoftmax AttentionTransformer

  16. Lang3DSeg: Annotation-Free Open-Vocabulary 3D Segmentation with Point Transformers

    Oct 1, 2026Cigdem Kokenoz, Amir Salarpour, Alkim Domeke +5Open-Vocabulary 3D SegmentationTransformer

  17. Association profile conditioning in a set-temporal transformer for cross-session intracortical motor decoding

    Sep 30, 2026Xinyuan Zhang, Handong Mo, Pengfei Wen +5TransformerNeural Decoding

  18. Function-Space Transformer with Adaptive Anchors

    Sep 29, 2026Guorui Sang, Pedram RooshenasRepresentation LearningVisual Representation Learning

  19. Pretraining Latent Information Feedback Transformers with Teacher Supervision

    Sep 29, 2026Dor Tirosh, Ido Amos, Mor GevaLanguage Model PretrainingTransformer

  20. The Geometry of Inference in Transformer Residual Streams

    Sep 29, 2026Timur Mudarisov, Mikhail Burtsev, Radu StateTransformer InterpretabilityTransformer Inference

  21. Transformers Stop Thinking Too Early, and a Tiny LoRA Fixes It

    Sep 29, 2026Zehao Jin, Ruixuan Deng, Junran WangTransformerLLM Fine-Tuning

  22. Universal Approximation of Measure-to-Measure Operators by Pushforwards

    Sep 28, 2026Takashi Furuya, Nicholas H. Nelsen, Frank ColeTransformerUniversal Approximation

  23. Scalable In-Context Reinforcement Learning with Recurrent Algorithm Distillation

    Sep 28, 2026Yuanqing Ma, Zhenrui Zheng, Chenjun XiaoTransformerIn-Context RL

  24. SPIDER: Multi-Layer Semantic Token Pruning and Adaptive Sub-Layer Skipping in Multimodal Large Language Models

    Sep 28, 2026Tianxiang Chen, Zhentao Tan, Zi Ye +9Efficient Multimodal InferenceTransformer

  25. Tracking States or Tracking Cosets? An Algebraic Account of Learned State Tracking

    Sep 24, 2026Zhiyu Zhang, Yupeng LiTransformerRecurrent Neural Networks

  26. Transformers as Cross-Task Learners: Shared Structure Drives Sample Efficiency in In-Context Learning

    Sep 24, 2026Zhongjie Shi, Rongjie Lai, Alexander Cloninger +1TransformerMulti-Task Learning

  27. PBLH Estimation from Satellite Radiances via a Dual-Encoder Transformer

    Sep 23, 2026Lorenzo Innocenti, Luca Catalano, Edoardo Arnaudo +4TransformerRemote Sensing