Autoregressive Language Modeling

Latest papers 81

All topics
CardsList
  1. PassGPT+: Leveraging Linguistic Priors for Password Modeling

    Sep 30, 2026Rajneesh Anand, Neeraj Lakshmanan, Masoud YariAutoregressive Language ModelingDiffusion Language Models

  2. Decoupling Token Roles in Autoregressive Pretraining

    Sep 27, 2026Suqin Yuan, Runqi Lin, Kevin Qinghong Lin +4Language Model PretrainingAutoregressive Language Modeling

  3. Log-Depth Recurrent Language Modeling

    Sep 23, 2026Yiqin Wang, Nuri Cingillioglu, Charles PertLong-Context Language ModelingAutoregressive Language Modeling

  4. Variational Quantum Transformer Architecture for Synthetic Language Generation

    Sep 16, 2026Julian Hager, Michael Kölle, Gerhard Stenzel +3Quantum Machine LearningAutoregressive Language Modeling

  5. Structural priors for data-efficient language learning

    Sep 12, 2026Yana Veitsman, Jonas Mayer Martins, Jonathan Lautenschlager +1Language Model PretrainingNeural Network Initialization

  6. RiLM: Parameter-Efficient Language Modeling via Geodesic Decoding

    Sep 9, 2026Fang LiAutoregressive Language ModelingLanguage Modeling

  7. Line-Coupled Language Model

    Sep 7, 2026Shiyuan Li, Shaorong Zhang, Zhaorui Yang +3Multi-Token PredictionLanguage Model Decoding

  8. ALRA: Adaptive Local Relational Alignment for Logit-Based Pre-training Distillation of Autoregressive Language Models

    Sep 3, 2026Quang Hoang Trung, Quang Huu Hieu, Nguyen Van Hoang Phuc +1Language Model PretrainingAutoregressive Language Modeling

  9. Probabilistic Model Checking of Autoregressive Neural Sequence Models

    Sep 1, 2026Helge Spieker, Dennis Gross, Arnaud GotliebNeural Network VerificationAutoregressive Language Modeling

  10. One Form to Transfer Them All: Pretraining Multilingual Language Models Beyond Native Orthography

    Aug 26, 2026Muge Zhang, Aaron Jencks, Krishna Badikela +2Language Model PretrainingMultilingual Language Models

  11. TANGO: Treating Tokens as Operators

    Aug 22, 2026Joshua NunleyTransformer FFNsTransformer

  12. Full-bandwidth transformer

    Aug 9, 2026Xi Wang, Ziyang Cai, Zheng Zhan +5Autoregressive Language ModelingRecurrent Transformers

  13. Kathleen Writes: Autoregressive Generation and Data Scaling Without Attention

    Aug 5, 2026George FountzoulasLanguage Model Generation EvaluationAutoregressive Language Modeling

  14. TextNCA: Neural Cellular Automata for Language Modeling via Hierarchical Local Attention

    Aug 3, 2026Avni Mittal, Avinash Anand, Ashutosh Kumar +7Neural Cellular AutomataAutoregressive Language Modeling

  15. Total Variation Distance Estimation in Autoregressive Models

    Jul 21, 2026Eric Price, Kevin Tian, Zhiyang Xun +1LLM EvaluationLLM Inference

  16. LeRoPE: Learnable RoPE Frequencies Improve Language Modeling

    Jul 11, 2026Petros Karypis, Sean O'Brien, Shreyas Kadekodi +2Language Model PretrainingRotary Positional Embeddings

  17. Nemotron-Labs-Diffusion: A Tri-Mode Language Model Unifying Autoregressive, Diffusion, and Self-Speculation Decoding

    Jul 7, 2026Yonggan Fu, Lexington Whalen, Abhinav Garg +23Autoregressive DiffusionAutoregressive Language Modeling

  18. A Unified Framework for In-Context Learning with Causal and Masked Language Models

    Jul 5, 2026Chenrui Liu, Chuanlong Xie, Falong Tan +2Masked Language ModelingAutoregressive Language Modeling

  19. How Token Influence Decays with Distance: A Green-Function View of Trained Language Models

    Jun 28, 2026Matthias Brändel, Stephan Köhler, Oliver RheinbachTransformer InterpretabilityAutoregressive Language Modeling

  20. MultiHashFormer: Hash-based Generative Language Models

    Jun 26, 2026Huiyin Xue, Atsuki Yamaguchi, Nikolaos AletrasLLM CompressionDecoder-Only Language Models