Multi-Token Prediction

Latest papers 24

All topics
CardsList
  1. IronLLM: Forging Compact Edge-Native Language Models for Real-Time Embodied Intelligence

    Sep 29, 2026Changdi Yang, Fengquan Jiao, Haochih Lin +14LLM Inference OptimizationLanguage Modeling

  2. Line-Coupled Language Model

    Sep 7, 2026Shiyuan Li, Shaorong Zhang, Zhaorui Yang +3Autoregressive Language ModelsLanguage Modeling

  3. LoopMTP: A looped transformer guided by latent multi-token prediction

    Aug 4, 2026Behzad Shomali, Markus Frey, David Berghaus +2Multi-Token PredictionTransformer Architectures

  4. AdaMTP: An Adaptive Training Paradigm for Multi-Token Prediction

    Aug 1, 2026Ziqiang Cui, Han Shi, Bowei He +8Multi-Token PredictionLarge Language Model Backbones

  5. P-MTP: Efficient Document Parsing via Multi-Token Prediction with Progressive Depth Scaling

    Jun 23, 2026Le Xiang, Chenxi Zhai, Shu Wei +5Multi-Token PredictionVisual Token Pruning

  6. Speculative Pipeline Decoding: Higher-Accruacy and Zero-Bubble Speculation via Pipeline Parallelism

    May 29, 2026Yijiong Yu, Huazheng Wang, Shuai Yuan +2Speculative DecodingSelf-Speculative

  7. Joint Training of Multi-Token Prediction in Reinforcement Learning via Optimal Coefficient Calibration

    May 27, 2026Zili Wang, Jiajun Chai, Lin Chen +3Reinforcement Learning With Verifiable RewardMulti-Token Prediction

  8. Pair-In, Pair-Out: Latent Multi-Token Prediction for Efficient LLMs

    May 26, 2026Wenhui Tan, Minghao Li, Xiaoqian Ma +5Multi-Token PredictionLarge Language Model Decoding

  9. Multi-Token Residual Prediction

    May 12, 2026Yufeng Xu, Zishuo Bao, Qian Wang +6Multi-Token PredictionDiffusion Language Models

  10. From Token to Token Pair: Efficient Prompt Compression for Large Language Models in Clinical Prediction

    May 12, 2026Mingcheng Zhu, Zhiyao Luo, Yu Liu +1Multi-Token PredictionElectronic Health Records

  11. MemoSight: Unifying Context Compression and Multi Token Prediction for Reasoning Acceleration

    Apr 16, 2026Xinyu Liu, Xin Liu, Bo Jin +8Multi-Token PredictionReasoning Benchmark

  12. HSD: Training-Free Acceleration for Document Parsing Vision-Language Models with Hierarchical Speculative Decoding

    Feb 13, 2026Wenhui Liao, Hongliang Li, Pengyu Xie +15Document ParsingSpeculative Decoding