Language Model Decoding

Latest papers 108

All topics
CardsList
  1. Understanding Semantic IDs: From Item Representation to Item Selection in Generative Recommendation

    Jul 27, 2026Junting Wang, Xinrui He, Yunzhe Li +1Semantic ID RecommendationLanguage Model Decoding

  2. Speculative Correction: Draft-then-Refine Decoding for Diffusion Language Models

    Jul 21, 2026Brian K Chen, Chong Wu, Kenji KawaguchiLanguage Model DecodingSpeculative Decoding for Diffusion Language Models

  3. Adaptive Multi-Step Lookahead Decoding for Diffusion Language Models

    Jul 17, 2026Yingqian Cui, Wei Deng, Lantao Mei +4Masked Diffusion ModelsLanguage Model Decoding

  4. Noisy-Channel Minimum Bayes Risk Decoding

    Jul 6, 2026Yusuke Sakai, Hidetaka Kamigaito, Taro WatanabeLanguage Model DecodingMBR Decoding

  5. What Does a Routing Oracle Measure Under Stochastic Decoding? Coupling, Scorer Choice, and Single-Commit Ceilings

    Jul 3, 2026Teng-Ruei ChenLLM EvaluationLanguage Model Decoding

  6. Set Diffusion: Interpolating Token Orderings Between Autoregression and Diffusion for Fast and Flexible Decoding

    Jul 2, 2026Marianne Arriola, Volodymyr KuleshovLanguage Model DecodingDiffusion Language Model Decoding

  7. Depth Exploration for LLM Decoding

    Jun 28, 2026Weisi Yang, Zipeng Sun, Stephen XiaLanguage Model DecodingLLM Inference Acceleration

  8. When are likely answers right? On Sequence Probability and Correctness in LLMs

    Jun 25, 2026Johannes Zenn, Jonas GeipingLLM EvaluationLanguage Model Decoding

  9. Scheduling Thoughts: Learning the Order of Thought in Diffusion Language Models

    Jun 22, 2026Jiawei Xu, Minghui Liu, Aakriti Agrawal +2Masked Diffusion ModelsLanguage Model Decoding

  10. The Anatomy of the CTC Oracle Gap: Acoustic Exhaustion and Linguistic Recovery

    Jun 22, 2026Ivan NovosadASR EvaluationLanguage Model Decoding

  11. Breaking the Likelihood Trap: Variance-Calibrated Modulation for Large Language Model Decoding

    Jun 21, 2026Yuanhao Ding, Meimingwei Li, Esteban Garces Arias +3Open-Ended GenerationLanguage Model Decoding

  12. Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding

    Jun 20, 2026Xuanming Zhang, Sining Zhoubian, Yuxuan Chen +8LLM AlignmentLanguage Model Decoding

  13. From Awareness to Adherence: Bridging the Context Gap in Spoken Dialogue Systems via Context-Aware Decoding

    Jun 15, 2026Che Hyun Lee, Heeseung Kim, Sungroh YoonLanguage Model DecodingSpoken Dialogue Systems

  14. ReSET: Accurate Latency-Critical NVFP4 Reasoning via Step-Aware Temperature Scaling

    Jun 11, 2026Sihwa Lee, Janghwan Lee, Donghoon Yoo +4LLM QuantizationLanguage Model Decoding

  15. K-Forcing: Joint Next-K-Token Decoding via Push-Forward Language Modeling

    Jun 9, 2026Zhiwei Tang, Yuanyu He, Yizheng Han +4LLM ServingLanguage Model Decoding

  16. STORM: Stepwise Token Optimization with Reward-Guided Beam Search

    Jun 9, 2026Arthur Satouf, Giulio D'Erasmo, Yuxuan Zong +3Language Model DecodingLexical Retrieval

  17. Gradient-Guided Reward Optimization for Inference-time Alignment

    Jun 8, 2026Hankun Lin, Ruqi ZhangReward HackingLLM Alignment

  18. Steganography Without Modification: Hidden Communication via LLM Seeds

    Jun 8, 2026Felix Mächtle, Jonas Sander, Sebastian Berndt +3Language Model DecodingLLM Inference

  19. The Token Not Taken: Sampling, State, and the Stochasticity of AI Agents

    Jun 8, 2026Muhammad Zia Hydari, Raja IqbalLanguage Model DecodingLLM Agents

  20. Inside the LLM Word Factory

    Jun 7, 2026Benzi Busigin, Yuval PinterLanguage Model DecodingLLM Interpretability