Language Model Decoding

Latest papers 108

All topics
CardsList
  1. Can Language Models Learn to Reject Their Own Bad Reasoning Steps?

    Oct 5, 2026Siheng Xiong, Xiaoze Liu, Yiqiao Jin +2LLM Self-CorrectionLanguage Model Decoding

  2. Nash Equilibrium Text: A Game-Theoretic Decoding Framework for Text Generation

    Oct 5, 2026Alireza Jafari, Arman Adibi, Mohammad Ghavamzadeh +1Nash EquilibriumNon-Autoregressive Text Generation

  3. Gacha Decoding: Eliciting Diverse Generations Through Instruction Following

    Oct 1, 2026Scott Geng, Yufei Zhang, Joseph Lee +3Language Model DecodingDiverse Text Generation

  4. AS2^2D: Accelerating On-Demand Audio Understanding on Mobile Devices

    Sep 29, 2026Yunzhe Li, Kyoungjun Park, Hongzi Zhu +1On-Device Language Model InferenceLanguage Model Decoding

  5. Twist, Don't Tilt: Trajectory-Exact Constrained Decoding for Masked Diffusion Models

    Sep 28, 2026Aditya Thimmaiah, Lara Marinov, Jayanth Srinivasa +3Constrained DecodingMasked Diffusion Models

  6. Composable Decoding on the Probability Simplex: Theory and Implementation

    Sep 28, 2026Xiaotong Ji, Ahmed Khaled Khamis, Rasul Tutunov +2Constrained DecodingLanguage Model Decoding

  7. Where Activation Sparsity and KV-Cache Sparsity Cross in LLM Decoding

    Sep 27, 2026Jungseob Lee, Seungyoon Lee, Seongtae Hong +2Language Model DecodingActivation Sparsity

  8. Encoded but Not Decoded: Layer-Localized Evidence for a Three-Level Gap in LLM Syntax

    Sep 24, 2026Zhenyan Lu, He Wang, Xiaohui HuangLLM EvaluationLanguage Model Decoding

  9. FLEET: From Logits Entropy to Enhanced Trajectories in Text Generation

    Sep 23, 2026Oleksii Streltsov, Oleksandra VitkoLanguage Model DecodingMemory-Augmented Language Models

  10. Greedy Decoding Is Not Precision-Invariant: Cross-Precision Output Divergence in LLM Inference

    Sep 22, 2026Gaoyuan Du, Anam Nawaz Khan, Rex Zhou +4Language Model DecodingLLM Inference

  11. On-Demand Attention: Language Models Know When to Recall

    Sep 17, 2026Haibo Feng, Ruiqi Liang, Hanyang Peng +1Language Model DecodingLong-Context Language Model Inference

  12. Beyond Truncation: Rethinking LLM Decoding as Ensemble Pruning

    Sep 16, 2026Dunyao Xue, Chengshuo Du, Zhengbo Wang +2Language Model DecodingDiverse Text Generation

  13. Look Before You Leap: Factual Decoding with Internal Attribution Signals

    Sep 14, 2026Hayeong Ryu, JungMin Yun, Byeonggeuk Lim +2Language Model DecodingLanguage Model Error Detection

  14. Chopthin-Consensus Power Sampling: A Diversity-Preserving Approach to LLM Decoding

    Sep 14, 2026Minoo Ahmadi, Seyedarmin Azizi, Erfan Baghaei Potraghloo +2Language Model DecodingLLM Inference

  15. Route, Don't Fix: Regime-Dependent Decoding Correction and a Trajectory-Gated Router for Reliable Clinical LLM Answer Selection

    Sep 13, 2026Zeyu Dong, Benjamin Wang, Joyee W. JinAdaptive InferenceLanguage Model Decoding

  16. Line-Coupled Language Model

    Sep 7, 2026Shiyuan Li, Shaorong Zhang, Zhaorui Yang +3Multi-Token PredictionLanguage Model Decoding

  17. Predict, Don't Iterate: Efficient Adaptive-Length Infilling for Diffusion Language Models

    Sep 2, 2026Haobo Xu, Sirui Chen, Yuanchen Bei +5Language Model DecodingDiffusion Language Models

  18. hLLM: Single Pass Decoding for Generative Reranking

    Sep 1, 2026Emil Laftchiev, Prachi Agrawal, Moe Kayali +7Language Model DecodingLLM Reranking

  19. Overfitting Mitigation via Singular Value Decomposition in Minimum Bayes Risk Decoding

    Sep 1, 2026Riza Setiawan Soetedjo, Yusuke Sakai, Hidetaka Kamigaito +2Language Model DecodingMBR Decoding

  20. Hidden in the Request: Explaining Unethical LLM Compliance through Token Relevance

    Aug 24, 2026Or Biton, Tomer Krichli, Itai Allouche +1Language Model DecodingLanguage Model Safety Evaluation

  21. Ripple-Pivot Search: Active Parallel Decoding for Diffusion Large Language Models

    Aug 12, 2026Yushi Ye, Xu Chen, Haoyun Jiang +7Language Model DecodingDiffusion Language Model Inference

  22. FutureBridge: Token Selection Beyond Local Preference in Collaborative Decoding

    Aug 7, 2026Quanquan Li, Hongbo Zhang, Yihe Chi +9Language Model DecodingMulti-LLM Collaboration

  23. Temperature-driven inversion and nonlinear dynamics in ChatGPT-like AIs

    Aug 2, 2026Neil F. Johnson, Frank Yingjie Huo, Bella Xinrui LiLanguage Model DecodingAutoregressive Generation

  24. Instruction-Tuned Language Models Cannot Sample from Distributions They Can Describe

    Jul 28, 2026Chaemin Jang, Dongman Lee, Jihee KimLanguage Model DecodingLLM Prompting

  25. Understanding Semantic IDs: From Item Representation to Item Selection in Generative Recommendation

    Jul 27, 2026Junting Wang, Xinrui He, Yunzhe Li +1Semantic ID RecommendationLanguage Model Decoding

  26. Speculative Correction: Draft-then-Refine Decoding for Diffusion Language Models

    Jul 21, 2026Brian K Chen, Chong Wu, Kenji KawaguchiLanguage Model DecodingSpeculative Decoding for Diffusion Language Models

  27. Adaptive Multi-Step Lookahead Decoding for Diffusion Language Models

    Jul 17, 2026Yingqian Cui, Wei Deng, Lantao Mei +4Masked Diffusion ModelsLanguage Model Decoding

  28. Noisy-Channel Minimum Bayes Risk Decoding

    Jul 6, 2026Yusuke Sakai, Hidetaka Kamigaito, Taro WatanabeLanguage Model DecodingMBR Decoding

  29. What Does a Routing Oracle Measure Under Stochastic Decoding? Coupling, Scorer Choice, and Single-Commit Ceilings

    Jul 3, 2026Teng-Ruei ChenLLM EvaluationLanguage Model Decoding

  30. Set Diffusion: Interpolating Token Orderings Between Autoregression and Diffusion for Fast and Flexible Decoding

    Jul 2, 2026Marianne Arriola, Volodymyr KuleshovLanguage Model DecodingDiffusion Language Model Decoding

  31. Depth Exploration for LLM Decoding

    Jun 28, 2026Weisi Yang, Zipeng Sun, Stephen XiaLanguage Model DecodingLLM Inference Acceleration

  32. When are likely answers right? On Sequence Probability and Correctness in LLMs

    Jun 25, 2026Johannes Zenn, Jonas GeipingLLM EvaluationLanguage Model Decoding

  33. Scheduling Thoughts: Learning the Order of Thought in Diffusion Language Models

    Jun 22, 2026Jiawei Xu, Minghui Liu, Aakriti Agrawal +2Masked Diffusion ModelsLanguage Model Decoding

  34. The Anatomy of the CTC Oracle Gap: Acoustic Exhaustion and Linguistic Recovery

    Jun 22, 2026Ivan NovosadASR EvaluationLanguage Model Decoding

  35. Breaking the Likelihood Trap: Variance-Calibrated Modulation for Large Language Model Decoding

    Jun 21, 2026Yuanhao Ding, Meimingwei Li, Esteban Garces Arias +3Open-Ended GenerationLanguage Model Decoding

  36. Deeper is Not Always Better: Mitigating the Alignment Tax via Confident Layer Decoding

    Jun 20, 2026Xuanming Zhang, Sining Zhoubian, Yuxuan Chen +8LLM AlignmentLanguage Model Decoding

  37. From Awareness to Adherence: Bridging the Context Gap in Spoken Dialogue Systems via Context-Aware Decoding

    Jun 15, 2026Che Hyun Lee, Heeseung Kim, Sungroh YoonLanguage Model DecodingSpoken Dialogue Systems

  38. ReSET: Accurate Latency-Critical NVFP4 Reasoning via Step-Aware Temperature Scaling

    Jun 11, 2026Sihwa Lee, Janghwan Lee, Donghoon Yoo +4LLM QuantizationLanguage Model Decoding

  39. K-Forcing: Joint Next-K-Token Decoding via Push-Forward Language Modeling

    Jun 9, 2026Zhiwei Tang, Yuanyu He, Yizheng Han +4LLM ServingLanguage Model Decoding

  40. STORM: Stepwise Token Optimization with Reward-Guided Beam Search

    Jun 9, 2026Arthur Satouf, Giulio D'Erasmo, Yuxuan Zong +3Language Model DecodingLexical Retrieval

  41. Gradient-Guided Reward Optimization for Inference-time Alignment

    Jun 8, 2026Hankun Lin, Ruqi ZhangReward HackingLLM Alignment

  42. Steganography Without Modification: Hidden Communication via LLM Seeds

    Jun 8, 2026Felix Mächtle, Jonas Sander, Sebastian Berndt +3Language Model DecodingLLM Inference

  43. The Token Not Taken: Sampling, State, and the Stochasticity of AI Agents

    Jun 8, 2026Muhammad Zia Hydari, Raja IqbalLanguage Model DecodingLLM Agents

  44. Inside the LLM Word Factory

    Jun 7, 2026Benzi Busigin, Yuval PinterLanguage Model DecodingLLM Interpretability