Language Model Decoding

Latest papers 108

All topics
CardsList
  1. Can Language Models Learn to Reject Their Own Bad Reasoning Steps?

    Oct 5, 2026Siheng Xiong, Xiaoze Liu, Yiqiao Jin +2LLM Self-CorrectionLanguage Model Decoding

  2. Nash Equilibrium Text: A Game-Theoretic Decoding Framework for Text Generation

    Oct 5, 2026Alireza Jafari, Arman Adibi, Mohammad Ghavamzadeh +1Nash EquilibriumNon-Autoregressive Text Generation

  3. Gacha Decoding: Eliciting Diverse Generations Through Instruction Following

    Oct 1, 2026Scott Geng, Yufei Zhang, Joseph Lee +3Language Model DecodingDiverse Text Generation

  4. AS2^2D: Accelerating On-Demand Audio Understanding on Mobile Devices

    Sep 29, 2026Yunzhe Li, Kyoungjun Park, Hongzi Zhu +1On-Device Language Model InferenceLanguage Model Decoding

  5. Twist, Don't Tilt: Trajectory-Exact Constrained Decoding for Masked Diffusion Models

    Sep 28, 2026Aditya Thimmaiah, Lara Marinov, Jayanth Srinivasa +3Constrained DecodingMasked Diffusion Models

  6. Composable Decoding on the Probability Simplex: Theory and Implementation

    Sep 28, 2026Xiaotong Ji, Ahmed Khaled Khamis, Rasul Tutunov +2Constrained DecodingLanguage Model Decoding

  7. Where Activation Sparsity and KV-Cache Sparsity Cross in LLM Decoding

    Sep 27, 2026Jungseob Lee, Seungyoon Lee, Seongtae Hong +2Language Model DecodingActivation Sparsity

  8. Encoded but Not Decoded: Layer-Localized Evidence for a Three-Level Gap in LLM Syntax

    Sep 24, 2026Zhenyan Lu, He Wang, Xiaohui HuangLLM EvaluationLanguage Model Decoding

  9. FLEET: From Logits Entropy to Enhanced Trajectories in Text Generation

    Sep 23, 2026Oleksii Streltsov, Oleksandra VitkoLanguage Model DecodingMemory-Augmented Language Models

  10. Greedy Decoding Is Not Precision-Invariant: Cross-Precision Output Divergence in LLM Inference

    Sep 22, 2026Gaoyuan Du, Anam Nawaz Khan, Rex Zhou +4Language Model DecodingLLM Inference

  11. On-Demand Attention: Language Models Know When to Recall

    Sep 17, 2026Haibo Feng, Ruiqi Liang, Hanyang Peng +1Language Model DecodingLong-Context Language Model Inference

  12. Beyond Truncation: Rethinking LLM Decoding as Ensemble Pruning

    Sep 16, 2026Dunyao Xue, Chengshuo Du, Zhengbo Wang +2Language Model DecodingDiverse Text Generation

  13. Look Before You Leap: Factual Decoding with Internal Attribution Signals

    Sep 14, 2026Hayeong Ryu, JungMin Yun, Byeonggeuk Lim +2Language Model DecodingLanguage Model Error Detection

  14. Chopthin-Consensus Power Sampling: A Diversity-Preserving Approach to LLM Decoding

    Sep 14, 2026Minoo Ahmadi, Seyedarmin Azizi, Erfan Baghaei Potraghloo +2Language Model DecodingLLM Inference

  15. Route, Don't Fix: Regime-Dependent Decoding Correction and a Trajectory-Gated Router for Reliable Clinical LLM Answer Selection

    Sep 13, 2026Zeyu Dong, Benjamin Wang, Joyee W. JinAdaptive InferenceLanguage Model Decoding

  16. Line-Coupled Language Model

    Sep 7, 2026Shiyuan Li, Shaorong Zhang, Zhaorui Yang +3Multi-Token PredictionLanguage Model Decoding

  17. Predict, Don't Iterate: Efficient Adaptive-Length Infilling for Diffusion Language Models

    Sep 2, 2026Haobo Xu, Sirui Chen, Yuanchen Bei +5Language Model DecodingDiffusion Language Models

  18. hLLM: Single Pass Decoding for Generative Reranking

    Sep 1, 2026Emil Laftchiev, Prachi Agrawal, Moe Kayali +7Language Model DecodingLLM Reranking

  19. Overfitting Mitigation via Singular Value Decomposition in Minimum Bayes Risk Decoding

    Sep 1, 2026Riza Setiawan Soetedjo, Yusuke Sakai, Hidetaka Kamigaito +2Language Model DecodingMBR Decoding

  20. Hidden in the Request: Explaining Unethical LLM Compliance through Token Relevance

    Aug 24, 2026Or Biton, Tomer Krichli, Itai Allouche +1Language Model DecodingLanguage Model Safety Evaluation

  21. Ripple-Pivot Search: Active Parallel Decoding for Diffusion Large Language Models

    Aug 12, 2026Yushi Ye, Xu Chen, Haoyun Jiang +7Language Model DecodingDiffusion Language Model Inference

  22. FutureBridge: Token Selection Beyond Local Preference in Collaborative Decoding

    Aug 7, 2026Quanquan Li, Hongbo Zhang, Yihe Chi +9Language Model DecodingMulti-LLM Collaboration

  23. Temperature-driven inversion and nonlinear dynamics in ChatGPT-like AIs

    Aug 2, 2026Neil F. Johnson, Frank Yingjie Huo, Bella Xinrui LiLanguage Model DecodingAutoregressive Generation

  24. Instruction-Tuned Language Models Cannot Sample from Distributions They Can Describe

    Jul 28, 2026Chaemin Jang, Dongman Lee, Jihee KimLanguage Model DecodingLLM Prompting