Next-Token Distribution

Latest papers 19

All topics
CardsList
  1. Interpolated Policy Distillation: A Controllable Continuum Between Off-Policy and On-Policy Distillation

    Sep 29, 2026Youxu Shi, Yifan Sun, Dacheng Yin +5Off-Policy LearningNext-Token Distribution

  2. CertMark: Distortion-Free Multi-Bit Watermarking with Certified Decoding

    Sep 27, 2026Paweł Batorski, Przemysław Spurek, Paul SwobodaWatermarksDecoding

  3. Next-token functional estimation

    Sep 17, 2026Milind Nakul, Vidya Muthukumar, Ashwin PananjadyNext-Token DistributionSurprisal

  4. Attention-Steered Vision-Language Models for Sign Language Translation

    Jul 31, 2026Meibo Hu, Guohao Sun, Annemarie D. Ross +2Gloss-Free Sign Language TranslationSign Language Translation

  5. Geometric Configurations of Perturbed Jailbreak Prompts

    Jul 22, 2026Lynn Delcon, Andres Algaba, Vincent GinisLarge Language Model JailbreaksJailbreak Attacks

  6. K-Forcing: Joint Next-K-Token Decoding via Push-Forward Language Modeling

    Jun 9, 2026Zhiwei Tang, Yuanyu He, Yizheng Han +4Autoregressive Language ModelsAutoregressive Generation

  7. Rethinking the Role of Positional Encoding: Sliding-Window Transformers without PE Remain Turing Complete

    Jun 1, 2026Qian Li, Xinyu Mao, Shang-Hua TengPositional EncodingTransformer Architectures

  8. Bastion: Budget-Aware Speculative Decoding with Tree-structured Block Diffusion Drafting

    May 28, 2026Soowon Oh, Nam Cao, Yujin Kim +4Block-Diffusion DrafterSpeculative Decoding

  9. The Bridge-Garden Dilemma in LLM Distillation: Why Mixing Hard and Soft Labels Works

    May 25, 2026Guanghui Wang, Kaiwen Lv Kacuila, Zhiyong Yang +5Knowledge DistillationDataset Distillation

  10. OLLM: Options-based Large Language Models

    Apr 21, 2026Shashank Sharma, Janina Hoffmann, Vinay NamboodiriLLM Reasoning StrategiesLarge Language Models(Llms

  11. Self-Improving Tabular Language Models via Iterative Reward-Guided Post-Training

    Apr 21, 2026Yunbo Long, Tejumade Afonja, Guangya Hao +2Post-TrainingNext-Token Distribution

  12. Deriving Neural Scaling Laws from the statistics of natural language

    Feb 7, 2026Francesco Cagnetta, Allan Raventós, Surya Ganguli +1Scaling LawsNext-Token Distribution

  13. Extracting Probabilistic Knowledge from Large Language Models for Bayesian Network Parameterization

    May 21, 2025Aliakbar Nafar, Kristen Brent Venable, Zijun Cui +1Bayesian NetworksPrior Knowledge Integration