Object Tokens

Momentum

1 paper in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 20

All topics
CardsList
  1. Register Tokens for Bounded-State Reasoning in Diffusion Language Models

    Sep 14, 2026Albert Ge, Chandan Singh, Yufan Zhuang +3Diffusion Language ModelsMasked Diffusion Language Models

  2. Sparse Readout Prism: Explaining Logit-Lens Scores in Features Instead of Tokens

    Sep 1, 2026Matteo He, William F. Shen, Xinchi Qiu +1ReadoutLogit Lens

  3. Beyond Token Positions: Safety Alignment Across Denoising Steps in Diffusion Language Models

    Aug 31, 2026Guoli Wang, Haonan Shi, Tu Ouyang +1Diffusion Language ModelsLarge Language Model Safety

  4. DBLAST: Dependent Block Drafting for Stochastic Speculative Decoding

    Aug 5, 2026Amirmohammad Karimi, Chao Gao, Negar HassanpourSpeculative DecodingBlock-Diffusion Drafter

  5. Hi-Token: Hierarchical Coordinate Tokenization for Generative Visual Grounding

    Aug 4, 2026Xiuyuan Zhu, Ke Lu, Kun Dong +6Long Visual-Token SequencesRecent Vision-Language Models

  6. DIRECT: Direct Decoding for Efficient and Aligned Sequence Labeling with Large Language Models

    Jul 29, 2026Yilei Wang, Jiaxin Gan, Kexuan Zhang +3Sequence ModelingObject Tokens

  7. Text Template Tokens Are Implicit Semantic Registers in Diffusion Transformers

    Jul 21, 2026Maohua Li, Qirui Li, Yanke Zhou +10Diffusion TransformersText-To-Image Diffusion Models

  8. Enhancing Numerical Prediction in LLMs via Smooth MMD Alignment

    Jun 26, 2026Zhuo Zuo, Li Yue, Wenhao Zheng +2Maximum Mean DiscrepancyLatent Representation Alignment

  9. Object Tokens as a Bridge Between Segmentation and Visual Question Answering in Robotic Surgery

    Jun 14, 2026Yiping Li, Ronald de Jong, Romy van Jaarsveld +5Surgical VideosRecent Vision-Language Models

  10. Characterizing Cultural Localization in AI-Generated Stories

    Jun 12, 2026Shaily Bhatt, Supriti Vijay, Jeremiah Milbauer +1Narrative GenerationNarratives

  11. Visual-Advantage On-Policy Distillation for Vision-Language Models

    May 21, 2026Ruiqi Liu, Xiaolei Lv, Gengsheng Li +8Recent Vision-Language ModelsObject Tokens

  12. Structured Layout Priors for Robust Out-of-Distribution Visual Document Understanding

    May 19, 2026Peter El Hachem, Ahmed Nassar, A. Said Gurbuz +2Visual Document RetrievalDocument Parsing

  13. Spark3R: Asymmetric Token Reduction Makes Fast Feed-Forward 3D Reconstruction

    May 7, 2026Zecheng Tang, Jiaye Fu, Qiankun Gao +5Feed-Forward 3D Reconstruction3D Reconstruction

  14. (1D) Ordered Tokens Enable Efficient Test-Time Search

    Apr 16, 2026Zhitong Gao, Parham Rezaei, Ali Cy +7Autoregressive Image GenerationAutoregressive Generation

  15. TokenLight: Precise Lighting Control in Images using Attribute Tokens

    Apr 16, 2026Sumit Chaturvedi, Yannick Hold-Geoffroy, Mengwei Ren +5Image RelightingLighting

  16. Poly-attention: a general scheme for higher-order self-attention

    Feb 2, 2026Sayak Chakrabarti, Toniann Pitassi, Josh AlmanLinear AttentionTransformer Architectures

  17. Fine PT-PT Web: A High-Quality 41 Billion Tokens Data Collection of the European Portuguese Web

    Date pendingGonçalo Vinagre, Rui Pedro Guerra, Pedro Gomes +7Text CorporaPortuguese