Compact Latent Sensor Tokens

Momentum

7 papers in the last four weeks, up 75% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 38

All topics
CardsList
  1. LightMTP: Lightweight Latent Multi-Token Prediction

    Oct 5, 2026Tamara Czinczoll, Julie Kallini, Gerard de Melo +1Multi-Token PredictionCompact Latent Sensor Tokens

  2. MoLE: Mixture of Latent Experts for Complementary Visual Reasoning

    Oct 1, 2026Yingcheng Liu, Tianyi Jiang, Yujuan Ding +5Latent Visual ReasoningVisual Reasoning

  3. Sparse-WAM: Accelerating World Action Models via Action-Guided Sparse Imagination

    Sep 30, 2026Xinling Xie, Haodong Wang, Jiazhi Mi +8Faster-WamWorld Models

  4. Matisse: Evidence-Space Reasoning for Active 3D Reconstruction

    Sep 30, 2026Xihang Yu, Kaichen Zhou, Lorenzo Shaikewitz +43D ReconstructionKeyframe Selection

  5. Late Attention Layers Alone Can Copy Entity Tokens, but Not Without Attending to Their Context

    Sep 28, 2026Muyu He, Yuchen Liu, Ran Tao +1Compact Latent Sensor TokensLinear Attention

  6. Token-Disentangled Latent Test-Time Scaling for Vision-Language Reasoning

    Sep 28, 2026Hao-Xuan Ma, Yihao Liu, Yutao Sun +8Compact Latent Sensor TokensMultimodal Large Language Models

  7. Rethinking Latent Visual Reasoning: Grounding Latent Reasoning in Visual Evidence

    Sep 28, 2026Xi Xiao, Tianchen Zhao, Youngeun Kim +10Latent Visual ReasoningVisual Reasoning

  8. A*-Thought-V2: Efficient Latent Reasoning via Geometric Dynamics of LLM

    Sep 7, 2026Xiaoang Xu, Siyuan Liu, Shuo Wang +13Efficient Latent ReasoningChain-of-Thought Reasoning

  9. LatentPress: Context Compression Beyond Text and Vision

    Sep 1, 2026Zhengze Zhou, Hejian SangEfficient Long-Context InferenceLarge Language Model Compression

  10. Verbalizing Multi-Token Concepts in LLMs

    Aug 31, 2026Xijie Gong, Zimeng Huang, Tonghan WangCompact Latent Sensor TokensHidden States

  11. Diffusion Image Editing via Asynchronous Token Decoding

    Aug 10, 2026Yang Shi, Liangsi Lu, Minzhe Guo +4Diffusion-Based Image EditingText-To-Image Diffusion Models

  12. LoopMTP: A looped transformer guided by latent multi-token prediction

    Aug 4, 2026Behzad Shomali, Markus Frey, David Berghaus +2Multi-Token PredictionTransformer Architectures

  13. Agentic Graph Token Reasoning

    Aug 1, 2026Zhuoyi Peng, Yi YangCompact Latent Sensor TokensAgentic Reasoning

  14. Meshy T2: Fast Native Mesh Generation with Flow Matching

    Jul 28, 2026Jiale Xu, Rendong Liang, Yuhao Long +5Mesh GenerationMeshes

  15. Token-Wise Latent Streaming from Slow Reasoners to Fast Planners for Dynamic Vision Language Navigation

    Jul 18, 2026Tianshuai Hu, Yangyi Zhong, Zeying Gong +7Vision-Language NavigationCompact Latent Sensor Tokens

  16. STELLA: Efficient Sensor-to-LLM Translation for On-Device Human Activity Recognition

    Jul 3, 2026Nirhoshan Sivaroopan, Albert Zomaya, Kanchana ThilakarathnaHuman Activity RecognitionCompact Latent Sensor Tokens

  17. Latent Bridges for Multi-Table Question Answering

    Jun 27, 2026Simone Varriale, Tamara Cucumides, Floris Geerts +1QuestionCompact Latent Sensor Tokens

  18. TaskTok: Delving into Task Tokens for Task-driven Image Restoration

    Jun 25, 2026Hongjae Lee, Sojung Kang, Jaeseong Yu +1Image RestorationVisual Tokenizers

  19. Latent Visual States for Efficient Multimodal Reasoning

    Jun 23, 2026Xiuwei Chen, Wentao Hu, Yongxin Wang +8Latent Visual ReasoningLarge Multimodal Models

  20. Beyond Visual Memory: Mechanistic Diagnostics of Latent Visual Reasoning

    May 31, 2026Garvin Guo, Yu Chen, Xiang Wang +4Latent Visual ReasoningCompact Latent Sensor Tokens

  21. Learning Global Motion with Compact Gaussians for Feed-Forward 4D Reconstruction

    May 29, 2026Mungyeom Kim, Minkyeong Jeon, Honggyu An +104D ReconstructionFeed-Forward 3D Gaussian

  22. NITP: Next Implicit Token Prediction for LLM Pre-training

    May 24, 2026Xiangdong Zhang, Debing Zhang, Shaofeng Zhang +3Next-Token PredictionToken-Level Supervision

  23. JFAA: Technical Report for the EPIC-KITCHENS-100 Action Anticipation Challenge at EgoVis 2026

    May 20, 2026Qiaohui Chu, Haoyu Zhang, Yisen Feng +4Action PredictionVideo Joint Embedding Predictive Architecture

  24. What's Holding Back Latent Visual Reasoning?

    May 18, 2026André G. Viveiros, Nuno Gonçalves, André F. T. Martins +1Latent Visual ReasoningCompact Latent Sensor Tokens

  25. Elastic-dLLM: Position Preserving Context Compression and Augmentation of Diffusion LLMs

    May 18, 2026Junyi Wu, Tianchen Zhao, Shaoqiu Zhang +3Diffusion Language ModelsLarge Language Model Decoding

  26. Exploring Vision-Language Models for Online Signature Verification: A Zero-Shot Capability Study

    May 14, 2026Marta Robledo-Moreno, Ruben Vera-Rodriguez, Ruben Tolosana +1Online Signature VerificationRecent Vision-Language Models

  27. Continuous Latent Contexts Enable Efficient Online Learning in Transformers

    May 11, 2026Emile Anand, Abdullah Ateyeh, Xinyuan Cao +1In-Context LearningTransformer Architectures

  28. Beyond Position Bias: Shifting Context Compression from Position-Driven to Semantic-Driven

    May 10, 2026Jiwei Tang, Zhijing Huang, Xinyu Zhang +5Efficient Long-Context InferenceCompact Latent Sensor Tokens

  29. Imagination Helps Visual Reasoning, But Not Yet in Latent Space

    Feb 26, 2026You Li, Chi Chen, Yanghao Li +4Latent Visual ReasoningVisual Reasoning

  30. Wavelet Policy: Imitation Learning in the Scale Domain with World Prior Memory

    Apr 7, 2025Changchuan Yang, Haoxuan Xu, Yuhang Dong +3Imitation LearningEfficient World-Action Model