Token Embeddings

Momentum

9 papers in the last four weeks, up 50% on the four weeks before. 0.1% of all new papers.

Jul 6Week of Sep 21

Latest papers 57

All topics
CardsList
  1. Selecting What Matters: Semantic Compression-Guided Selective Pooling for Long-Context Embeddings

    Sep 29, 2026Zifeng Cheng, Jie Zheng, Zhiwei Jiang +4Efficient Long-Context InferenceToken Embeddings

  2. CacheRepair: Learning to Repair Cross-Chunk Context in RAG for KV Cache Fusion

    Sep 28, 2026Genglin Wang, Wangsong Yin, Yeerzhati Abudunuer +3Key-Value CacheCross-Attention

  3. Instance-Adaptive Prompts as Context for Time-Series Foundation Models

    Sep 28, 2026Zehao Xiao, Shifeng Xie, Lei Zan +5Time Series Foundation ModelsWireless Foundation Models

  4. Distilling Sequential Computation in Transformer Language Models

    Sep 23, 2026Zixuan Lan, Jessica Yang, Yanhong Li +2Transformer ArchitecturesToken Embeddings

  5. Beyond Truncation: Rethinking LLM Decoding as Ensemble Pruning

    Sep 16, 2026Dunyao Xue, Chengshuo Du, Zhengbo Wang +2Large Language Model DecodingDecoding

  6. CoGe-GCD: Reframing Generalized Category Discovery with Compositional Generalization

    Sep 9, 2026Luyao Tang, Jiewei Zheng, Kunze Huang +3Generalized Category DiscoveryCompositional Generalization

  7. uFlowCSP: Crystal Structure Prediction using Mean flow generative models

    Sep 9, 2026Sourin Dey, Dipannoy Das Gupta, Lai Wei +2Crystal Structure PredictionCrystal Structure

  8. Vectorizer: Vectorizing NumPy Programs with Shape-Guided Rewrite

    Sep 8, 2026Jingqian Liu, Xiaoyu Liu, Yuepeng WangVectorizationPython

  9. Position Matters: Feature Inversion Attacks in ViT Split Inference with Token Reduction and Shuffling

    Sep 1, 2026Stefano Leggio, Giulio Rossolini, Alessandro BiondiVision TransformerToken Embeddings

  10. Context Staircase: Signature-Aligned Dynamics of Token Embeddings under Small Initialization

    Aug 31, 2026Junjie Yao, Liangkai Hang, Zhi-Qin John XuToken EmbeddingsDistributional Signatures

  11. Learning Representations through Token Prediction: Geometry, Approximation, and Downstream Guarantees

    Aug 30, 2026Shulei WangNext-Token PredictionToken Embeddings

  12. Beyond Sequence Order: Syntax-Informed Positional Embeddings for Transformers

    Aug 6, 2026Haris Riaz, Hyungji Kim, Mihai SurdeanuToken EmbeddingsTransformer Architectures

  13. Interpretable GOHR Agents via Sparse Autoencoders

    Jul 27, 2026Shiwei Tan, Yusong Zhao, Weiyi Qin +6Autonomous AgentsHidden States

  14. Latent-LoRA: Compact Latent-Space Adapters with Gradient-Free Routing for Continual Learning

    Jul 26, 2026Reza Rahimi Azghan, Gautham Krishna Gudur, Giulia Pedrielli +2Replay-Based Continual LearningCatastrophic Forgetting

  15. Progressive Cramming: Reliable Token Compression and What It Reveals

    Jul 23, 2026Dmitrii Tarasov, Timofei Lashukov, Elizaveta Goncharova +1Token CompressionData Compression Methods

  16. Do Speech Tokens Leak Voiceprints? Speaker Inversion Attacks Against End-to-End Speech Language Models

    Jul 18, 2026Ye Lu, Yihan Yan, Zhaoyang Zhang +4Speech EncoderToken Embeddings

  17. Sticky Jump Diffusions: A Unifying View of Masked, Continuous, and Hybrid Diffusion

    Jul 12, 2026Pascal Jutras-Dubé, Patrick Pynadath, Jeremy Lu +2Diffusion DynamicsStochastic Differential Equations

  18. VectorizationLLM: Smart Vectorization Based AI Assistant

    Jul 8, 2026Ryan DukeMath ProblemsTutors

  19. Riemannian Geometry for Pre-trained Language Model Embeddings

    Jul 8, 2026Szczepan Konior, Alexandre Quemy, Przemysław Klocek +2Token EmbeddingsText Embeddings

  20. Full Glyph Images Beat Token Embeddings: A Controlled Study for Transformers

    Jul 4, 2026Shuyang Xiang, Hao GuanToken EmbeddingsTransformer Architectures

  21. Robust Text Watermarking for Large Language Models via Dual Semantic Embeddings

    Jun 30, 2026Jonas Schäfer, Cezary Pilaszewicz, Gerhard WunderLarge Language Model WatermarksWatermarks

  22. VASAE: Naming SAE Dictionary Directions with Vocabulary-Aligned Anchoring

    Jun 26, 2026Kairui Zhang, Ziwen Yu, Zahraa S. Abdallah +1Sparse Autoencoder FeaturesImproving Sparse Autoencoders

  23. Token-to-Token Alignment of Text Embeddings for Semantic Blending

    Jun 22, 2026Saar Huberman, Ron Mokady, Or Patashnik +1Image-Text AlignmentText-To-Image

  24. STORM: Stepwise Token Optimization with Reward-Guided Beam Search

    Jun 9, 2026Arthur Satouf, Giulio D'Erasmo, Yuxuan Zong +3Retrieval LayerRetrievers

  25. Is Text All You Need? Text as a Universal Information Bottleneck for Speech LLMs

    Jun 8, 2026Ming-Hao Hsu, Yuxuan Hu, Shujie Liu +3Speech Language ModelsToken Embeddings

  26. Tensorizing Engram: Sharing Latents Across N-Gram Embeddings is Beneficial in LLMs

    Jun 6, 2026Wuyang Zhou, Yuxuan Gu, Giorgos Iacovides +3Unigram TokenizerToken Embeddings

  27. Generative Criticality in Large Language Model Temperature Scaling

    Jun 4, 2026Huajian Ruan, Jinyang Li, Xingyu Guo +1Autoregressive GenerationToken Embeddings

  28. ColBERTSaR: Sparsified ColBERT Index via Product Quantization

    Jun 4, 2026Eugene Yang, Andrew Yates, Dawn Lawrie +3Retrieval LayerToken Embeddings

  29. Don't Forget Your Embeddings: Robust Knowledge Erasure via Precise Editing of Embeddings

    Jun 2, 2026Clara Haya Suslik, Or Shafran, Mor GevaConcept ErasureLarge Language Model Unlearning

  30. LLMs Need Encoders for Semantic IDs Too

    May 29, 2026Xiangyi Chen, Zelun Wang, Xinyi Li +3Multimodal Large Language ModelsToken Embeddings

  31. Instruction Lens Score: Your Instruction Contributes a Powerful Object Hallucination Detector for Multimodal Large Language Models

    May 12, 2026Runhe Lai, Xinhua Lu, Yanqi Wu +3Citation Hallucination DetectionObject Hallucination

  32. Conditional Memory Enhanced Item Representation for Generative Recommendation

    May 12, 2026Ziwei Liu, Yejing Wang, Shengyu Zhou +2Autoregressive GenerationToken Embeddings

  33. SimReg: Achieving Higher Performance in the Pretraining via Embedding Similarity Regularization

    May 9, 2026Yan Sun, Guoxia Wang, Jinle Zeng +6Large Language Model PretrainingPretraining

  34. Federation of Experts: Communication Efficient Distributed Inference for Large Language Models

    May 7, 2026Muhammad Shahir Abdurrahman, Chun Deng, Azalia Mirhoseini +1Transformer ArchitecturesToken Embeddings

  35. MSD-Score: Multi-Scale Distributional Scoring for Reference-Free Image Caption Evaluation

    May 7, 2026Shichao Kan, Xuyang Zhang, Haojie Zhang +7Image Difference CaptioningSimilarity and Metrics

  36. Lost in State Space: Probing Frozen Mamba Representations

    Apr 30, 2026Bhagyashree Wagh, Akash SinghToken EmbeddingsRecurrent State

  37. Why Mean Pooling Works: Quantifying Second-Order Collapse in Text Embeddings

    Apr 30, 2026Tomomasa Hara, Hiroto Kurita, Masaaki Imaizumi +2Token EmbeddingsText Embeddings

  38. Towards Intelligent Legal Document Analysis: CNN-Driven Classification of Case Law Texts

    Apr 20, 2026Moinul Hossain, Sourav Rabi Das, Zikrul Shariar Ayon +4Large Language Model ClassificationTerm Frequency-Inverse Document Frequency

  39. DuConTE: Dual-Granularity Text Encoder with Topology-Constrained Attention for Text-attributed Graphs

    Apr 19, 2026Lexuan Liang, Tao Zou, Xuxiang Ta +1Text-Attributed GraphGraph Neural Networks

  40. A framework for auditing grounding claims

    Dec 5, 2025Daniel Quigley, Eric MaynardContextual GroundingModel Auditing