Text Embedding Models

Momentum

6 papers in the last four weeks, level with the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 81

All topics
CardsList
  1. Non-negative Elastic Net Decoding for Information Retrieval

    Jun 16, 2026Koki Okajima, Yasutoshi Ida, Tsukasa Yoshida +1Representation LearningInformation Retrieval

  2. Examining the Limits of Word2Vec with Toki Pona

    Jun 15, 2026Daniel Zhenhan Huang, Hongchen WuText Embedding EvaluationDistributional Semantics

  3. SkMTEB: Slovak Massive Text Embedding Benchmark and Model Adaptation

    Jun 11, 2026Marek Šuppa, Andrej Ridzik, Daniel Hládek +2Text EmbeddingsWord Embeddings

  4. Your UnEmbedding Matrix is Secretly a Feature Lens for Text Embeddings

    Jun 5, 2026Songhao Wu, Zhongxin Chen, Yuxuan Liu +3Text EmbeddingsText Embedding Models

  5. Geometry of Semantic Space: Comparative Study of Discrete and Continuous Models

    Jun 5, 2026Gabriel Bounias, Sabine PlouxNeural Representation GeometryGraph Embedding

  6. ReverseEOL: Improving Training-free Text Embeddings via Text Reversal in Decoder-only LLMs

    Jun 4, 2026Ailiang Lin, Zhuoyun Li, Yusong Wang +3Text EmbeddingsDecoder-Only Language Models

  7. SEA-LION-Embedding: Open and Reproducible Text Embeddings for Southeast Asia

    Jun 2, 2026Peerat Limkonchotiwat, Raymond Ng, Sarana Nutanong +1Text EmbeddingsText Embedding Evaluation

  8. Adapting Multilingual Embedding Models to Turkish via Cross-Lingual Tokenizer Surgery and Offline Distillation

    May 28, 2026M. Ali Bayram, Banu Diri, Savaş YıldırımMultilingual Language ModelsSentence Embeddings

  9. Xetrieval: Mechanistically Explaining Dense Retrieval

    May 28, 2026Zhixin Cai, Jun Bai, Yang Liu +7Text Embedding ModelsDense Retrieval

  10. The Harder Text Embedding Benchmark (HTEB): Beyond One-dimensional Static Robustness

    May 27, 2026Manuel Frank, Haithem AfliText EmbeddingsText Embedding Evaluation

  11. PromptEmbedder: Efficient and Transferable Text Embedding via Dual-LLM Soft Prompting

    May 27, 2026Yu-Che Tsai, Kuan-Yu Chen, Yuan-Hao Chen +4Text EmbeddingsPrompt Tuning

  12. Hubness, Not Anisotropy, Drives Cross-Lingual Retrieval Asymmetry in Multilingual Embedding Models

    May 26, 2026Adib Sakhawat, Fardeen Sadab, Atik ShahriarMultilingual IRText Embedding Models

  13. Benchmarking Google Embeddings 2 against Open-Source Models for Multilingual Dense Retrieval and RAG Systems

    May 22, 2026Stefano Cirillo, Domenico Desiato, Giuseppe Polese +1Retrieval-Augmented GenerationText Embedding Evaluation

  14. Evaluation of Chunking Strategies for Effective Text Embedding in Low-Resource Language on Agricultural Documents

    May 21, 2026Sovandara Chhoun, Pichdara Po, Sereiwathna Ros +2Document ChunkingMultilingual IR

  15. Structure Retention in Embedding Spaces as a Predictor of Benchmark Performance

    May 21, 2026Amanda Myntti, Jenna Kanerva, Veronika Laippala +1Text Embedding EvaluationText Embedding Models

  16. m3BERT: A Modern, Multi-lingual, Matryoshka Bidirectional Encoder

    May 19, 2026Yaoxiang Wang, Simiao Zuo, Qingguo Hu +4Language Model PretrainingRepresentation Learning

  17. To MRL or not to MRL: Text Embeddings are Robust to Truncation Without Matryoshka Learning, Except In Heavy Truncation Scenarios

    May 15, 2026Sotaro Takeshita, Yurina Takeshita, Simone Paolo Ponzetto +1Text EmbeddingsRepresentation Learning

  18. Layer-wise Representation Dynamics: An Empirical Investigation Across Embedders and Base LLMs

    May 12, 2026Jingzhou Jiang, Yi Yang, Kar Yan TamText EmbeddingsLLM Pruning

  19. GRC: Unifying Reasoning-Driven Generation, Retrieval and Compression

    May 9, 2026Zhongtao Miao, Qiyu Wu, Yoshimasa TsuruokaRetrieval-Augmented GenerationMemory-Augmented Language Models

  20. Embeddings for Preferences, Not Semantics

    May 8, 2026Carter Blair, Ariel D. Procaccia, Milind TambeText EmbeddingsWord Embeddings