Text Embedding Evaluation

Momentum

3 papers in the last four weeks, down 25% on the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 60

All topics
CardsList
  1. Your Prompt Should Do More: Effects of Retrieval Instructions in Embedding Models

    Oct 7, 2026Amanda Myntti, Jenna Kanerva, Veronika Laippala +1Text Embedding ModelsInformation Retrieval

  2. Embedding Models Measure in Peculiar Ways

    Sep 17, 2026Juri Opitz, Andrianos MichailText EmbeddingsText Embedding Evaluation

  3. Do General NLP Embeddings Capture Ontological Reasoning?

    Aug 31, 2026Hamed Babaei Giglou, Jennifer D'Souza, Sören AuerLogical ReasoningText Embedding Evaluation

  4. The Embedder's Dilemma: LLMs Are Better, but at What Cost?

    Aug 13, 2026Adnan El Assadi, Niklas Muennighoff, Jinhyuk LeeLLM Inference EfficiencyLLM Evaluation

  5. Calibrating WEAT Against Anisotropy: ZCA Whitening as a Geometric Pre-Processing Step for Embedding Association Tests

    Aug 7, 2026Seitaro Ono, Senna Ross, Jun SaikiNeural Representation GeometryText Embedding Evaluation

  6. How Far Do Simple Transformations Translate Across Text Embedding Models?

    Aug 6, 2026Sid Ali Hamideche, Louis-Adrien Dufrène, Quentin Lampin +1Representation LearningText Embedding Evaluation

  7. Mapping Similarity Spaces across Embedding Models with Synthetic Query Probing

    Aug 6, 2026Marcin Rozmus, Peter van der PuttenText Embedding EvaluationText Embedding Models

  8. A Comparative Evaluation of Embeddings and LLMs in a Greek Book Publisher Setting - The CUP Dataset

    Jul 23, 2026Katerina Papantoniou, Panagiotis Papadakos, Theodore Patkos +3Text Embedding EvaluationMultilingual IR

  9. Multilingual Sentence Embeddings for Linguistic-Integrated Reliability Audit

    Jul 20, 2026Ummugul Bezirhan, Ji Yoon Jung, Matthias von DavierSentence EmbeddingsEducational Assessment

  10. MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese

    Jul 6, 2026Tardelli Ronan Coelho StekelText Embedding EvaluationText Embedding Models

  11. Beyond Multilingual Averages: MTEB-PT, a Benchmark for Portuguese Sentence Encoders

    Jul 5, 2026Lucas Hideki Takeuchi Okamura, Alexandre Alcoforado, Anna Helena Reali CostaSentence EmbeddingsText Embedding Evaluation

  12. ALEE: Any-Language Evaluation of Embeddings via English-Centric Minimal Pairs

    Jun 30, 2026Andrianos Michail, Stylianos Psychias, Michelle Wastl +3Text Embedding EvaluationLow-Resource Language Processing

  13. STEB: Style Text Embedding Benchmark

    Jun 30, 2026Rafael Rivera Soto, Anna Wegmann, Cristina AggazzottiText EmbeddingsText Embedding Evaluation

  14. SABER-Math: Automated Benchmark for Information Retrieval Evaluation in Mathematics

    Jun 29, 2026Nikolay Georgiev, Maria Drencheva, Kseniia Ibragimova +3Text Embedding EvaluationLLM Reranking

  15. A Comparative Study on Affective Cues in Text Embeddings Across Psychological Emotion Theories

    Jun 27, 2026Fabio Ciani, Harald Schweiger, Emilia Parada-Cabaleiro +1Text EmbeddingsText Embedding Evaluation

  16. Does My Embedding Reflect That A=BA = B? Evaluating Mathematical Equivalence in Embedding Models

    Jun 22, 2026Jiaying Ye, Samarth Rao, Leo Carlin +9Contrastive LearningText Embedding Evaluation

  17. Do LLM Embedding Spaces Recover Expert Structure?

    Jun 22, 2026Yixuan Zhu, Zhenke Duan, Fanghen LiLLM Fine-TuningMental Health

  18. Evaluating Document-Tuned Transformer Representations for Person-level Mental Health Assessment

    Jun 19, 2026Aaron Marker, Oscar Kjell, Vasudha Varadarajan +1Sentence EmbeddingsMental Health

  19. Examining the Limits of Word2Vec with Toki Pona

    Jun 15, 2026Daniel Zhenhan Huang, Hongchen WuText Embedding EvaluationDistributional Semantics

  20. SkMTEB: Slovak Massive Text Embedding Benchmark and Model Adaptation

    Jun 11, 2026Marek Šuppa, Andrej Ridzik, Daniel Hládek +2Text EmbeddingsWord Embeddings

  21. Modeling semantic association in self-paced reading with language model embeddings

    Jun 5, 2026Sara Møller Østergaard, Kenneth Enevoldsen, Afra Alishahi +1Sentence EmbeddingsText Embedding Evaluation

  22. Principles of Concept Representation in Sentence Encoders

    Jun 5, 2026Isabelle Mohr, John Dujany, Jonathan Souquet +1Sentence EmbeddingsCompositional Reasoning

  23. SEA-LION-Embedding: Open and Reproducible Text Embeddings for Southeast Asia

    Jun 2, 2026Peerat Limkonchotiwat, Raymond Ng, Sarana Nutanong +1Text EmbeddingsText Embedding Evaluation

  24. On the Robustness of Multilingual Text Embedding Rankings Across Learning Tasks, Languages, and Benchmark Datasets

    May 29, 2026Ana Gjorgjevikj, Barbara Koroušić Seljak, Tome EftimovMultilingual Language Model EvaluationText Embedding Evaluation

  25. The Harder Text Embedding Benchmark (HTEB): Beyond One-dimensional Static Robustness

    May 27, 2026Manuel Frank, Haithem AfliText EmbeddingsText Embedding Evaluation

  26. Grounding Text Embeddings in Stakeholder Associations

    May 26, 2026Jonathan Rystrøm, Sofie Burgos-Thorsen, Zihao Fu +3Text Embedding EvaluationHuman-in-the-Loop Evaluation

  27. Benchmarking Patent Embeddings: A Multi-Task Evaluation of 22 Models Across Retrieval, Classification, and Clustering

    May 22, 2026Amirhossein Yousefiramandi, Ciaran CooneyLegal IRClustering

  28. Benchmarking Google Embeddings 2 against Open-Source Models for Multilingual Dense Retrieval and RAG Systems

    May 22, 2026Stefano Cirillo, Domenico Desiato, Giuseppe Polese +1Retrieval-Augmented GenerationText Embedding Evaluation

  29. IdioLink: Retrieving Meaning Beyond Words Across Idiomatic and Literal Expressions

    May 21, 2026Kai Golan Hashiloni, Daniel Fadlon, Lior Livyatan +3Figurative Language UnderstandingSemantic Search

  30. Structure Retention in Embedding Spaces as a Predictor of Benchmark Performance

    May 21, 2026Amanda Myntti, Jenna Kanerva, Veronika Laippala +1Text Embedding EvaluationText Embedding Models

  31. To MRL or not to MRL: Text Embeddings are Robust to Truncation Without Matryoshka Learning, Except In Heavy Truncation Scenarios

    May 15, 2026Sotaro Takeshita, Yurina Takeshita, Simone Paolo Ponzetto +1Text EmbeddingsRepresentation Learning

  32. The Proxy Presumption: From Semantic Embeddings to Valid Social Measures

    May 8, 2026Baishi Li, Ta Yu, Kelvin J. L. Koa +1Text EmbeddingsText Embedding Evaluation

  33. Is Textual Similarity Invariant under Machine Translation? Evidence Based on the Political Manifesto Corpus

    May 1, 2026Daria Boratyn, Damian Brzyski, Albert Leśniak +5Semantic Textual SimilarityText Embedding Evaluation

  34. Why Mean Pooling Works: Quantifying Second-Order Collapse in Text Embeddings

    Apr 30, 2026Tomomasa Hara, Hiroto Kurita, Masaaki Imaizumi +2Text EmbeddingsText Embedding Evaluation

  35. SemEval-2026 Task 4: Narrative Story Similarity and Narrative Representation Learning

    Apr 23, 2026Hans Ole Hatzel, Ekaterina Artemova, Haimo Paul Stiemer +2Semantic Textual SimilarityRepresentation Learning

  36. Finding Meaning in Embeddings: Concept Separation Curves

    Apr 23, 2026Paul Keuren, Marc Ponsen, Robert Ayoub BagheriSentence EmbeddingsText Embedding Evaluation

  37. TeleEmbedBench: A Multi-Corpus Embedding Benchmark for RAG in Telecommunications

    Apr 20, 2026Pranshav Gajjar, Vijay K ShahText Embedding EvaluationText Embedding Models

  38. FLARE: Task-agnostic embedding model evaluation through a normalization process

    Apr 19, 2026Jingzhou Jiang, Yixuan Tang, Yi Yang +1Text Embedding EvaluationText Embedding Models

  39. JFinTEB: Japanese Financial Text Embedding Benchmark

    Apr 17, 2026Masahiro Suzuki, Hiroki SakajiText Embedding EvaluationText Embedding Models

  40. Comparison of Modern Multilingual Text Embedding Techniques for Hate Speech Detection Task

    Apr 16, 2026Evaldas Vaiciukynas, Paulius Danenas, Linas Ablonskis +5Sentence EmbeddingsText Embedding Evaluation

  41. LMEB: Long-horizon Memory Embedding Benchmark

    Mar 13, 2026Xinping Zhao, Xinshuo Hu, Jiaxin Xu +9Text Embedding EvaluationIR Evaluation

  42. GRAN-TED: Generating Robust, Aligned, and Nuanced Text Embedding for Diffusion Models

    Dec 17, 2025Bozhou Li, Sihan Yang, Yushuo Guan +6Text Embedding EvaluationT2I Generation

  43. A Framework for Deductive Semantic Content Analysis at Scale in Science Education Using Text Embeddings

    Aug 27, 2025Jonas Timmann Mjaaland, Markus Fleten Kreutzer, Halvor Tyseng +5Educational TechnologyText Embedding Evaluation

  44. ChEmbed: Enhancing Chemical Literature Search Through Domain-Specific Text Embeddings

    Aug 3, 2025Ali Shiraee Kasmaee, Mohammad Khodadad, Mahdi Astaraki +4Text Embedding EvaluationInformation Retrieval

  45. Chunk Twice, Embed Once: A Systematic Study of Segmentation and Representation Trade-offs in Chemistry-Aware Retrieval-Augmented Generation

    Jun 13, 2025Mahmoud Amiri, Thomas BocklitzDocument ChunkingText Embedding Evaluation