Low-Resource Language Processing

Latest papers 342

All topics
CardsList
  1. Can Large Language Models Handle Discourse Particles? A Case Study of Colloquial Malay

    May 27, 2026Mariah Al Giptiah Binte Yusoff, Jakin Tan, Bocheng Chen +2Multilingual Language Model EvaluationPragmatic Reasoning in Language Models

  2. Towards Reliable Multilingual LLMs-as-a-Judge: An Empirical Study

    May 27, 2026Irune Zubiaga, Aitor Soroa, Rodrigo AgerriMultilingual Language Model EvaluationLLM-as-a-Judge

  3. Enhancing BiGRU with a KAN Block for Legal Document Classification and Summarization

    May 27, 2026Ahmed Faizul Haque Dhrubo, Souvik Pramanik, Most. Aysha Siddika Sumona +4Recurrent Neural NetworksText Summarization

  4. Building Community-Centred NLP Resources for Puno Quechua

    May 27, 2026Elwin Huaman, Adrian Gamarra Lafuente, Johanna Cordova +1Automatic Speech RecognitionLow-Resource Language Processing

  5. Temporal Simultaneity Predicts Annotation Quality in Sentiment Corpora

    May 26, 2026Idris Abdulmumin, Mokgadi Penelope Matloga, Tadesse Destaw Belay +5Annotator DisagreementSentiment Analysis

  6. Formalization of Malagasy conjugation

    May 26, 2026Joro Ny Aina Ranaivoarison, Eric Laporte, Baholisoa Simone RalalaoherivonyLow-Resource Language Processing

  7. AlbanianLLMSafety: A Safety Evaluation Dataset for Large Language Models in Albanian

    May 26, 2026Wajdi Zaghouani, Kholoud K. Aldous, Isra FejzullajLLM Safety BenchmarksLanguage Model Safety Evaluation

  8. DunbaaBERT: From Sacrifice to Semantics

    May 26, 2026Iffat Maab, Waleed Jamil, Raphael SchmittLanguage Model PretrainingLanguage Modeling

  9. Telenor Nordics Customer Service self-help corpus

    May 26, 2026Mike RiessLow-Resource Language Processing

  10. FTibSuite: A Comprehensive Resource Suite for Tibetan Vision-Language Modeling

    May 26, 2026Guixian Xu, Yide Liang, Zeli Su +5VLM EvaluationVision-Language Models

  11. Forgotten Words: Benchmarking NeoBERT for Dementia Detection in Low-Resource Conversational Filipino and English Speech

    May 25, 2026Rez Samantha Z. Floresca, Edric Castel C. Hao, Hannah Grachiella Buñales +3Multilingual Language Model EvaluationSpeech-Based Dementia Detection

  12. The Multilingual Curse at the Retrieval Layer: Evidence from Amharic

    May 23, 2026Yosef Worku Alemneh, Kidist Amde Mekonnen, Maarten de RijkeMultilingual IRLow-Resource Language Processing

  13. Convex Low-resource Accent-Robust Language Detection in Speech Recognition

    May 22, 2026Miria Feng, William Tan, Mert PilanciDistribution Shift RobustnessSpeech Processing

  14. Evaluation of Chunking Strategies for Effective Text Embedding in Low-Resource Language on Agricultural Documents

    May 21, 2026Sovandara Chhoun, Pichdara Po, Sereiwathna Ros +2Document ChunkingMultilingual IR

  15. Do LLMs Know What Luxembourgish Borrows? Probing Lexical Neology in Low-Resource Multilingual Models

    May 20, 2026Nina Hosseini-KivananiMultilingual Language Model EvaluationKnowledge Augmentation for Language Models

  16. Building Arabic NLP from the Ground Up: Twenty Years of Lessons, Failures, and Open Problems

    May 20, 2026Wajdi ZaghouaniArabic NLPLow-Resource Language Processing

  17. LLM-Based Financial Sentiment Analysis in Arabic: Evidence from Saudi Markets

    May 19, 2026Mona H. Albaqawi, Eman M. Albalkhi, Joud A. Albaiti +1Financial Sentiment AnalysisLow-Resource Language Processing

  18. The Annotation Scarcity Paradox in Low-Resource NLP Evaluation: A Decade of Acceleration and Emerging Constraints

    May 18, 2026Vukosi MarivateLow-Resource Language Processing

  19. Mixture of Experts for Low-Resource LLMs

    May 17, 2026Ori Bar Joseph, Smadar Arvatz, Noam Kayzer +2Mixture-of-Experts Language ModelsExpert Routing