Low-Resource Language Processing

Latest papers 342

All topics
CardsList
  1. Benchmarking Parameter-Efficient Fine-Tuning of Large Language Models for Low-Resource Tajik Text Generation with the Tajik Web Corpus

    May 5, 2026Mullosharaf K. ArabovLLM Fine-TuningLow-Resource Language Processing

  2. SemEval-2026 Task 7: Everyday Knowledge Across Diverse Languages and Cultures

    May 4, 2026Nedjma Ousidhoum, Junho Myung, Carla Perez-Almendros +27Multilingual Language Model EvaluationLLM Evaluation

  3. Tibetan-TTS:Low-Resource Tibetan Speech Synthesis with Large Model Adaptation

    May 4, 2026Jiaxu He, Chao Wang, Jie Lian +4TTS SynthesisLow-Resource TTS Synthesis

  4. Automatic Reflection Level Classification in Hungarian Student Essays

    May 4, 2026Zsolt Csibi, Mónika Sándor, Mónika Serfőző +2Automated Essay ScoringLow-Resource Language Processing

  5. Cross-Lingual Learning within Arabic Script for Low-Resource HTR

    May 3, 2026Sana Al-azzawi, Elisa Barney, Marcus LiwickiOnline Handwriting RecognitionLow-Resource Language Processing

  6. SiNFluD: Creating and Evaluating Figurative Language Dataset for Sindhi

    May 2, 2026Wazir Ali, Adeeb Noor, Saifullah TumraniFigurative Language UnderstandingText Classification

  7. Addressing Data Scarcity in Bangla Fake News Detection: An LLM-Based Dataset Augmentation Approach

    May 2, 2026Ahmed Alfey Sani, Kazi Akib Zaoad, Shefayat E Shams Adib +2Class-Imbalanced LearningSynthetic Data Augmentation

  8. Cultural Benchmarking of LLMs in Standard and Dialectal Arabic Dialogues

    Apr 30, 2026Muhammad Dehan Al Kautsar, Saeed Almheiri, Momina Ahsan +13Multilingual Language Model EvaluationArabic NLP

  9. Linguistically Informed Multimodal Fusion for Vietnamese Scene-Text Image Captioning: Dataset, Graph Framework, and Phonological Attention

    Apr 30, 2026Nhi Ngoc-Yen Nguyen, Anh-Duc Nguyen, Nghia Hieu Nguyen +2Image CaptioningLow-Resource Language Processing

  10. Language Ideologies in a Multilingual Society: An LLM-based Analysis of Luxembourgish News Comments

    Apr 30, 2026Emilia Milano, Alistair Plum, Yves Scherrer +1Low-Resource Language Processing

  11. Naamah: A Large Scale Synthetic Sanskrit NER Corpus via DBpedia Seeding and LLM Generation

    Apr 29, 2026Akhil Rajeev P, Annarao KulkarniNamed Entity RecognitionSynthetic Data Generation

  12. CORAL: Adaptive Retrieval Loop for Culturally-Aligned Multilingual RAG

    Apr 28, 2026Nayeon Lee, Jiwoo Song, Byeongcheol KangRetrieval-Augmented GenerationAdaptive RAG

  13. Sign-Language Datasets at Scale: A Comprehensive Survey on Resources, Benchmarks, and Annotation Standards

    Apr 28, 2026Yiming Ni, Zhi-Qi Cheng, Jiayu Li +1Sign Language RecognitionLow-Resource Language Processing

  14. Language corpora for the Dutch medical domain

    Apr 28, 2026B. van EsHealthcareLow-Resource Language Processing

  15. IRIS: Interleaved Reinforcement with Incremental Staged Curriculum for Cross-Lingual Mathematical Reasoning

    Apr 27, 2026Navya Gupta, Rishitej Reddy Vyalla, Avinash Anand +8Cross-Lingual Reasoning in Language ModelsRL for Language Model Reasoning

  16. Resource-Lean Lexicon Induction for German Dialects

    Apr 26, 2026Robert Litschko, Barbara Plank, Diego FrassinelliLow-Resource Language Processing

  17. Neural Grammatical Error Correction for Romanian

    Apr 26, 2026Teodor-Mihai Cotet, Stefan Ruseti, Mihai DascaluGrammatical Error CorrectionLow-Resource Language Processing

  18. XITE: Cross-lingual Interpolation for Transfer using Embeddings

    Apr 26, 2026Barah Fazili, Preethi JyothiMultilingual Language ModelsData Augmentation

  19. Multilinguality at the Edge: Developing Language Models for the Global South

    Apr 23, 2026Lester James V. Miranda, Songbo Hu, Roi Reichart +1Multilingual Language ModelsOn-Device Language Model Inference

  20. CARE: Counselor-Aligned Response Engine for Online Mental-Health Support

    Apr 23, 2026Hagai Astrin, Ayal Swaid, Avi Segal +1Mental Health CounselingEmotional Support Conversation

  21. Machine learning and emoji prediction: How much accuracy can MARBERT achieve?

    Apr 22, 2026Mohammed Q. Shormani, Ibrahim Abdulmalik Hassan Muneef Y. AlshawshArabic NLPLow-Resource Language Processing

  22. AFRILANGTUTOR: Advancing Language Tutoring and Culture Education in Low-Resource Languages with Large Language Models

    Apr 22, 2026Tadesse Destaw Belay, Shahriar Kabir Nahin, Israel Abebe Azime +6Multilingual Language ModelsIntelligent Tutoring Systems

  23. RespondeoQA: a Benchmark for Bilingual Latin-English Question Answering

    Apr 22, 2026Marisa Hudspeth, Patrick J. Burns, Brendan O'ConnorMultilingual Language Model EvaluationMultilingual QA

  24. Toward Cross-Lingual Quality Classifiers for Multilingual Pretraining Data Selection

    Apr 22, 2026Yassine Turki, Vinko Sabolčec, Bettina Messmer +1Language Model PretrainingMultilingual Language Models

  25. Effects of Cross-lingual Evidence in Multilingual Medical Question Answering

    Apr 22, 2026Anar Yeginbergen, Maite Oronoz, Rodrigo AgerriKnowledge Augmentation for Language ModelsHealthcare

  26. RoLegalGEC: Legal Domain Grammatical Error Detection and Correction Dataset for Romanian

    Apr 21, 2026Mircea Timpuriu, Mihaela-Claudia Cercel, Dumitru-Clementin CercelLegal NLPGrammatical Error Correction

  27. A Bolu: A Structured Dataset for the Computational Analysis of Sardinian Improvisational Poetry

    Apr 21, 2026Silvio Calderaro, Johanna MontiLow-Resource Language Processing

  28. Bangla Key2Text: Text Generation from Keywords for a Low Resource Language

    Apr 21, 2026Tonmoy Talukder, G M ShahariarLow-Resource Language ProcessingText Generation