Low-Resource Language Processing

Latest papers 342

All topics
CardsList
  1. Towards Robust Arabic Speech Emotion Recognition with Deep Learning

    Jun 9, 2026Youcef Soufiane Gheffari, Samiya SilarbiHybrid CNN-Transformer ArchitecturesSpeech Emotion Recognition

  2. Data Synthesis and Parameter-Efficient Fine-Tuning for Low-Resource NMT: A Case Study on Q'eqchi' Mayan

    Jun 8, 2026Alexander Chulzhanov, Soeren Eberhardt, Arjun MukherjeeSynthetic Data GenerationLow-Resource MT

  3. Overcoming Decoder Inconsistencies in Whisper for Dravidian and Low-Resource Languages

    Jun 8, 2026Chowdam Venkata Kumar, Kumud Tripathi, Pankaj WasnikAttention MechanismsLow-Resource Language Processing

  4. MUDIDI: A Two-Stage Framework for Multilingual Dictionary Digitization with Language Models

    Jun 8, 2026David Setiawan, Temuulen Khishigsuren, Milind Agarwal +3Low-Resource Language ProcessingOptical Character Recognition

  5. NüshuVoice: Reviving the Voice of Endangered Nüshu with Pitch-Aware Text-to-Speech

    Jun 8, 2026Hongkun Yang, Xinhui Yi, Xiyan Zhao +13TTS SynthesisLow-Resource TTS Synthesis

  6. Translate-R1: Cost-Aware Translation Tool Use via Reinforcement Learning

    Jun 5, 2026Pratik Jayarao, Chaitanya Dwivedi, Himanshu Gupta +5RL for Language ModelsLLM Tool Use

  7. Modular Monolingual Adaptation using Pretrained Language Models

    Jun 4, 2026Nalin Kumar, Ondřej DušekLow-Resource Language ProcessingTokenizer Adaptation

  8. A Komi-Yazva--Russian Parallel Corpus and Evaluation Protocol for Zero- and Few-Shot LLM Translation

    Jun 4, 2026Petr ParshakovLLM EvaluationLow-Resource MT

  9. CHALIS: A Challenge Dataset for Language Identification in Difficult Scenarios

    Jun 4, 2026Michal Tichý, Jindřich LibovickýDistribution Shift RobustnessLanguage Identification

  10. Multilingual Coreference Resolution via Cycle-Consistent Machine Translation

    Jun 3, 2026Adriana-Valentina Costache, Eduard Poesina, Silviu-Florin Gheorghe +2Coreference ResolutionData Augmentation

  11. DuDi: Dual-Signal Distillation with Cross-Lingual Verbalizer

    Jun 3, 2026Patomporn Payoungkhamdee, Tinnakit Udsa, Jian Gang Ngui +3Multilingual Language ModelsSmall Language Models

  12. KletterMix: Climbing Toward High-Quality German Pretraining Data

    Jun 2, 2026Maurice Kraus, Ruben Härle, Sebastian Sztwiertnia +4Language Model PretrainingSynthetic Data Pretraining

  13. From Script to Semantics: Prompting Strategies for African NLI

    Jun 2, 2026Anuj Tiwari, Terry Oko-odion, Hannah NwokochaMultilingual Language Model EvaluationLLM Prompting

  14. Sample-Size Scaling of the African Languages NLI Evaluation

    Jun 2, 2026Anuj Tiwari, Oluwapelumi Ogunremu, Terry Oko-odion +2Multilingual Language Model EvaluationLow-Resource Language Processing

  15. Learning When to Translate for Multilingual Reasoning

    Jun 1, 2026Deokhyung Kang, Hyounghun Kim, Gary Geunbae LeeMultilingual Language ModelsCross-Lingual Reasoning in Language Models

  16. Multilingual Idioms in Sentences and Conversations Across High-, Medium-, and Low-Resource Languages

    Jun 1, 2026Saeed Almheiri, Bilal Elbouardi, Salsabila Zahirah Pranida +16Figurative Language UnderstandingMultilingual Language Models

  17. Multilinguality of Large Language Models From a Structural Perspective

    Jun 1, 2026Haruki Sakajo, Yusuke Sakai, Hidetaka Kamigaito +1Multilingual Language ModelsRepresentational Similarity Analysis

  18. When Meaning Travels: A Granular Lens on Hybrid-MoE's Role in Idiomatic Understanding for Language Models

    Jun 1, 2026Sarmistha Das, Vaibhav Vishal, Shreyas Guha +3Mixture-of-Experts Language ModelsLow-Resource Language Processing

  19. Peacemaker at ATE-IT: Automatic term extraction from Italian text for waste management data using encoder model

    May 31, 2026Mahdi Bakhtiyarzadeh, Hadi Bayrami Asl Tekanlou, Jafar RazmaraDocument Information ExtractionLow-Resource Language Processing

  20. TukaBench: A Culturally Grounded Jailbreak Benchmark for African Languages

    May 31, 2026Victor Akinode, Senyu Li, Wassim Hamidouche +3LLM Safety BenchmarksMultilingual Language Model Evaluation

  21. Low-Resource Safety Failures Are Action Failures, Not Representation Failures

    May 31, 2026Rashad Aziz, Ikhlasul Akmal Hanif, Fajri KotoLanguage Model CalibrationLLM Safety

  22. PolySpeech-100: A Large-Scale Benchmark for Speech Understanding Across 100+ Languages and Dialects

    May 31, 2026Sicheng Yang, Shulan Ruan, Shiwei Wu +4Audio-Language Model EvaluationAudio Understanding

  23. Reliable Multilingual Orthopedic Decision Support from Clinical Narratives: Language-Aware Adaptation and Verification-Guided Deferral

    May 29, 2026Danish Ali, Li Xiaojian, Sundas Iqbal +1Multilingual Language ModelsSelective Prediction

  24. Multilingual and Cross-Lingual Citation Needed Detection on Wikipedia for Lower-Resource Languages

    May 29, 2026Gerrit Quaremba, Amy Rechkemmer, Elizabeth Black +2Multilingual Language Model EvaluationSmall Language Models

  25. Evaluating Cross-lingual Knowledge Consistency in Code-Mixed vis-a-vis Indian Languages using IndicKLAR

    May 28, 2026Debajyoti Mazumder, Divyansh Pathak, Prashant Kodali +3Multilingual Language Model EvaluationCross-Lingual Reasoning in Language Models

  26. Source-Grounded Semantic Reinforcement Learning for Low-Resource Target-Language Generation

    May 28, 2026Zeli Su, Ziyin Zhang, Zewei Pan +8RL for Language ModelsLow-Resource Language Processing