Multilingual Language Model Evaluation

Latest papers 309

All topics
CardsList
  1. Evaluating Large Language Models on Urdu Idioms

    Oct 20, 2025Muhammad Farmal Khan, Mousumi AkterMultilingual Language Model EvaluationLow-Resource Language Processing

  2. Camellia: Benchmarking Cultural Biases in LLMs for Asian Languages

    Oct 6, 2025Tarek Naous, Anagha Savit, Carlos Rafael Catalan +17Multilingual Language Model EvaluationCultural Bias in Language Models

  3. In-context Learning vs. Instruction Tuning: The Case of Small and Multilingual Language Models

    Mar 3, 2025David Ponce, Thierry EtchegoyhenMultilingual Language ModelsMultilingual Language Model Evaluation

  4. KoSimpleQA: A Korean Factuality Benchmark with an Analysis of Reasoning LLMs

    Date pendingDonghyeon Ko, Kyubyung Chae, Yeguk Jin +6Multilingual Language Model EvaluationLLM Evaluation

  5. UrduMMLU: A Massive Multitask Benchmark for Urdu Language Understanding

    Date pendingAhmer Tabassum, Sarfraz Ahmad, Hasan Iqbal +3Multilingual Language Model EvaluationMultilingual QA