Search research

Topics & fields

121–150 of 24,951

Papers

CardsList
  1. Lost in Translation: Do LVLM Judges Generalize Across Languages?

    Apr 21, 2026Md Tahmid Rahman Laskar, Mohammed Saidul Islam, Mir Tafseer Nayeem +5Multilingual BenchmarkLarge Language Model Judges

  2. HarnessOpt-Bench: Evaluating LLMs at Harness Optimization

    Aug 6, 2026Varun Ursekar, Apaar Shanker, Yash Maurya +4Agent Harness

  3. Evaluating Second-Order Bias of LLMs Through Epistemic Entitlement

    Jun 16, 2026Ramaravind Kommiya Mothilal, Terry Jingchen Zhang, Raiyan Ahmed +3Large Language Model BiasImplicit Bias