Data Contamination in Language Models

Latest papers 39

All topics
CardsList
  1. Uncheatable Eval: Dynamic Compression-Based Evaluation of Language Models

    Sep 23, 2026Kaifeng Tan, Yudong Li, Linlin ShenLLM EvaluationData Contamination in Language Models

  2. Mirror, Mirror on the Wall: Prompt Echoing in Small Instruct Language Models

    Sep 14, 2026Inez Okulska, Bartosz Naskręcki, Jan Piotrowski +1Data Contamination in Language ModelsInduction Heads

  3. SynthSentry: Detecting Synthetic Data Contamination in Language Model Training Data

    Sep 14, 2026Praveen Kumar Myakala, Ravichandra Namburi, Sowmya Keragodu Jayaramu +1AI-Generated Text DetectionTraining Data Curation

  4. Molecular Déjà Vu: Digit-Level Retrieval of Molecular Properties in Frontier Language Models

    Sep 4, 2026Matthias Busch, Marius Tacke, Sviatlana V. Lamaka +4LLM EvaluationLLM Reliability

  5. Cultivar: A Contrastive and Locale-Oriented Translation Benchmark for Investigating Contamination and Localisation Robustness

    Aug 10, 2026Pinzhen Chen, Koel Dutta Chowdhury, Xiaoya Xu +20Data Contamination in Language ModelsLanguage Model Robustness

  6. Library Reachability in LSR-Synth: How Anti-Memorization Design Changes the Measurement of Symbolic Discovery

    Jul 30, 2026Zhan'ao Yao, Liang Yin, Zhihao Gao +9Synthetic Benchmark GenerationData Contamination in Language Models

  7. How Context Attribution Handles What the Model Already Knows

    Jul 26, 2026Quoc-Huy Trinh, Lin Zhu, Sebastian SzyllerLLM EvaluationLLM Interpretability

  8. Novel Claim or Déjà Vu? Rethinking "Contamination-Free'' Dynamic Evaluation for Multimodal Automated Fact-Checking

    Jul 26, 2026Haorui He, Xinwen Chen, Dacheng Wen +3Benchmark ContaminationAutomated Fact-Checking

  9. RustMizan: A Compilable, Contamination-Aware Benchmarking Framework for Rust Vulnerabilities

    Jul 6, 2026Tarek Elsayed, Shiping Yang, Eunsong Koh +13Software Vulnerability DetectionData Contamination in Language Models

  10. Defending Against Harmful Supervision Hidden in Benign Samples

    Jun 29, 2026Bang An, Yibo Yang, Dandan Guo +3Supervised Fine-TuningFine-Tuning

  11. SrDetection: A Self-Referential Framework for Data Leakage Detection in Code Large Language Models

    Jun 29, 2026Shuaimin Li, Liyang Fan, Zeyang Li +9LLM EvaluationLLM Auditing

  12. Uncertainty-based Debiasing and Unlearning for Decontamination

    Jun 22, 2026Guangzhi Sun, Xiao Zhan, Mark GalesData Contamination in Language ModelsLLM Unlearning

  13. Subtitle-Aligned Fine-Tuning of Whisper for Swiss German ASR: Benchmark Contamination, Convention Mismatch, and an Honest Baseline at 25.6% WER (13.8% cWER)

    May 29, 2026Felix AkeretASR EvaluationFine-Tuning

  14. LaRA: Layer-wise Representation Analysis for Detecting Data Contamination in RL Post-Training

    May 28, 2026Minju Gwak, Minseo Kwak, Dongseok Lee +3Data Contamination in Language ModelsRL Post-Training

  15. NumLeak: Public Numeric Benchmarks as Latent Labels in Foundation Models

    May 28, 2026Anany KotawalaData LeakageLLM Evaluation

  16. MemGuard: Preventing Memory Contamination in Long-Term Memory-Augmented Large Language Models

    May 27, 2026Hyeonjeong Ha, Jeonghwan Kim, Cheng Qian +7Memory-Augmented Language ModelsLLM Hallucination Mitigation

  17. MAIGO: Mitigating Lost-in-Conversation with History-Cleaned On-Policy Self-Distillation

    May 26, 2026Haoyu Zheng, Yun Zhu, Shu Yuan +5Instruction FollowingData Contamination in Language Models

  18. Cordyceps: Covert Control Attacks on LLMs via Data Poisoning

    May 26, 2026Zedian Shao, Charles Fleming, Teodora BalutaLLM Backdoor AttacksAdversarial Attacks on LLMs

  19. TRACER: A Semantic-Aware Framework for Fine-Grained Contamination Detection in Code LLMs

    May 22, 2026Yifeng Di, Xuliang Huang, Tianyi ZhangLLM AuditingData Contamination in Language Models

  20. The Illusion of Reasoning: Exposing Evasive Data Contamination in LLMs via Zero-CoT Truncation

    May 21, 2026Yifan Lan, Yuanpu Cao, Hanyu Wang +2LLM EvaluationLLM Auditing

  21. Provable Joint Decontamination for Benchmarking Multiple Large Language Models

    May 20, 2026Zhenlong Liu, Hao Zeng, Hongxin WeiLLM EvaluationBenchmark Contamination