Hate Speech Detection

Latest papers 56

All topics
CardsList
  1. Disagreeing Rationales: Rethinking Classification and Explainability Evaluation in Hate Speech Detection

    May 29, 2026Benedetta Muscato, Beiduo Chen, Gizem Gezici +2Annotator DisagreementHate Speech Detection

  2. FBHM: Functional Benchmarking and Steering of VLMs for Hateful Meme Detection

    May 29, 2026Paramananda Bhaskar, Naquee Rizwan, Daksh Jogchand +2VLM EvaluationVLM Adaptation

  3. Cyberbullying Governance on Social Media: A Unified Framework from Content Identification to Intervention

    May 26, 2026Yiting Huang, Wenting Zhu, Zekun Wang +6Social Media AnalysisHate Speech Detection

  4. Attribute-Based Diagnosis of LLM Alignment with Hate Speech Annotations

    May 26, 2026Mohammad Amine Jradi, Faeze Ghorbanpour, Alexander FraserLLM EvaluationLLM Alignment

  5. Distinguishing Right from Wrong in Debates: Attribution Analysis of Chinese Harmful Memes

    May 23, 2026Weiming Wang, Junyu Lu, Han Wang +5Hate Speech Detection

  6. Multi-Stage Training for Abusive Comment Detection in Indic Languages

    May 21, 2026Pranshu Rastogi, Madhav Mathur, Ramaneswaran S +1Hate Speech Detection

  7. Beyond Content: A Comprehensive Speech Toxicity Dataset and Detection Framework Incorporating Paralinguistic Cues

    May 15, 2026Zhongjie Ba, Liang Yi, Peng Cheng +3Speech ProcessingHate Speech Detection

  8. KIT-TIP-NLP at MultiPride: Continual Learning with Multilingual Foundation Model

    May 13, 2026Barathi Ganesh HB, Michal Ptaszynski, Rene Melendez +1Hate Speech Detection

  9. Who and What? Using Linguistic Features and Annotator Characteristics to Analyze Annotation Variation

    May 7, 2026Maximilian Maurer, Maximilian Linde, Gabriella LapesaAnnotator DisagreementHuman-in-the-Loop Annotation

  10. A Comparative Study of PyCaret AutoML and CNN-BiLSTM for Binary Hate Speech Detection in Indonesian Twitter

    May 6, 2026Tanty Widiyastuti, Mayada, Adisty Syawalda Ariyanto +3Convolutional RNNsHate Speech Detection

  11. Leveraging Argument Structure to Predict Content Hatefulness

    May 4, 2026Nicolás Benjamín Ocampo, Davide CeolinArgument MiningHate Speech Detection

  12. MemeScouts@LT-EDI 2026: Asking the Right Questions -- Prompted Weak Supervision for Meme Hate Speech Detection

    Apr 27, 2026Ivo Bueno, Lea Hirlimann, Enkelejda KasneciHate Speech DetectionWeakly Supervised Learning

  13. IYKYK (But AI Doesn't): Automated Content Moderation Does Not Capture Communities' Heterogeneous Attitudes Towards Reclaimed Language

    Apr 17, 2026Christina Chance, Rebecca Pattichis, Arjun Subramonian +4Social Media AnalysisAnnotator Disagreement

  14. Explain the Flag: Contextualizing Hate Speech Beyond Censorship

    Apr 16, 2026Jason Liartis, Eirini Kaldeli, Lambrini Gyftokosta +2Hate Speech Detection

  15. Comparison of Modern Multilingual Text Embedding Techniques for Hate Speech Detection Task

    Apr 16, 2026Evaldas Vaiciukynas, Paulius Danenas, Linas Ablonskis +5Sentence EmbeddingsText Embedding Evaluation

  16. Do We Still Need Humans in the Loop? Human vs. LLM Annotation in Active Learning for TikTok Hate Speech Detection

    Apr 15, 2026Ahmad Dawar Hakimi, Lea Hirlimann, Isabelle Augenstein +1LLM-Assisted AnnotationHuman-in-the-Loop Annotation

  17. The Enforcement and Feasibility of Hate Speech Moderation

    Apr 14, 2026Manuel Tonneau, Dylan Thurgood, Diyi Liu +7Social Media AnalysisHate Speech Detection

  18. When Hate Meets Facts: LLMs-in-the-Loop for Check-worthiness Detection in Hate Speech

    Mar 26, 2026Nicolás Benjamín Ocampo, Tommaso Caselli, Davide CeolinLLM-Assisted AnnotationHate Speech Detection

  19. PEST: Parameter Efficient Steering of Blackbox VLMs via Agentic Few-shot Alignment for Hateful Meme Moderation

    Jan 8, 2026Naquee Rizwan, Subhankar Swain, Paramananda Bhaskar +3VLM AdaptationHate Speech Detection

  20. ToxSyn-PT: A Synthetic Fine-Grained Dataset of Minority-Targeted Toxic Language in Portuguese

    Jun 11, 2025Iago Alves Brito, Julia Soares Dollis, Fernanda Bufon Farber +2Synthetic Data GenerationHate Speech Detection

  21. Leveraging LLMs for Context-Aware Implicit Textual and Multimodal Hate Speech Detection

    Date pendingJoshua Wolfe Brook, Ilia MarkovHate Speech Detection

  22. Efficient Adaptation of LLMs for Hate Speech Detection in Low-Resource Languages: A Comparative Study on Roman Urdu

    Date pendingToneema Zubair, Muhammad Junaid Asif, Faisal Kamiran +2LLM EvaluationHate Speech Detection

  23. Whitewashing Hate, Smearing Harmless Content: Annotator-Style Rebuttal Attacks on LLM-Based Moderation

    Date pendingJunyu Lu, Kaiyuan Liu, Kaichun Wang +8Content ModerationAdversarial Attacks on LLMs