Harmful Language

Momentum

2 papers in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 15

All topics
CardsList
  1. DecoyTrace: Toxic Decoys for Active Defense in Decentralized Federated Learning

    Sep 28, 2026Pedro Beltrán-López, Enrique Tomás Martínez Beltrán, Pantaleone Nespoli +2Federated LearningModel-Agnostic Defense

  2. Detoxifying Toxic Communication: A Design Science Approach to Responsible AI

    Aug 31, 2026Hossein Arshadi Soufiani, Henry M. Kim, Hjalmar Turesson +2Harmful LanguageDetoxification

  3. Unmasking Toxic Mimicry in Medical Offline Reinforcement Learning for ICU Sepsis Management via Counterfactual Clinical Audits

    Aug 11, 2026Hangqi Ren, Junyi LiaoSepsisMimic-Iv Datasets

  4. Beyond a Global Norm: Personalizing Toxicity Sensitivity in Language Models Without Retraining

    Jul 25, 2026Rares A. C. Diaconescu, Iulia Slanina, Alina Florea +5ToxicityHarmful Language

  5. ToxiREX: A Dataset on Toxic REasoning in ConteXt

    Jun 26, 2026Stefan F. Schouten, Ilia Markov, Piek VossenHarmful LanguageToxicity

  6. Forgive or forget: Understanding the context of hate in audio retrieval systems

    Jun 4, 2026Arghya Pal, Sailaja Rajanala, Raphael C. -W. Phan +1Text-To-AudioHarmful Language

  7. D2D^2-Monitor: Dynamic Safety Monitoring for Diffusion LLMs via Hesitation Signals

    May 25, 2026Aoxi Liu, Yupeng Chen, James Oldfield +5Large Language Model SafetyDiffusion Language Models

  8. State Contamination in Memory-Augmented LLM Agents

    May 16, 2026Yian Wang, Agam Goyal, Yuen Chen +1Large Language Model AgentsHarmful Language

  9. Who and What? Using Linguistic Features and Annotator Characteristics to Analyze Annotation Variation

    May 7, 2026Maximilian Maurer, Maximilian Linde, Gabriella LapesaHuman AnnotatorsLinguistics

  10. When Routine Chats Turn Toxic: Unintended Long-Term State Poisoning in Personalized Agents

    May 7, 2026Xiaoyu Xu, Minxin Du, Qipeng Xie +3PoisoningPersonalized Large Language Model Agents

  11. Mapping Election Toxicity on Social Media across Issue, Ideology, and Psychosocial Dimensions

    Apr 18, 2026Lei Cao, Wen Zeng, Xinyue Wu +2IdeologyHarmful Language

  12. CausalDetox: Causal Head Selection and Intervention for Language Model Detoxification

    Apr 16, 2026Yian Wang, Yuen Chen, Agam Goyal +1DetoxificationHarmful Language

  13. Test-Time Detoxification without Training or Learning Anything

    Jan 14, 2026Baturay Saglam, Dionysis KalogeriasToxicityDetoxification