Explainable AI Methods

Momentum

23 papers in the last four weeks, up 10% on the four weeks before. 0.3% of all new papers.

Jul 6Week of Sep 21

Latest papers 230

All topics
CardsList
  1. Detect, Explain, Interpret: An End-to-End Benchmark for Time Series Anomaly Detection, Explainability and Interpretability

    Oct 1, 2026Roberto Stanzione, Jules Barbe, Magali Parrino +2Time-Series Anomaly DetectionTime Series

  2. VIEScore2: Unified Image Evaluation with Spatially Grounded Explanations

    Oct 1, 2026Xianda Du, Max Ku, Weiming Ren +5Multi-Image Editing BenchmarksSynthetic Image Detection

  3. WOMBAT: Whitebox Oracle for Molecular Benchmarking and Attribution Testing

    Sep 30, 2026Dominik Matuszek, Bartosz Zieliński, Tomasz Danel +1Graph Neural NetworksExplainable AI Methods

  4. Do Better Scores Mean Better Physics? Physics-Grounded Explanations for Sim2Real Neural Operators

    Sep 30, 2026Somyajit Chakraborty, Xizhong ChenPhysics SimulationNeural Operators

  5. Synthetic Speech Attribution via Prototypical Networks

    Sep 30, 2026Viola Negroni, Paolo Bestagini, Stefano TubaroSpeech SynthesisExplainable AI Methods

  6. Selecting The Most Informative Tokens in Natural Language Autoencoders

    Sep 29, 2026Federico Torrielli, Gianluca Barmina, Andrea Blasi Núñez +4Explainable AI MethodsModel Activations

  7. FigAct: Turning Scientific Figures into Active Canvases for Explanation

    Sep 28, 2026Shishi Xiao, Zichao Wang, Alexa Siu +2Scientific FigureExplainable AI Methods

  8. Using LLMs to Detect LLM-Generated Texts: A Cross-Generation Analysis

    Sep 28, 2026Haiyue Yuan, Jie Guo, Weidong Qiu +3Machine-Generated Text DetectionAuthorship

  9. RewardExplainer: Learning Reward Model Explanations from Counterfactual Preference Feedback

    Sep 27, 2026Jingyi He, Nier Wu, Shuang Liu +3Progress Reward ModelingExplainable AI Methods

  10. Understanding Confabulation and Rethinking Reconstruction in Activation Explanations

    Sep 27, 2026Gert Lek, Zixuan Xia, Pin-Yu Chen +1Model ActivationsExplainable AI Methods

  11. Learnable Time-Frequency Masks for Explaining Time-Series Classifiers

    Sep 24, 2026Theresa Dahl Frehr, Francisco Pelayo, Lukas Raad +3Time-FrequencyDeep Learning

  12. When Explanations Cannot Be Read: Measuring and Correcting SHAP and LIME Rendering for Right-to-Left Languages

    Sep 23, 2026Rameesha Zia, Muhammad Shahid Iqbal MalikExplainable AI MethodsShapley Additive Explanations

  13. MorphoSHAP: Rethinking the Unit of Attribution in Explanation for Deep Visual Models

    Sep 22, 2026Anirudh Prabhakaran, Alexandre Rocchi, Gianni FranchiShapingExplainable AI Methods

  14. Collaborative Streaming Anomaly Detection with Interactive Explanations and Ensemble Consensus

    Sep 20, 2026Diogo Risca, Afonso Lourenço, Ricardo Martins +1Anomaly ScoreArtificial Intelligence Detection

  15. Transferring Visual Explanations: How Cross-Architecture Knowledge Distillation Affects Model Interpretability

    Sep 20, 2026Aleks Czufarow, Ihor BabinKnowledge DistillationInterpretability

  16. When Do Language-Grounded Explanations Help? A Graph-Bottleneck for Farm Monitoring Interpretable Sheep Facial Pain

    Sep 17, 2026Alam Noor, Miguel Guti'errez Gait'anExpressionExplainable AI Methods

  17. Evaluating Explanation Methods by the Predictors They Induce

    Sep 17, 2026Jacob Selbæk, Hugo L. HammerShapley Additive ExplanationsExplainable AI Methods

  18. FCx: An algorithm for finding Feasible Counterfactual Explanations

    Sep 16, 2026Kleopatra Markou, Vana Kalogeraki, Dimitrios GunopulosCounterfactual ExplanationCounterfactuals

  19. Probabilistic Linear Explanations

    Sep 16, 2026Frederic Koriche, Jean-Marie Lagniez, Chi TranExplainabilityExplainable AI Methods

  20. Bias Amplification in Multi-Agent Network: How Biased Agents Shape Opinions and Rhetoric

    Sep 16, 2026Omran Berjawi, Giuseppe Fenza, Rida KhatounMulti-Agent Large Language Model SystemsMulti-Agent Communication

  21. EDCT-Bench: Uncovering Faithfulness Gaps in VLMs via Explanation-Driven Counterfactual Testing

    Sep 16, 2026Sihao Ding, Santosh Vasa, Aditi Ramadwar +1Visual EvidenceExplainable AI Methods

  22. An Empirical Study of Counterfactual Self-Explanations in LLMs

    Sep 15, 2026Giannis Kalyvas, Giorgos Filandrianos, Orfeas Menis Mastromichalakis +2Free-Form Textual RationalesCounterfactual Explanation

  23. Explanations-Driven Active Feature Acquisition for Algorithmic Recourse

    Sep 14, 2026Vinura Galwaduge, Jagath SamarabanduFeature EngineeringAlgorithmic Cores

  24. Detecting and Explaining Fake News Short Videos with Multimodal Content and Real-World Evidence

    Sep 14, 2026Yifeng Luo, Yupeng Li, Ming Tang +2Fake News DetectionAi-Generated Video Detection

  25. XAI-Arena: Can LLMs Assess the Quality of XAI Explanations?

    Sep 10, 2026Yanfei Hu Fleischhauer, Alona Zharova, Nadja Klein +1XaiExplainable Artificial Intelligence

  26. XAI-Refine: An Automated Explanation-Knowledge Loop for Brain-Age Prediction

    Sep 8, 2026Yang Qiao, Junjie Wu, Deqiang Qiu +2Brain AgeExplainable AI Methods

  27. Explaining f-Divergence-Based Regularization via Local Curvature and Sharpness-Aware Minimization

    Sep 8, 2026Nour Jamoussi, Marios KountourisSharpness-Aware MinimizationLocal Curvature

  28. When Superpixels Fail on Documents: A Study of Segmentation for LIME Explanations

    Sep 7, 2026Quentin Telnoff, Emanuela Boros, Mickaël Coustaty +3InterpretabilityDocument

  29. Knowing Is Not Enough: Information Retrievability as a Precondition to Effective LLM Oversight

    Sep 2, 2026Xinyu Fu, Narayan Ramasubbu, Dennis GallettaLarge Language Models FailExplainable AI Methods

  30. Automated Testing of LLM-Based Post Hoc Explainers Using Model Checking as an Oracle

    Aug 31, 2026Dennis Gross, Helge SpiekerProbabilistic Model CheckingExplainable AI Methods

  31. Attribute-Based Activation Steering of LLMs for Group-Specific Explanation Generation

    Aug 29, 2026Leandra Fichtel, Janek Prange, Henning WachsmuthExplainable AI MethodsLinear Activation Steering

  32. LM-X: Explainable Vision--Language--Action Modeling via Progress, Event, and Uncertainty Prediction

    Aug 26, 2026Jin Lou, Zhiyuan Jing, Xupeng Wang +21Action ExpertExplainable AI Methods

  33. The Lifecycle of LLM-as-a-Judge for Large-Scale Recommendation Explanations

    Aug 18, 2026Emma Yanyang Kong, JJ Tan, Ishan Gupta +8Llm-As-A-JudgeExplainable AI Methods

  34. SAEVerbalizer: Generating Explanations for Sparse Autoencoder Features via Representation Verbalization

    Aug 13, 2026Weihan Meng, Hongzhu Guo, Yi Jing +5Sparse Autoencoder FeaturesVerbalization

  35. Discovering Efficient and Explainable Communication Topologies for LLM-based Multi-Agent Systems via Causal Inference

    Aug 13, 2026Junzhi Li, Peng He, Qirui Ji +3Network TopologyCommunication Topologies

  36. When Explanations Betray Backdoors: Black-Box Auditing for Language Model Classifiers

    Aug 12, 2026Yang Liu, Ran ZouLarge Language Model ClassificationExplainable AI Methods

  37. Class Activation Mapping in Explainable Computer Vision: A Method-Centered Review of CNN, Transformer, and Foundation-Model-Era Visual Explanations

    Aug 12, 2026AmirHossein Eshghi, Hamid Saadatfar, Seyyed Ali Hoseini +2Gradient-Weighted Class Activation MappingClass Activation Mapping

  38. RelShap: Relationally Consistent Shapley Explanations

    Aug 11, 2026Seungeun Lee, Joao Fonseca, Julia StoyanovichShapley Additive ExplanationsShapley Value

  39. COGENT: Counterfactual Gaussian Explanations for Volumetric Medical Images

    Aug 11, 2026Dorian Rząsa, Bartosz Zabdyr, Krzysztof Piekarz +7VolumeCounterfactual Explanation

  40. BREAD: Baseline-Referenced Explanations for Anomaly Diagnosis

    Aug 11, 2026Jiaqi Qiu, Rob Goedhart, Jannis Kurtz +1Graph Anomaly DetectionXai

  41. FiRe: Fixed-Noise Refinement for Visual Counterfactual Explanations

    Aug 9, 2026Yan Zeng, Changlu Guo, Oskar Kristoffersen +3Counterfactual ExplanationCounterfactuals

  42. Accurate Ensembles, Fragile Narratives: Multi-Scale Stacking and a Fidelity Audit of LLM-Generated Explanations for Credit Risk

    Aug 8, 2026Gregorius Reynaldi Pratama, Kuo-Kun TsengCredit Risk PredictionEnsemble

  43. Challenges in Evaluating Explanation Methods for Static and Evolving Data

    Aug 6, 2026Jerzy StefanowskiExplainable Artificial IntelligenceExplainable AI Methods

  44. LangChoiceBench: Measuring and Explaining Programming-Language Choice in LLMs

    Aug 6, 2026Lukas Twist, Twm Stone, Helen Yannakoudakis +1Large Language Model BenchmarksChoice

  45. An entropic explanation of insistence on sameness in autism

    Aug 5, 2026Przemysław ŚliwińskiAutism Spectrum DisorderEntropy

  46. Beyond Accuracy: A Multidimensional Evaluation of Statistical Reasoning in Large Language Models

    Aug 4, 2026Monnie McGee, Mateo Langston Smith, Julian CabreraLLM Reasoning StrategiesStatistical Inference

  47. Explainable AI for the EU Right to Explanation: A Systematic Review of the Law-XAI Translation Gap

    Aug 3, 2026Benjamin Fresz, Elena Dubovitskaya, Marco F. HuberExplainable Artificial IntelligenceEu Artificial Intelligence Act

  48. PICTURE: Enhancing Theory-of-Mind in Large Language Models by Revealing, Not Hiding, Characters' Lack of Knowledge

    Aug 3, 2026Eojin Jeon, SangKeun LeeTheory-Of-Mind ReasoningLLM Reasoning Strategies

  49. Through the LENS: Local Geometric Decomposition of Vision-Language Model Representations

    Aug 1, 2026Shalom Kachko, Raz Lapid, Margarita Vald +2Cross-ModalModalities

  50. Distilling Reasoning Traces into Advisory Prompts for Software Engineering Tasks

    Aug 1, 2026Faizan Faisal, Prem Devanbu, Toufique AhmedAi-Assisted Programming TasksSoftware Engineering

  51. Recovering Explanations from Transformed Rule-Based Ontologies

    Jul 31, 2026Alex Ivliev, Markus Krötzsch, Maximilian MarxOntologyRecursive Reasoner

  52. A Human-Centered Validation of the Explainability-Performance Coefficient

    Jul 31, 2026Christian Oliva, Luis F. Lago-FernándezExplainabilityExplainable AI Methods

  53. FADEx: Feature Attribution and Distortion-based Explanation of Dimensionality Reduction

    Jul 29, 2026Lucas Greff Meneses, Evandro S. Ortigossa, Claudio Silva +1Dimensionality ReductionFeature Importance

  54. (EC)2: Event-Centric Explainability for Cybersecurity Through Multi-Agent LLM Investigations

    Jul 28, 2026Neta Kirmayer, David Tayouri, Andrés Murillo +3CybersecurityInterpretable Anomaly Detection