Gradient-Based Attribution

Latest papers 77

All topics
CardsList
  1. Towards Value-Constrained Credit Assignment in Fully Delegated AI Cooperatives

    Jun 26, 2026Young Yoon, Jimin Kim, Soyeon ParkGradient-Based AttributionValue Alignment

  2. GBC: Gradient-Based Connections for Optimizing Multi-Agent Systems

    Jun 26, 2026Xiaocheng Yang, Abdulrahman Alrabah, Dilek Hakkani-Tür +1Gradient-Based AttributionMulti-Agent LLM Systems

  3. Explainable AI in Speaker Recognition -- Attention Map Visualisation and Evaluation

    Jun 22, 2026Yanze Xu, Mark D. Plumbley, Wenwu WangGradient-Based AttributionFeature Attribution

  4. Diffusion Integrated Gradients: Controllable Path Generation for Flexible Feature Attribution

    Jun 21, 2026Soyeon Kim, Kyowoon Lee, Jaesik ChoiGradient-Based AttributionFeature Attribution

  5. Residue-Level Attributions in Protein Language Models Do Not Recover Allergen Epitopes

    Jun 20, 2026Jianzhou Yao, Anxiong Song, Katja Baerenfaller +1Gradient-Based AttributionProtein Language Models

  6. LIG: Layer-wise Integrated Gradients for Within-Layer Flow Analysis in Transformers

    Jun 19, 2026Eight Suzuki, Hideitsu Hino, Noboru MurataGradient-Based AttributionTransformer Interpretability

  7. Influcoder: Distilling Decoders' Gradient Influence Rankings into an Encoder for Data Attribution

    Jun 11, 2026Dimitri Kachler, Damien Sileo, Pascal DenisGradient-Based AttributionInfluence Functions

  8. Bergson: An Open Source Library for Data Attribution

    Jun 10, 2026Lucia Quirke, Louis Jaburi, David Johnston +6Gradient-Based AttributionLLM Interpretability

  9. When Attribution Patching Lies: Diagnosis and a Second-Order Correction

    Jun 5, 2026Luyang Zhang, Jialu WangGradient-Based AttributionLLM Interpretability

  10. Attribution via Distributional Paths for Information Revelation

    Jun 2, 2026Kieran A. Murphy, Shameen ShresthaGradient-Based AttributionFeature Attribution

  11. Comparing Post-Hoc Explainable AI Methods for Interpreting Black-Box EEG Models in Depression Detection

    May 27, 2026Antonia Šarčević, Nikolina FridGradient-Based AttributionElectroencephalography

  12. Localization then Neutralization: Gradient-guided Token Suppression against Visual Prompt Injection Attack

    May 24, 2026Dongpeng Zhang, Ke Ma, Yangbangyan Jiang +4Gradient-Based AttributionVLM Robustness

  13. Evaluating the Temporal Detection Capability of Integrated Gradients Applied on Sound Classifier

    May 22, 2026Martynas Dumpis, Tuomas VirtanenGradient-Based AttributionIntegrated Gradients

  14. Spectral Integrated Gradients for Coarse-to-Fine Feature Attribution

    May 19, 2026Soyeon Kim, Seongwoo Lim, Kyowoon Lee +1Gradient-Based AttributionIntegrated Gradients

  15. AIM: Adversarial Information Masking for Faithfulness Evaluation of Saliency Maps

    May 16, 2026Chia-Ying Hsieh, Hsin-Yuan Fang, Chun-Shu WeiGradient-Based AttributionSaliency Map Evaluation

  16. Zero-Shot Faithful Textual Explanations via Directional-Derivative Influence on Predictions

    May 16, 2026Toshinori Yamauchi, Hiroshi Kera, Kazuhiko KawamotoGradient-Based AttributionNeural Network Interpretability

  17. FAME: Feature Activation Map Explanation on Image Classification and Face Recognition

    May 12, 2026Xinyi Zhang, Manuel GüntherGradient-Based AttributionFeature Attribution

  18. How Faithful Is Trajectory-Based Data Attribution? Error Sources, Remedies, and Practical Guidelines

    May 12, 2026Junwei Deng, Pingbang Hu, Suliang Jin +4Gradient-Based AttributionData Selection

  19. Attribution-Based Neuron Utility for Plasticity Restoration in Deep Networks

    May 7, 2026Patrick Elisii, Lucas Beauchemin, Dawer JamshedGradient-Based AttributionLoss of Plasticity

  20. FRInGe: Distribution-Space Integrated Gradients with Fisher--Rao Geometry

    May 7, 2026Gabriele Martino, Sebastian TschiatschekGradient-Based AttributionIntegrated Gradients

  21. Playing the network backward: A Game Theoretic Attribution Framework

    May 7, 2026Jakob Paul Zimmermann, Jim Berend, Georg Loho +2Gradient-Based AttributionTransformer Interpretability

  22. Attribution-Guided Masking for Robust Cross-Domain Sentiment Classification

    May 4, 2026Shubham Harkare, Arvind Yogesh Suresh Babu, Yash KulkarniGradient-Based AttributionSentiment Analysis