AI Trustworthiness

Momentum

28 papers in the last four weeks, up 133% on the four weeks before. 0.3% of all new papers.

Jul 6Week of Sep 21

Latest papers 228

All topics
CardsList
  1. Image Quality Dependent Degradation for AI Systems

    Jul 28, 2026Yannick Kees, Elena Hoemann, Frank Köster +1Image Quality AssessmentVisual Degradation

  2. Architectural Backdoors in Vision-Language Model Supply Chains via Representation Steering

    Jul 28, 2026Maria Rosaria Briglia, Igor Maljkovic, Antonio Emanuele Cinà +3Vision-Language Foundation ModelsLarge Language Model Backbones

  3. Belief-Aware Influence and Trust (BAIT): Shaping Human Belief During Repeated Human-Robot Interaction

    Jul 28, 2026Ye-Ji Mun, Mahsa Golchoubian, Shahabedin Sagheb +4Human-Robot InteractionModel Predictive Path Integral

  4. Evaluating the Impact of Explainable AI on Trust in AI-Assisted Code Review

    Jul 27, 2026Zhenhan Gao, Marvin Muñoz Barón, Umm-e Habiba +2Code QualityExplainable Artificial Intelligence

  5. Human Preference aligned Tabular Similarity

    Jul 27, 2026Frederik Hoppe, Astrid Franz, Marianne Michaelis +2Similarity and MetricsText Embeddings

  6. Mutual Modality Trust with Lightweight Reconstruction Regularization for Fine-grained Tire Pattern Recognition

    Jul 27, 2026Jianning Yang, Jie Fang, Xinda Ma +3Automotive DetectionFine-Grained Perception

  7. Towards Trustworthy and Cost-Efficient Data Integration: From Naïve RAG to Agentic RAG

    Jul 24, 2026Chuangtao Ma, Arijit KhanAgentic Retrieval-Augmented Generation SystemsData Science Agents

  8. Deconstructing Off-Policy Ratios: Entropy-Scaled Trust Regions for Asynchronous Reinforcement Learning

    Jul 24, 2026Guanqun Zhao, Zijun Xie, Binbin Zheng +5Trust RegionTraining-Inference Mismatch

  9. Trustworthiness Costs of Domain Adaptation in Small Language Models:A Cross-Architecture Empirical Study

    Jul 23, 2026Ramesh B. ParamkushamLarge Language Model AdaptationLarge Language Model Reliability

  10. Reexamining zero-shot summarization: Empirical investigation of trustworthiness of LLM-summarizers

    Jul 23, 2026Vasudha Bhatnagar, Purnima Bindal, Vikas Kumar +1Large Language Model ReliabilitySummarization

  11. AI-generated Images Challenge Visual Trust in High-risk Scenarios

    Jul 23, 2026Yi-Zhi Wang, Yichen Xiao, Linan Yue +5Ai-Generated Image DetectionImage Generation

  12. LegalCiteTrust: Benchmarking Citation Trustworthiness in Chinese Long-Form Legal Research Reports

    Jul 23, 2026Yunhan Li, Mingjie Xie, Zeyang Shi +2CitationsLarge Language Model Reliability

  13. TRUST-ESD: A Risk-Calibrated and Governance-Aware AI Framework for Enterprise Strategic Decision Support Under Uncertainty

    Jul 22, 2026Tian Qiu, Li Yan, Mahabubur Rahman Miraj +3Software Engineering Decision SupportArtificial Intelligence Governance

  14. AgentTrails: Towards Trust and Reuse for Agentic Tasks

    Jul 21, 2026Eden Wu, Sonia Castelo, Yurong Liu +2AI TrustworthinessReuse

  15. Stale but Stable: Staleness-Adaptive Trust Regions for Stabilizing Asynchronous Reinforcement Learning

    Jul 21, 2026Junyao Yang, Yucheng Shi, Zongxia Li +6Trust RegionGradient Staleness

  16. It Matters How You Say It: Exploring Rhetorical Patterns for AI-Assisted Information Evaluation

    Jul 20, 2026Sadra Sabouri, Zeinabsadat Saghi, Jordan Lee Boyd-Graber +3RhetoricInterpretive Layer

  17. Human-in-the-Loop User Feedback Affects Perceived Accuracy and Trust, but Task Subjectivity Matters

    Jul 20, 2026Donald R. Honeycutt, Mahsan Nourani, Eric D. RaganFeedbackSubjectivity

  18. A Methodology for Auditable Trustworthiness Levels in AI Lifecycle Governance

    Jul 17, 2026Andrea FerrarioTrustworthy Artificial IntelligenceAI Trustworthiness

  19. Closing the AI Trust Gap: The Case for Independent Certification for Trustworthy AI

    Jul 17, 2026Trisevgeni Papakonstantinou, Cansu Canca, Farah Nanji +14Trustworthy Artificial IntelligenceAI Trustworthiness

  20. Towards a Unified Multidimensional Explainability Metric: Evaluating Trustworthiness in AI Models

    Jul 15, 2026Georgios Makridis, Georgios Fatouros, Athanasios Kiourtis +4XaiExplainability

  21. Active Trust Management for Successful Human-Robot Teaming: Moving from a Trust Repair to a Trust Satisficing Perspective

    Jul 15, 2026Nicola Webb, Edmund R. HuntHuman-Robot CollaborationAI Trustworthiness

  22. Trust Before Fusion: QIMG-7 and Source-Aware Resolution for Polluted Multimodal RAG

    Jul 12, 2026Saadeldine Eletter, Owais Aijaz, Preslav NakovMultimodal Retrieval Augmented GenerationMultimodal Retrieval

  23. ConceptSMILE: Auditing the Trustworthiness of Concept-Based Explainable AI

    Jul 10, 2026Mohadeseh Mollapour, Koorosh Aslansefat, Zeinab Dehghani +3Explainable Artificial IntelligenceTrustworthy Artificial Intelligence

  24. Prismata: Confining Cross-Site Prompt Injection in Web Agents

    Jul 9, 2026Corban Villa, Alp Eren Ozdarendeli, Sijun Tan +1Web AgentsUntrusted Content

  25. Agent Delivery Engineering Predictive Reliability Framework

    Jul 8, 2026Dexing LiuEarly Failure PredictionReadmission Prediction

  26. From Blueprint to Reality: Modeling and Applying Putnam's Social Capital Theory with LLM-based Multi-agent Simulations

    Jul 7, 2026Shiyi Ling, Zhi Zheng, Hui Zheng +3Scaling Improve Social SimulationMulti-Agent Simulations

  27. Curated retrieval versus open web search in public AI information services: a coverage-trust trade-off

    Jul 6, 2026Hafsteinn Einarsson, Hafsteinn Birgir Einarsson, Jón Gunnar Ólafsson +1CredibilityAI Trustworthiness

  28. !Imperio, smolVLA: The Implications of Data Poisoning on Open Source Robotics

    Jul 5, 2026Stefan Bühler, Mark SchuteraPoisoningAI Trustworthiness

  29. Probabilistic Robustness in Medical Image Classification

    Jul 4, 2026Yi Zhang, Siddartha Khastgir, Xingyu ZhaoMedical Image ClassificationDeep Learning

  30. Calibrating the Instrument: Controllability of an LLM-Driven Synthetic Population

    Jul 1, 2026Mirko Degli EspostiPopulation DynamicsSynthetic Data

  31. The Moving Target: A Longitudinal Audit of Trustworthiness Drift Across Twelve Checkpoints of Open-Source Chat LLMs

    Jul 1, 2026Zhichao Fan, Yanhang Li, Zexin Zhuang +2Large Language Model ReliabilityAI Trustworthiness

  32. Trust the Prior (or Not): Uncertainty-Aware Abdominal Aortic Aneurysm Segmentation

    Jun 30, 2026Erich Robbi, Daniele Ravanelli, Andrea PasseriniSemi-Supervised Medical Image SegmentationCoronary Angiography

  33. Harnessing the Latent Space: From Steering Vectors to Model Calibrators for Control and Trust

    Jun 30, 2026Nishant SubramaniAI TrustworthinessSteering

  34. Trust Your Instincts: Confidence-Driven Test-Time RL for Vision-Language-Action Models

    Jun 29, 2026Siyao Chen, Jiakang Yuan, Jiaxin Wang +1AI Trustworthiness

  35. The Calibrated Deepfake Trust Score (CDTS): Competence-Coupled Trust Degradation Across Deepfake Detectors

    Jun 28, 2026Md Anas BiswasDeepfake DetectionAI Trustworthiness

  36. TRUST: Efficient Abdominal Trauma Recognition via Image-to-Ultrasound-Video Transfer Learning

    Jun 26, 2026Enguang Wang, Hao Zhou, Shuo Gao +2UltrasoundClinical Ultrasound Dataset

  37. Confidence-Aware Tool Orchestration for Robust Video Understanding

    Jun 25, 2026Yangfan He, Yujin Choi, Jaehong YoonFine-Grained Video UnderstandingVideo Agent

  38. Fortress and Gatekeeper: Theorizing Transitive Trust in Third-Party Cybersecurity Risk Governance

    Jun 25, 2026Yijun Chen, Misita AnwarCybersecurityGovernance

  39. Long-Term Simulation Exposes Cognitive-Developmental Risks in AI Companions

    Jun 24, 2026Kaicheng Shen, Lingyu Li, Wen Wu +3Artificial Intelligence CompanionsUser Simulation

  40. TRUSTMEM: Learning Trustworthy Memory Consolidation for LLM Agents with Long-Term Memory

    Jun 23, 2026Tianyu Yang, Sudipta Paul, Vijay Srinivasan +2Agentic MemoryLong-Term Memory

  41. The Clinician's Veto: Navigating Trust, Liability, and Uncertainty in Autonomous AI Prescribing

    Jun 23, 2026Eileanor LaRocco, Sarah Tan, Adarsh Subbaswamy +4Medication LeafletClinician Trust

  42. Breaking Shortcut Learning for Cross-Trial EEG-Guided Target Speech Extraction via Two-Stage Training

    Jun 23, 2026Wonchul Shin, Inyong Choi, Kyogu LeeTarget Speaker ExtractionElectroencephalography

  43. Where Is My Physics Wrong? Localized and Identifiable Discovery of Model Discrepancy

    Jun 22, 2026Yifan WangDiscrepancyModel Discovery

  44. EnTrust: Modeling Inter-Modal Conflict for Trustworthy Multimodal Medical Image Analysis

    Jun 19, 2026Dwarikanath Mahapatra, Abhijit Das, Behzad Bozorgtabar +5Pixel-Level PredictionDisagreement

  45. FinRED: An Expert-Guided Benchmark Generation and Evaluation Framework for Financial LLM Red-Teaming

    Jun 18, 2026Chaeyun Kim, Daeyoung Park, Junghwan Kim +4Red-TeamingLarge Language Model Safety

  46. Toward Machine Risk Perception: Integrating Trust Calibration and Precursor-Based Risk Estimation for Humanoid

    Jun 18, 2026He WenHuman-Robot CollaborationAccidents

  47. Trust the Right Teacher: Quality-Aware Self-Distillation for GUI Grounding

    Jun 16, 2026Jingyuan Huang, Zuming Huang, Yucheng Shi +4Graphical User InterfaceSelf-Distillation Framework

  48. AI Adoption Across a Multinational Workforce: Sociotechnical Conditions for GenAI Acceptance in Human Resources

    Jun 16, 2026Dalia Ali, Maria José Rodríguez Velázquez, Manoel Horta Ribeiro +2Socio-Technical SystemsGenerative Artificial Intelligence

  49. TCHG: Tri-Trust Conditioned Heterogeneous Graph Learning for Reliable Dynamic Trust Prediction

    Jun 15, 2026Bohao Liao, Boyu Deng, Qipeng Song +2Log-Ratio-Based Gaussian Trust WeightText-Attributed Graph