AI Trustworthiness

Momentum

28 papers in the last four weeks, up 133% on the four weeks before. 0.3% of all new papers.

Jul 6Week of Sep 21

Latest papers 228

All topics
CardsList
  1. Cheap to Draw, Expensive to Trust: Certifying Test-Time Scaling Curves

    Sep 30, 2026Sohail, Sarkar, Shakuntala BaichooModel AuditingTest-Time Scaling

  2. Trust Is Not a Score: Runtime Assurance Contracts for High-Risk AI Agents

    Sep 30, 2026Serhii ZabolotniiRuntime EnforcementContracts

  3. Towards Trustworthy AI for Glioma Diagnosis: A Task-Aware Evaluation of Uncertainty Quantification

    Sep 30, 2026Gonzalo Esteban Mosquera Rojas, Sebastian R. van der Voort, Carolin M. Pirkl +3GliomaBrain Tumor Classification

  4. Trust the Critic More

    Sep 30, 2026Kaiyue Wen, Luke Bailey, Arvind Mahankali +1Critic-Free Reinforcement LearningLarge Language Model Reinforcement Learning

  5. Can Agents Trust Their Skills? Uncovering Unsafe Chains of Trust in Skill-Based LLM Agents

    Sep 30, 2026Yan Wang, Zhihao Zhang, Ke Chen +5AI TrustworthinessLarge Language Model Agents

  6. You Cannot Pick a Provider From the Price List: Market-Aware Routing for Open-Weight LLM Inference

    Sep 29, 2026Liang He, Jingbo Wen, Yixiong Chen +4Large Language Model RoutingLLM Inference Optimization

  7. Foundations of Proactive Agents: Principles, Technical Layers, and Proactivity-Gym

    Sep 29, 2026Jio Oh, Seunghyun Do, Young-Jun Lee +2Large Language Model AgentsUser Simulation

  8. CRJudgeBench: Can AI Detect Plausible but Invalid Code Reviews?

    Sep 29, 2026Yue Pan, Jiawei Li, Ziyuan Zhang +2Code QualityRaw Judge Outputs

  9. Lucid Dreaming for World Models: Learning to Doubt Imagination and Decide by Trust

    Sep 29, 2026Ziqi Wen, Ting Xu, Lianyu Wang +5Latent World ModelsWorld Models

  10. Multi-Channel Mitigation of Source-Trust Shortcuts in Fact-Checking RL Agents

    Sep 29, 2026Jianchang Su, Yiwei Yang, Wei ZhangFact-CheckingAI Trustworthiness

  11. Fewer Assumptions by Design: A Reusable Skill for LLM-Assisted Verus Verification

    Sep 28, 2026Andrada-Livia Antoneac, Dorel Lucanu, Dragoş Teodor GavriluţLlm-As-A-JudgeAI Trustworthiness

  12. Learn Now, Use Next, Trust Later: Prequential Test-Time Learning for LLM Agents

    Sep 28, 2026Tong Zhao, Reed Li, Yuyang Hu +5Large Language Model AgentsNext

  13. Kafila: Serving Large Language Models on a Trusted Set of Heterogeneous Commodity Machines

    Sep 28, 2026Murtaza Rangwala, Richard O. Sinnott, Rajkumar BuyyaAI TrustworthinessSwarms

  14. LLM4Trust: Exploring the Capabilities of Large Language Models for Trust Evaluation

    Sep 27, 2026Jie Wang, Yanbo Sun, Zheng Yan +2AI TrustworthinessLog-Ratio-Based Gaussian Trust Weight

  15. To Trust or Not to Trust: Retrieval-Augmented Fact Checking in Speech

    Sep 24, 2026Debajyoti Mazumder, Mamta, Abhirama Subramanyam PenamakuriFact-CheckingMisinformation

  16. Dual-Frontier: When Can an Agent Trust Its World Model?

    Sep 22, 2026Huatai Zhu, Qiang Chen, Ziqian Kou +5World ModelsCounterfactual Learning

  17. Distill What You Trust: Reliability-Aware Multi-Teacher On-Policy Distillation

    Sep 20, 2026Jie Sun, Mao Zheng, Mingyang Song +8Aware Heterogeneous Multi-Teacher Multimodal On-Policy DistillationTeacher

  18. Trust, but Validate the Instrument: Auditing AI-Generated RTL Verification Plans on Authored Security-Regression Proxies

    Sep 17, 2026Hang Xiao, Chuhong Xu, Kainan Zhou +2Runtime EnforcementModel Auditing

  19. A Unified Evaluation Framework for Trustworthy Large Language Models, Agentic AI, and Multimodal Systems

    Sep 17, 2026Shaina Raza, Ahmed Y. Radwan, Imran Liaquat +1Trustworthy Artificial IntelligenceLarge Language Model Reliability

  20. Building Trust in Artificial Intelligence: A Necessity for Railway Applications

    Sep 16, 2026Lefebvre Renard Clément, Lébé Vincent, Da Silva Ribeiro Pereira Ricardo +3Trustworthy Artificial IntelligenceRelighting

  21. Reflections on Trusting Trust, Revisited: Contaminating Self-Modifying AI Coding Agents with Poisoned Benchmarks

    Sep 15, 2026Franziska Roesner, Tadayoshi KohnoCoding AgentsPoisoning

  22. SpliTEE: Improving LLM Inference on Trusted Hardware with Differentially Private GPU Outsourcing

    Sep 14, 2026Shashie Dilhara Batan Arachchige, Robin Carpentier, Hassan Jameel Asghar +1LLM Inference OptimizationDiffie-Hellman

  23. Self-Verifying Anomaly Detection using Explainable AI for Cybersecurity of DER Networks

    Sep 14, 2026Damilola Popoola, Souradeep Bhattacharya, Manimaran GovindarasuInterpretable Anomaly DetectionDistributed Energy Resources

  24. Robust Trust

    Sep 14, 2026Piotr Dworczak, Alex SmolinAI TrustworthinessTrust Region

  25. Can We Trust LLM Judges: A Study of Capability-Dependent Biases and Multi-Judge Ensemble for Bias Calibration

    Sep 14, 2026Gemma Zhang, Prachi Badarayani, Asmi Kumar +2Llm-As-A-JudgeLarge Language Model Judges

  26. When2Talk: When Should a Proactive In-Car Agent Talk?

    Sep 14, 2026Kaiser Hamid, Peihang Li, Nade LiangProactiveTalk

  27. Trust by Design: Trust Calibration Through Non-Advisory Socratic Dialogue in Conversational Agents

    Sep 13, 2026Roba Hassan, Nahla Aboromi, Naomi Unkelos-ShpigelAI TrustworthinessSocratic Dialogue

  28. Understanding Operator Attitudes Toward AI-Supported Decision Making in Maritime Operations

    Sep 12, 2026Doreen Jirak, Armeen Saroukanoff, Dirk van RooyMaritime NavigationAttitude

  29. XAI-Arena: Can LLMs Assess the Quality of XAI Explanations?

    Sep 10, 2026Yanfei Hu Fleischhauer, Alona Zharova, Nadja Klein +1XaiExplainable Artificial Intelligence

  30. Seeing is Not Believing: Breaking the Physical-to-Digital Trust Boundary in Robotics

    Sep 8, 2026Leming Shen, Shikai Geng, Yuanqing Zheng +1Robot Operating SystemMulti-Robot Systems

  31. Do AI Coding Assistants Check Before They Install? A Pre-Registered Demand-Side Audit of Trust Signals in the Research Software Supply Chain

    Sep 7, 2026Pengyin ShanAi-Assisted Programming TasksModel Auditing

  32. Epistemic Warrant for LLM Recommendations: Characterizing the Basis for Reliance When Ground Truth Is Unavailable

    Sep 3, 2026Shai Vardi, João SedocLarge Language Model ReliabilityEpistemic States

  33. A Blind Trust, the Bloody Thrust: When Attacker-Controlled Hook Updates Steer AI Agent Harnesses towards Malicious Behaviors

    Sep 3, 2026Pengxun Li, Litian Zhang, Jianwei Hou +4Malicious AgentsArtificial Intelligence Agents

  34. Trust Your Guide Only When Certain: Uncertainty-Aware Sparse Alignment at Inference Time

    Sep 1, 2026Zeen Zhu, Zhuo Li, Weiyang Guo +4Distributional AlignmentInference-Time Defense

  35. Feedback-Assisted Trust Propagation over Document Relation Graphs for Retrieval-Augmented Generation

    Sep 1, 2026Zhuoheng Li, Ying ChenLog-Ratio-Based Gaussian Trust WeightAI Trustworthiness

  36. TRUST: Threshold-Recalibrated Uncertainty-Safe Training for Certified Dismissal in Breast Cancer Screening

    Aug 31, 2026Parham Hajishafiezahramini, Matthew Hamilton, Edward Kendall +2ScreeningDecision Thresholds

  37. Trust, but Verify: Rigorously Profiling Best-Effort High-Performance Computing for Digital Evolution

    Aug 25, 2026Matthew Andres Moreno, Santiago Rodriguez Papa, Charles Ofria +2High-Performance ComputingMultiscale Dynamics

  38. InterSAGE: The Secure and Verifiable Interoperability Protocol for An Internet of Agents

    Aug 13, 2026Zhenhua Zou, Sheng Guo, Qiuyang Zhan +3InteroperabilityProtocol

  39. Benchmarking Trustworthiness of SLMs: Pre-trained vs. Compressed

    Aug 12, 2026Haokun Lin, Kaijie Zhu, Haobo Xu +4Small Large Language ModelsLarge Language Model Reliability

  40. Self-evolving network verifiers

    Aug 11, 2026Ioannis Protogeros, Tibor Schneider, Laurent VanbeverOptical NetworksCounterexample

  41. Conversational versus Dashboard Explainable AI for UAV Intrusion Detection: An Empirical Study of Operator Trust and Reliance

    Aug 11, 2026Cong Chi Nguyen, Trang Mai Xuan, Vu-Duc Ngo +3Drone DetectionUnmanned Aerial Vehicle Detection

  42. Defending Retrieval-Augmented Intrusion Detection Against Knowledge Poisoning and Prompt Injection

    Aug 8, 2026Kaysarul Anas Apurba, Md. Hasibul Hasan, Mahedee Zaman Moon +2Intrusion DetectionHievi-Rag

  43. Learning When to Trust via Selective Context Preference Optimization

    Aug 6, 2026Xian Sun, Wei Chow, Yingshuo Wang +4Large Language Model ReliabilityAI Trustworthiness

  44. LiNC: Lightweight Noise Correction via Per-Sample Trust and Gaussian Mixture Modeling

    Aug 4, 2026Abhishek Moturu, Babak Taati, Anna GoldenbergNoisy LabelsMedical Imaging Datasets

  45. CTRAG: An In-Context Retrieval-based Framework for Automated Compliance Checking using LLMs

    Aug 3, 2026Muhammad Roman, Karen Rafferty, Barry DevereuxComplianceAI Trustworthiness

  46. When May a Model Replace the Experiment? Audits, Licenses, and the Price of Trust in Surrogate-Driven Design

    Aug 2, 2026Shuangxiu, Ma, Wenhe +1Model AuditingSurrogate Gradient

  47. Trust and Its Betrayal under Three Representational Strategies

    Jul 31, 2026Mihnea C. Moldoveanu, Joel A. C. BaumAI TrustworthinessEpistemic States

  48. The persuasive power of large language models does not depend on their perceived national origin

    Jul 31, 2026Ningzhi Liu, Yannic Hinrichs, Jonas R. KunstPersuasionSocial Influence

  49. Skillsets on the Chain: A Blockchain-based Zero-Trust Framework for Agentic AI Networking

    Jul 31, 2026Yayu Gao, Yong Xiao, Hao Hu +5Trustworthy Artificial IntelligenceAI Trustworthiness

  50. When Derived Measurements Mislead: Quantifying and Mitigating LLM Over-Trust with Privileged-Modality Reliability Evidence

    Jul 30, 2026Zongheng Guo, Tao Chen, Tianli Li +6Large Language Model ReliabilityAI Trustworthiness