Large Language Model Reliability

Latest papers 182

All topics
CardsList
  1. How the Audit Rule Shapes Faithful Factor Explanations in LLMs

    Oct 1, 2026Taolin Zhang, Hanyu Wang, Jiuheng Wan +2Model AuditingLarge Language Model Reliability

  2. The Price of Correlated Tests: How Strict Should a Model Release Gate Be?

    Oct 1, 2026Marco PollanenReleaseGating

  3. Towards Robust Numerical Claim Verification

    Sep 30, 2026Peter Røysland Aarnes, Vinay SettyLarge Language Model ReliabilityCategory-Aware Atomic Claims

  4. Multi-Channel Mitigation of Source-Trust Shortcuts in Fact-Checking RL Agents

    Sep 29, 2026Jianchang Su, Yiwei Yang, Wei ZhangFact-CheckingAI Trustworthiness

  5. A Polyphonic Conception of AI Understanding

    Sep 28, 2026Matthieu Queloz, Pierre BeckmannTrustworthy Artificial IntelligenceLarge Language Model Reliability

  6. Toward a Graded Measure of Belief Stability in Large Language Models

    Sep 28, 2026Samantha Dies, Branden Fitelson, Tina Eliassi-RadLarge Language Model Reliability

  7. LLMs Trust Their Own: Identity-Dependent Conformity in Multi-Agent Systems

    Sep 27, 2026Liron Soffer, Ravid Shwartz-Ziv, Chen ShaniConformityMulti-Agent Large Language Model Systems

  8. Technical Manual for Toolkit for Confidence-Corpus Consistency, Corpus Absorption and Rule Learning via Fine-Tuning on a Fabricated Corpus

    Sep 23, 2026José Luciano Verçosa Marques, Frederico Jorge Heitmann, Daniel Omar Perez +3Large Language Model ReliabilityText Corpora

  9. When Context Misleads: In-context Learning with Jurisdiction in Large Language Models

    Sep 23, 2026Pei-lin Li, Qingle Liu, Junyang Feng +4In-Context LearningIn-Context

  10. Human-LLM Deliberation as Interactive Proof: Conditions for Verifiability Without Transparency

    Sep 21, 2026Baotong Zhang, Dean Foster, João SedocLarge Language Model ReliabilityProvable Guarantees

  11. From Articles to Publishers: Aggregating Language Model Predictions for News Source Reliability Inference

    Sep 21, 2026John Bianchi, Manuel Pratelli, Fabio Pinelli +1CredibilityHeadlines

  12. Intrinsic Sequence-Likelihood Confidence in Retrieval-Dominated Extractive QA: Two Pre-Specified Negatives, and What They Do and Do Not Attribute

    Sep 17, 2026Gunwoo Lee, Changmin Sung, Sang-Hwan Gwak +3Large Language Model ReliabilityNegative Results

  13. A Unified Evaluation Framework for Trustworthy Large Language Models, Agentic AI, and Multimodal Systems

    Sep 17, 2026Shaina Raza, Ahmed Y. Radwan, Imran Liaquat +1Trustworthy Artificial IntelligenceLarge Language Model Reliability

  14. An Empirical Evaluation of Cost-Efficient Large Language Models on Algorithmic Programming Tasks

    Sep 16, 2026Chandimal Adikari, Nandika HerathLarge Language Model ReliabilityEmpirical Study

  15. The Misery of Mechanistic Interpretability: A Formal Perspective

    Sep 14, 2026Tobias Ladner, Matthias AlthoffMechanistic InterpretabilityInterpretability

  16. Can LLMs Follow Medical Expert Logic? A Benchmark for Hierarchical Logical Consistency in Risk-of-Bias Assessment

    Sep 12, 2026Jiayu Huang, Zichen Tang, Qianhui Ling +2Clinical Reasoning TrainingLarge Language Model Reliability

  17. Evaluating and Improving Evidence-Grounded Fact-Checking in LLMs via Multi-Round Evidence Ablation

    Sep 8, 2026Xingyu Deng, Mingzi Cao, Nikolaos Aletras +2Fact-CheckingLarge Language Model Reliability

  18. Epistemic Warrant for LLM Recommendations: Characterizing the Basis for Reliance When Ground Truth Is Unavailable

    Sep 3, 2026Shai Vardi, João SedocLarge Language Model ReliabilityEpistemic States

  19. Does Playing it Safe Count as Faithfulness? Reassessing LVLM Hallucination Mitigation Methods

    Sep 1, 2026Mehrdad Fazli, Sina Mansouri, Mohit Marvania +1Large Language Model HallucinationHallucination Mitigation

  20. Reliability Challenges in Diffusion Vision-Language Models

    Sep 1, 2026Md. Atabuzzaman, Chris ThomasDiffusion Language ModelsLarge Language Model Reliability

  21. Calibrating Small Language Models for Claim Check-Worthiness Detection

    Aug 31, 2026Pratuat Amatya, V Venktesh, Vinay SettyLarge Language Model ReliabilitySmall Large Language Models

  22. Whether LLMs Can Navigate Beliefs and Facts Depends on How You Phrase It

    Aug 18, 2026Quang Minh Nguyen, Luis Frentzen SalimLarge Language Model ReliabilityFacts

  23. NetlistBench: Evaluating LLM Reliability in SPICE Netlist Recognition and Manipulation

    Aug 12, 2026Jiarui Ma, Jianghan Wang, Yuheng Ma +2Printed Circuit BoardLarge Language Model Reliability

  24. Benchmarking Trustworthiness of SLMs: Pre-trained vs. Compressed

    Aug 12, 2026Haokun Lin, Kaijie Zhu, Haobo Xu +4Small Large Language ModelsLarge Language Model Reliability

  25. Assessing Reliability of BERT-Based Models on Question Answering Tasks

    Aug 11, 2026Pooja Yadav, Priyanka Harjule, Basant Agarwal +1Large Language Model ReliabilityBert-Based Models

  26. Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility

    Aug 10, 2026Siyang Wu, Yibo Jiang, Bryon AragamLarge Language Model ReliabilityAnswer

  27. Learning When to Trust via Selective Context Preference Optimization

    Aug 6, 2026Xian Sun, Wei Chow, Yingshuo Wang +4Large Language Model ReliabilityAI Trustworthiness

  28. Decomposed Entailment for Factuality Checking and Hallucination Detection

    Aug 6, 2026Achir Oukelmoun, Nasredine Semmar, Gaël De ChalendarHallucination DetectionLarge Language Model Reliability

  29. Quantization Effects on Biomedical LLM Reliability

    Aug 4, 2026Anton Rasmussen, Hong QinLarge Language Model ReliabilityLarge Language Model Quantization

  30. Control Under Compression: Reliability Frontiers for Tool-Using Agents

    Aug 2, 2026Yinghan Hou, Zongyou YangLanguage-Model AgentsLarge Language Model Reliability

  31. SCHEDBench: A Benchmark for Evaluating LLM Constraint Faithfulness in Natural-Language Combinatorial Scheduling

    Aug 2, 2026Shrenil Shaun Sharma, Avi SharmaJob Shop SchedulingLarge Language Model Reliability

  32. Tracing the Cascade: A Topology-Aware Evaluation Framework for Scientific Agent Hallucinations

    Aug 1, 2026Xinshun Feng, Ziqi Miao, Lijun Li +1Scientific DiscoveryLarge Language Model Reliability

  33. A Triple-Robustness Analysis of Retrieval-Augmented Generation for Multi-Hop Requirements Traceability

    Aug 1, 2026Meftun Akarsu, Burak Özdemir, Doğancan Büyükçolak +1Graph-Based Retrieval Augmented GenerationTraceability

  34. Averaging Bias: Human Faithfulness Annotations are not Locally Faithful

    Jul 31, 2026Huajian Zhang, Yiyang Feng, Jiawei ZhouExplanation FaithfulnessFaithfulness

  35. When Derived Measurements Mislead: Quantifying and Mitigating LLM Over-Trust with Privileged-Modality Reliability Evidence

    Jul 30, 2026Zongheng Guo, Tao Chen, Tianli Li +6Large Language Model ReliabilityAI Trustworthiness

  36. Stemma: Induced Decision Regions Reveal LLM Provenance

    Jul 28, 2026Keyu Zhang, Vadim Safronov, Andrew MartinLarge Language Model ReliabilityFingerprint

  37. Task-Conditional Faithfulness Auditing of Multimodal LLMs for Grid Diagnosis

    Jul 27, 2026Tianqiao Zhao, Meng Yue, Jianhui WangLarge Language Model ReliabilityMultimodal Large Language Models

  38. Modeling Memory-Dependent Reliability of LLMs: A Hidden Markov Model

    Jul 24, 2026Robab Aghazadeh Chakherlou, Siddartha Khastgir, Peter Popov +1Large Language Model ReliabilityHidden Markov Models

  39. Opaque Epistemic Mediation: How LLM Deployment Configurations Shape the Validation of Pseudo-Science

    Jul 24, 2026Davide Scarso, Hugo Noronha de Almeida, Joaquim PinaLarge Language Model ReliabilityCredibility

  40. On Improving Faithfulness of Podcasts from Documents

    Jul 24, 2026Soumya Dutta, Tejas Indulal Dhamecha, Pannaga ShivaswamyExplanation FaithfulnessFaithfulness

  41. Reliability-Contagion Feasibility in LLM Multi-Agent Networks

    Jul 24, 2026Ruiwu Niu, Xincheng Shu, Ying ZhaoMulti-Agent CommunicationLarge Language Model Reliability

  42. Trustworthiness Costs of Domain Adaptation in Small Language Models:A Cross-Architecture Empirical Study

    Jul 23, 2026Ramesh B. ParamkushamLarge Language Model AdaptationLarge Language Model Reliability

  43. Reexamining zero-shot summarization: Empirical investigation of trustworthiness of LLM-summarizers

    Jul 23, 2026Vasudha Bhatnagar, Purnima Bindal, Vikas Kumar +1Large Language Model ReliabilitySummarization

  44. LegalCiteTrust: Benchmarking Citation Trustworthiness in Chinese Long-Form Legal Research Reports

    Jul 23, 2026Yunhan Li, Mingjie Xie, Zeyang Shi +2CitationsLarge Language Model Reliability

  45. Integrity of peer-to-peer distributed LLM inference under malicious nodes

    Jul 21, 2026Mert Cihangiroglu, Antonino NoceraPeer-To-PeerLarge Language Model Reliability