Reliable

Momentum

6 papers in the last four weeks, down 25% on the four weeks before. 0.1% of all new papers.

Jul 6Week of Sep 21

Latest papers 64

All topics
CardsList
  1. Learning Reliable GUI Agents under Imperfect Priors

    Sep 30, 2026Bo Han, Qianyi Wang, Shuai Liu +9Graphical User Interface AgentsReliable

  2. How Reliable Are Predicted MOS for Reproducing Human System-Level Preferences in Speech Enhancement?

    Sep 30, 2026Nahomi Kusunoki, Tsubasa Ochiai, Naohiro Tawara +4Mean Opinion ScoresSpeech Enhancement

  3. SafeVantage: Vantage-Aware Memory for Reliable Embodied Decisions

    Sep 29, 2026Sean Hardesty Lewis, Zuyi Guo, Benwang Chen +3Viewpoint-Dependent Active PerceptionVisibility

  4. Reliability Engineering for AI Systems: Challenges, Methods, and Directions

    Sep 28, 2026Rong Pan, Yili Hong, Min XieArtificial Intelligence RiskArtificial Intelligence Systems

  5. RefineDrive: Reliable Failure-Guided Learning for Vision-Language-Action Driving

    Sep 28, 2026Zhe Sun, Ziyi Luo, Yehao Lu +2Autonomous DrivingDrives

  6. Reliability Theory for AI Control

    Sep 22, 2026Grant MolnarReliableTheory

  7. From Reliable Text to Real Voices: Trust-Aware Progressive Adaptation for Low-Resource TTS

    Sep 22, 2026Jiayi Lu, Yizhong Geng, Jinghan Yang +4Reliable

  8. Reliable Virtual Sensing: A Multi-Domain Benchmark for Robustness Under Sensor Failures

    Sep 16, 2026Jens U. Brandt, Noah C. Puetz, Alexander Windmann +4Robot FailuresVision Sensors

  9. FailBench: How Reliable are VLMs at Judging Robot Task Success?

    Sep 3, 2026Zaruhi Navasardyan, Tatul Danielyan, Hrant DavtyanRobotic ManipulationRobot Systems

  10. Towards a Reliable and Practical Eval Pipeline

    Sep 1, 2026Emma Thuong Nguyen, Abhishek GhoseEvaluation AgentReliable

  11. Agent Behavioral Contracts II: Certifying Compositional Reliability Without Assuming Independence

    Aug 13, 2026Varun Pratap Bhardwaj, Garima Singh, Arun Pratap BhardwajConditional IndependenceContracts

  12. ReLTEx: Reliable LLM-based Taxonomy Expansion

    Aug 11, 2026Zeinab Ghamlouch, Mehwish AlamTaxonomyEnrichment Analysis

  13. CARE: Confidence-Aware Reasoning for Reliable Medical VQA

    Aug 11, 2026Yuetian Du, Yucheng Wang, Zhenyuan Chen +9Medical Visual Question AnsweringClinical Reasoning Training

  14. Mitigating Context Interference for Reliable and Efficient Search Agents

    Aug 11, 2026Boyang Xue, Bin Wu, Shuofei Qiao +8Search AgentsInterference

  15. PPDL: LLM-Based Flows as Probabilistic Programs

    Aug 5, 2026Louis Mandel, Guillaume Baudart, Mandana Vaziri +1Large Language Model UncertaintyLarge Language Model Workflows

  16. Quality Diversity for Reliable Data Driven Time-Use Optimization

    Aug 5, 2026Aneta Neumann, Ty Stanford, Dorothea Dumuid +1Uncertainty QuantificationReadmission Prediction

  17. Why Ranking Anomaly Detection Algorithms Isn't as Reliable as You May Think

    Aug 5, 2026Simon Klüttermann, Jérôme Rutinowski, Frederik Polachowski +1Anomaly ScoreBenchmark Datasets

  18. Towards Reliable and Reproducible Fetal Brain Biometry: A Deep Learning Approach Using MRI

    Aug 4, 2026Francesca Maccarone, Marina Di Stefano, Giorgio Longari +7Prenatal UltrasoundMagnetic Resonance Imaging

  19. GGC: Selective Query Correction for Reliable Text-to-SPARQL Generation

    Jul 30, 2026Ziyi Yang, Thanh-Son Nguyen, Tuan Anh Nguyen +1SparqlGraph-Based Retrieval Augmented Generation

  20. MedXplore: Towards Reliable and Unbiased Generalized Category Discovery in Medical Imaging

    Jul 30, 2026Jianwei He, Kailin Lyu, Junhao Dong +6Medical Image ClassificationMedical Imaging

  21. Debate-on-Graph: Reliable and Adaptive Reasoning of Large Language Model on Uncertain Knowledge Graph

    Jul 19, 2026Peiji Yu, Xin Chen, Tianxing WuKnowledge GraphsLLM Reasoning Strategies

  22. Towards Reliable AI-Assisted Analog Design: Template-Constrained LLM Agents for SAR ADC Generation

    Jul 15, 2026Dimple Vijay Kochar, Hae-Seung Lee, Anantha P. ChandrakasanAnalog DesignAnalog

  23. GPUSimBench: Towards Scalable and Reliable GPU-Accelerated Simulators in Embodied AI

    Jul 6, 2026Huzhenyu Zhang, Shenghai Yuan, Wenrui Yan +4Physics SimulationScalable Robot Learning

  24. Denoised Conformal Alignment for Reliable Selection of Conditional Average Treatment Effect Predictions

    Jul 3, 2026Xinyun Lu, Haoang Chi, Zhiheng ZhangHeterogeneous Treatment EffectsReliable

  25. MAS-Lab: A Specification-Driven Validation Framework for Reliable Multi-Agent Systems

    Jun 29, 2026Jordan Augé, Giovanna Carofiglio, Giulio Grassi +1Model-Based Multi-Agent SystemsAgentic Framework

  26. ToolMenuBench: Benchmarking Tool-Menu Filtering Strategies for Reliable and Efficient LLM Agents

    Jun 13, 2026Rahul Suresh Babu, Laxmipriya Ganesh IyerLarge Language Model AgentsReliable

  27. XFlow: An Executable Protocol Programming System for Reliable Multi-Agent Workflows

    Jun 11, 2026Hanqi Li, Jing Peng, Zijian Wang +2Multi-Agent WorkflowsAgentic Workflow Design

  28. A Reliable Fault Diagnosis Method Based on Belief Rule Base Consider Robustness Analysis

    Jun 9, 2026Mingyuan Liu, Dan Yin, Zongzong WuFault DiagnosisRobustness Verification

  29. WebChallenger: A Reliable and Efficient Generalist Web Agent

    Jun 9, 2026Jayoo Hwang, Xiaowen Zhang, Vedant PadwalWeb AgentsExploration

  30. Reliable to Expressive: A Curriculum for Rubric-Following Safety Judges

    Jun 8, 2026Yongtaek Lim, Hyeji Choi, Minwoo KimSafety BenchmarksJudges

  31. Divide and Conquer: Reliable Multi-View Evidential Learning for Deepfake Detection

    Jun 1, 2026Xiaolu Kang, Zhongyuan Wang, Jikang Cheng +5Deepfake DetectionMulti-View

  32. Reliable Reasoning with Large Language Models via Preference-Based Maximum Satisfiability

    May 28, 2026Pedro Orvalho, Marta Kwiatkowska, Guillem Alenyà +1LLM Reasoning StrategiesSatisfiability

  33. PatchBoard: Schema-Grounded State Mutation for Reliable and Auditable LLM Multi-Agent Collaboration

    May 28, 2026Shuyu Zhang, Yaqi Shi, Jiarui Zhang +2State-TrackingKeyed Javascript Object Notation Record Yields

  34. Towards Reliable Multilingual LLMs-as-a-Judge: An Empirical Study

    May 27, 2026Irune Zubiaga, Aitor Soroa, Rodrigo AgerriMultilingual BenchmarkLarge Language Model Evaluation

  35. Confidence and Calibration of Activation Oracles for Reliable Interpretation of Language Model Internals

    May 25, 2026Federico Torrielli, Peter Schneider-Kamp, Lukas Galke PoechModel ActivationsLanguage Model Computes

  36. R2AoP: Reliable and Robust Angle of Progression Estimation from Intrapartum Ultrasound

    May 20, 2026Yuanhan Wang, Yifei Chen, Beining Wu +7Prenatal UltrasoundOptical Coherence Tomography

  37. Adaptive Conformal Prediction for Reliable and Explainable Medical Image Classification

    May 13, 2026One Octadion, Novanto Yudistira, Lailil MuflikhahMedical Image ClassificationOnline Conformal Prediction

  38. Low-Cost Labels, Reliable Choices: Rollout-Calibrated Hyper-Heuristics for Job Shop Scheduling

    May 11, 2026Junhao Wei, Yanxiao Li, Yifu Zhao +8Job Shop SchedulingHeuristics

  39. Foundations of Reliable Inference: Reliability-Efficiency Co-Design

    May 11, 2026Jiayi HuangUncertainty-Aware ClassificationBayesian Neural Networks

  40. Supercharging Bayesian Inference with Reliable AI-Informed Priors

    May 11, 2026Jongwoo Choi, Sean O'HaganReliable

  41. Effective and Memory-Efficient Alternatives to ECC for Reliable Large-Scale DNNs

    May 8, 2026Mohammad Hasan Ahmadilivani, Marten Roots, Marco Restifo +3Error CorrectionNeural Network Inference

  42. A Self-Healing Framework for Reliable LLM-Based Autonomous Agents

    May 7, 2026Cheonsu Jeong, Younggun ShinAutonomous AgentsSelf-Repair

  43. rAIson: Developing Reliable Decision-Making Agents

    May 2, 2026Pavlos Moraitis, Nikolaos Spanoudakis, Antonis KakasTechnologyReliable

  44. Block-wise Codeword Embedding for Reliable Multi-bit Text Watermarking

    May 1, 2026Joeun Kim, HoEun Kim, Dongsup Jin +1Large Language Model WatermarksMulti-Bit Watermarking

  45. Reliable Answers for Recurring Questions: Boosting Text-to-SQL Accuracy with Template Constrained Decoding

    Apr 30, 2026Smit Jivani, Sarvam Maheshwari, Sunita SarawagiText-To-SqlConstrained Decoding

  46. From Mirage to Grounding: Towards Reliable Multimodal Circuit-to-Verilog Code Generation

    Apr 30, 2026Guang Yang, Xing Hu, Xiang Chen +1Image-To-Code GenerationHigh-Level Synthesis

  47. Beyond the Mean: Within-Model Reliable Change Detection for LLM Evaluation

    Apr 30, 2026Jon-Paul CacioliLarge Language Model EvaluationChange

  48. Region Matters: Efficient and Reliable Region-Aware Visual Place Recognition

    Apr 24, 2026Shunpeng Chen, Yukun Song, Changwei Wang +6Visual Place RecognitionHarder Better Faster Denser Feature Matching

  49. Reference-state System Reliability method for scalable uncertainty quantification of coherent systems

    Apr 18, 2026Ji-Eun Byun, Hyeuk Ryu, Junho SongState SpaceUncertainty Quantification