Ground Truth

Latest papers 132

All topics
CardsList
  1. TabJoinBench: A Benchmark for Joinable Table Discovery

    Sep 30, 2026Sandipan De, Jin Wang, Vivek GuptaData LakesBenchmark Datasets

  2. WOMBAT: Whitebox Oracle for Molecular Benchmarking and Attribution Testing

    Sep 30, 2026Dominik Matuszek, Bartosz Zieliński, Tomasz Danel +1Graph Neural NetworksExplainable AI Methods

  3. End-to-End Historical Music Restoration in Latent Space

    Sep 30, 2026Steven Cho, Junghyun Koo, Raphael Lafargue +3RestorationDegradation

  4. Spatial-OPSD: Self-Improving Spatial Reasoning via Label-Free Self-Distillation

    Sep 29, 2026Zhenyu Liu, Zhangquan Chen, Keyi Chen +4Spatial ReasoningRecent Vision-Language Models

  5. Can Generative AI Automate Data Extraction for Meta-Analysis? A Case Study on Intercropping Research

    Sep 28, 2026Zehao Lu, Xingguo Xiong, Wopke van der Werf +2Research AutomationPrecision Agriculture

  6. Triangular Resampling for Long-Horizon Motion Generation

    Sep 28, 2026Kunhang Li, Yiyi Cai, Xiangyue Zhang +5Denoising TrajectoryDiffusion Models

  7. BIABench: Evaluating AI agents on real-world bioimage analysis tasks

    Sep 28, 2026Zixuan Pan, Davide Panzeri, Lukas Johanns +5Artificial Intelligence AgentsMicroscopy

  8. FB-GDM: Fully-Bayesian Guided Diffusion Models for High-Dimensional Linear Inverse Problems via Unsupervised Variational Inference

    Sep 24, 2026Gatien Séguy, Thomas RodetBayesian Inverse ProblemsDiffusion Models

  9. A Systematic Evaluation of Infrastructure-Based Radar System for Highway Traffic Monitoring

    Sep 22, 2026Tianheng Zhu, Woei-chyi Chang, Alamss Riaz +2RadarTraffic

  10. Label-Efficient Learning for Ground-Based Sky-Image Classification: A Benchmark of Transfer Learning, Active Learning, and Pseudo-Labeling on GCD

    Sep 22, 2026Esther Bou Dagher, Viktoriya Bu-Dager, Boguslaw ZegarlinskiLabel PropagationGround Truth

  11. FunArt: Decoding Functional Structure and Articulation from Generative 3D Latents

    Sep 17, 2026Dennis Rotondi, Abdelrhman Werby, Kai O. Arras3D Scene GraphsRobotic Perception

  12. Automated Goldsmith's Mark Retrieval in Silverware

    Sep 17, 2026Atmik Tiwari, Vincent Christlein, Mark Fichtner +5Silver BulletFingerprint

  13. Echo: Learning-based Matching Decompilation using Trusted Back Translation

    Sep 16, 2026Jun Bi, Xiangxin Fang, Aarsh Chaube +3DisassemblyMalware

  14. Can VLMs Reliably Assess Sidewalk Accessibility Attributes from Pedestrian-Level Imagery?

    Sep 15, 2026Seung Jae Lieu, Diego Morra, Chiara Cadoni +3Pedestrian DetectionAccessibility

  15. Skill-based Agentic Evaluation for Real-time Data Science Tasks

    Sep 15, 2026Aniruddha Tamhane, Raghavendra Addanki, Ayushi Aggarwal +4Data Science AgentsAgentic Evaluations

  16. Online Material Estimation for Conditioned Diffusion Policy in Shaping Deformable Linear Objects

    Sep 14, 2026Ryunosuke Yamada, Tomohiro Motoda, Yukiyasu Domae +1Deformable Linear ObjectsDiffusion Policies

  17. When Ground-Truth Fidelity Matters: An Orchestrated UAS Framework for Wheat Streak Mosaic Virus Detection Using Vision Transformers and Machine Learning

    Sep 14, 2026Dewi Endah Kharismawati, Sandeep Dhakal, Courtney E. McCusker +3Precision AgricultureSirus

  18. Beyond Dead Reckoning: A Point of View on Camera--DAS--GNSS Continuity in Road Tunnels

    Sep 13, 2026Lyes Saad Saoud, Hesham A. Rakha, Mona Jaber +1Rtk-GnssContinuum

  19. Parameter-Efficient Retrievers for Polish and European Languages

    Sep 11, 2026Sławomir Dadas, Rafał Poświata, Małgorzata Grębowiec +1Retrieval LayerRetrievers

  20. Data-Efficient Crosswalk Segmentation from Overhead CCTV via Confidence- and Geometry-Guided Pseudo-Labeling

    Sep 8, 2026Abdirashid Omar, Jonghyuk ParkChange DetectionPixel-Level Annotation

  21. What Do Scan-Derived Class Prototypes Add? Disentangling Supervision, Prototype Content and Query Protocol in Recognition over Frozen Foundation Features

    Sep 3, 2026Chenxi Tao, Hong-In Won, Seung-Kyum ChoiLearnable PrototypesDinov3

  22. Epistemic Warrant for LLM Recommendations: Characterizing the Basis for Reliance When Ground Truth Is Unavailable

    Sep 3, 2026Shai Vardi, João SedocLarge Language Model ReliabilityEpistemic States

  23. Camera trap classification with deep learning under ground truth uncertainty

    Aug 31, 2026Leonard Hockerts, Peter S. Stewart, Sarthak Arora +1Species IdentificationRoadside Cameras

  24. Where to Look Matters: On-Policy Self-Distillation for Long-Video Understanding

    Aug 26, 2026Kaishen Wang, Dongdi Zhao, Yijun Liang +4Video UnderstandingUnsupervised On-Policy Self-Distillation

  25. A Deep RL based Framework for Targeted White Matter Tractography

    Aug 13, 2026Ankita JoshiGround Truth

  26. Dual-Primal Graph VAEs for Noisy Label Aggregation

    Aug 11, 2026Patrick Stinson, Nikolaus KriegeskorteNoisy LabelsConditional Variational Autoencoder

  27. TRACE: TRajectory Attribution for Automated Context Engineering

    Aug 10, 2026Yikai Zhao, Pradeep Kumar Misra, Saurabh PandeyRemediationGround Truth

  28. Temporal Leakage in LLM Backtesting: Measurement, Validation, and Adjusted Scores

    Aug 4, 2026Zeyu Zhang, Bradly C. StadieMemorizationValidation

  29. Coarse-to-Fine Registration of Jawbone CT and Intraoral Scan Data Using GeDi and ICP with Pseudo-IOS Ground Truth

    Aug 3, 2026Sho Mitarai, Hikaru Kayo, Hisashi Ozaki +2Intraoral ScansImage Registration

  30. PredAct-Bench: Benchmarking Tool-Augmented Dialogue under Controlled Tool Noise

    Aug 3, 2026Abdulrahman AlRabah, Xiaocheng Yang, Dilek Hakkani-Tür +1Agentic BenchmarksGround Truth

  31. Agreement Is Not Quality: Blind Expert Verification of Human and LLM Qualitative Coding When Human Consensus Is Not Ground Truth

    Jul 30, 2026Alex Liu, Lief Esbenshade, Michael Xiao +4Llm-As-A-JudgeQualitative Research

  32. LLMBDC: Language Model for Biological Domains Oriented Clustering of Gene Ontology

    Jul 30, 2026Ximing Ran, Jie Xu, Peng Jin +3Enrichment AnalysisGround Truth

  33. Paying for Honesty Without Knowing the Truth: Reputation-Penalty Design for LLM Marketplace Agents

    Jul 30, 2026Mingdai Yang, Shicheng Fan, Kejing Yu +5HonestyReputation

  34. Embeddings based Anomaly Detection for Cleaning Global Crop Type Reference Datasets

    Jul 27, 2026Syed Roshaan Ali Shah, Kristof Van Tricht, Christina Butsko +2Agricultural MonitoringGraph Anomaly Detection

  35. A Self-Calibrating Agentic AI Framework for Autonomous Edge Resource Allocation

    Jul 24, 2026Fin Gentzen, Marla Grunewald, Iulisloi Zacarias +2Agentic FrameworkLarge Language Model Agents

  36. Staypoint Detection from Noisy Trajectory Data [Experiment Paper]

    Jul 21, 2026Lance Kennedy, Hossein Amiri, Yueyang Liu +9Ground TruthSituational Awareness

  37. Scalable Model-Assisted Multi-Target Estimation in Large Image Collections

    Jul 20, 2026Max Hamilton, Jinlin Lai, Daniel Sheldon +1Multimodal ClassificationGround Truth

  38. Why Low-Light Cameras Go Color Blind: Removing Color Bias in Raw Denoising

    Jul 13, 2026Mohammad Mohammadi, Sina Honari, Stavros Tsogkas +6Low-Light ImagesIterative Denoising Methods

  39. Learning Linear Temporal Specifications from Demonstrations with Uncertainty

    Jul 12, 2026Parastou Fahim, Constantino Lagoa, Rômulo Meira-G'oesLinear Temporal LogicsUncertainty

  40. REFORGE: A Method for Benchmarking LLMs' Reverse Engineering Capabilities in Decompiled Binary Function Naming

    Jul 7, 2026Nicolas Koller, Andreas u. SchmidtReverse EngineeringDisassembly

  41. Interpretable Human-Label-Free Deep Learning for Real-Bogus Classification with Uncertainty Quantification

    Jul 6, 2026Raphaël Bonnet-Guerrini, Bruno Sanchez, Dominique Fouchez +5Ground TruthUncertainty Quantification

  42. SteelBench: Evaluating Vision-Language Models in Real-World Industrial Environments

    Jul 6, 2026Suryanarayana Reddy Yarrabothula, Manisha Chawla, Kunal Sinha +5Open-Vocabulary Action RecognitionIndustrial

  43. MARLIN: De Novo Molecular Structure Elucidation from Tandem Mass Spectra without a Ground-Truth Formula

    Jul 6, 2026Xujun Che, Xiuxia Du, Depeng XuTandem Mass SpectraMolecules

  44. Risk-Constrained Freshness-Aware Semantic Caching for Open-Web Retrieval-Augmented LLMs

    Jul 5, 2026Muhammad Mansoor, Tahir Ahmad, Yeo-Chan YoonGround Truth

  45. Reinforcement Learning without Ground-Truth Solutions can Improve LLMs

    Jun 25, 2026Yingyu Lin, Qiyue Gao, Nikki Lijing Kuang +6Reinforcement Learning With Verifiable RewardGround Truth

  46. How to evaluate clustering with ground truth?

    Jun 25, 2026Pasi FräntiEvaluation MetricsSpearman Correlation

  47. A Synthetic Reliability-Aware PINN Benchmark for Offshore Wind Turbine Support-Structure Monitoring with Bayesian Inverse Identification

    Jun 23, 2026Puneet Kant, Monika TanwarOffshore Wind TurbineParametric Physics-Informed Neural Network