Empirical Study

Momentum

32 papers in the last four weeks, up 167% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 207

All topics
CardsList
  1. Are Frontier VLM Agents Ready to Be Robot Generalists? An Empirical Study with the Embodied Agent Arena

    Oct 1, 2026Haojian Huang, Pukun Zhao, Zexi Li +7AffordancesEmpirical Study

  2. Can LLMs Reason Over Long Horizons? An Empirical Evaluation of Context Strategies for Longitudinal Clinical Reasoning

    Sep 30, 2026Taye Akinrele, Noorbakhsh Amiri Golilarz, Subash Neupane +2LLM Reasoning StrategiesEfficient Long-Context Inference

  3. An Empirical Study of Architectural Shift from Traditional to AI-Enabled Simulink Controllers

    Sep 29, 2026Hadiza Umar Yusuf, Khouloud GaaloulCyber-Physical SystemRobust Control

  4. An Empirical Study and Assessment of EU AI Act Compliance Checkers

    Sep 28, 2026Zhen Tao, Alize Kahraman, Shidong Pan +4Eu Artificial Intelligence ActCompliance

  5. From Data to Program: Fast & Direct Generative Program Inference from Empirical Data

    Sep 28, 2026Simon Klüttermann, Xueying Ding, Leman AkogluEmpirical StudyAutoregressive Model

  6. EMPIRIC: Experiment-Driven Learning of Residual World Models for Robot Planning

    Sep 28, 2026Yichao Liang, Amber Li, Dat Nguyen +13Scalable Robot LearningRobot Planning

  7. What Makes World Action Models Generalize? An Empirical Study of Test-Time Future Modeling

    Sep 28, 2026Renping Zhou, Zanlin Ni, Zihao Fan +8Latent World ModelsWorld Models

  8. High-Level Text Preprocessing for Semantic Similarity Analysis of Discursive Texts: A Framework and Empirical Demonstration

    Sep 27, 2026Mehmet Murat Albayrakoglu, Mehmet Nafiz AydinDiscoursePreprocessing

  9. Calibration as a First-Class Criterion in LLM Evaluation

    Sep 22, 2026Mario Sanz-Guerrero, Katharina von der WenseLarge Language Model EvaluationOverconfidence

  10. You Only Need 2/3 of the Chosen Experts: An Empirical Study of Dynamic Expert Pruning in Fine-Grained MoE LLMs

    Sep 22, 2026Yuanteng Chen, Qiwei Lai, Chen Tianqi +7Mixture-Of-ExpertsEmpirical Study

  11. What Matters in Designing World Action Models: An Empirical Study

    Sep 21, 2026Chao Tang, Haoqing Wang, Zilang Cen +9Recent World-Action ModelsWorld Models

  12. An Empirical Study of Harness Design for Coding Agents

    Sep 17, 2026Run-Ze Fan, Zihao Zhang, Simin Ma +6Coding AgentsAgent Harness

  13. A Unified Evaluation Framework for Trustworthy Large Language Models, Agentic AI, and Multimodal Systems

    Sep 17, 2026Shaina Raza, Ahmed Y. Radwan, Imran Liaquat +1Trustworthy Artificial IntelligenceLarge Language Model Reliability

  14. An Empirical Evaluation of Cost-Efficient Large Language Models on Algorithmic Programming Tasks

    Sep 16, 2026Chandimal Adikari, Nandika HerathLarge Language Model ReliabilityEmpirical Study

  15. An Empirical Study of Counterfactual Self-Explanations in LLMs

    Sep 15, 2026Giannis Kalyvas, Giorgos Filandrianos, Orfeas Menis Mastromichalakis +2Free-Form Textual RationalesCounterfactual Explanation

  16. Generative models for simulation based filtering: Formulations and Empirical Comparisons

    Sep 14, 2026Mohammad Al-Jarrah, Wei Deng, Bamdad Hosseini +1Bayesian FilteringParticle Filters

  17. Empirical Evaluation of Open-Source Large Language Models for Retrieval-Augmented Generation in ESG Domain

    Sep 14, 2026Motaz Saad, Anna Borrelli, Ivan Gentile +3Large Language Model BenchmarksEmpirical Study

  18. Generative AI Use Cases In Real Estate Marketing: Adoption and Constraints in Germany

    Sep 14, 2026Victor Kolominsky-Rabas, Leopold Müller, Felicia Perpina +1Real Estate DataGenerative Artificial Intelligence

  19. Tuning ROS 2 for Energy-Efficient Navigation: Empirical Insights from Costmap 2D Configurations

    Sep 14, 2026Michel Albonico, Andreas Wortmann, Ivano MalavoltaRobot NavigationRobot Operating System

  20. Is Bash All You Need? An Empirical Study of Tool Interfaces for Enterprise Digital Worker Agents

    Sep 14, 2026Hazel Mak, Susheel Suresh, Sahil Bhatnagar +3Computer-Use AgentsEmpirical Study

  21. Empirical Evaluation of Data Poisoning Attacks in Supervised Learning

    Sep 10, 2026Toshif Khan, Muhammad AbusaqerPoisoningTraining Data

  22. Empirical Evaluation of Membership Inference Attacks on NLP Text Classifiers: A Baseline Study on SST-2

    Sep 10, 2026William Novak, Muhammad AbusaqerMembership Inference AttacksLarge Language Model Classification

  23. Scored vs. Generated Readouts in Behavioral Language Models: An Empirical Study of Elicitation Format

    Sep 9, 2026Touchapon Kraisingkorn, Krittin Pachtrachai, Wachiravit ModecruaFree-Form Textual RationalesReadout

  24. Beliefs and Behavior in Language Models

    Sep 7, 2026Alex Smolin, Bryan WilderLLM Reasoning StrategiesBehavioral Foundation Models

  25. The Accuracy Paradox: Empirical Diagnostic of Default Decision Thresholds in Multi-Label Enzyme Commission Prediction [With Code]

    Sep 7, 2026Bilal Ahmad, Rajed MehmoodMulti-Label ClassificationDecision Thresholds

  26. Bag of Tricks or Bag of Myths? Reducing Modeling Complexity with Task Knowledge in Explainable Suicide Risk Assessment

    Sep 7, 2026Shlok Shelat, Shrey Salvi, Souvik Roy +2Suicide RiskRisk Stratification

  27. FaVOR: LLM-Based Agentic Framework for Factor Mining via Empirical Validation

    Aug 31, 2026Hyeonjin Kim, Minseok Kim, Seunghyeon Jung +3Exploratory Factor AnalysisFactor

  28. What is Missing from AI Post-Training AI: An Empirical Analysis

    Aug 19, 2026Joy Jia Yin Lim, Xin Huang, Hao Peng +5Large Language Model AgentsPost-Training

  29. Agent Skills Can Be Harmful: An Empirical Study of Skill-Induced Failures in LLM Agents

    Aug 12, 2026Gen Dong, Yanjie Gao, Liqun Li +3Large Language Model AgentsTask Success Rate

  30. Uncertainty-Aware Deep Learning for Genomics Applications: Insights from an Empirical Study

    Aug 11, 2026Sepideh Saran, Mahsa Ghanbari, Uwe OhlerGenome-Wide Association StudyUncertainty-Aware Classification

  31. Conversational versus Dashboard Explainable AI for UAV Intrusion Detection: An Empirical Study of Operator Trust and Reliance

    Aug 11, 2026Cong Chi Nguyen, Trang Mai Xuan, Vu-Duc Ngo +3Drone DetectionUnmanned Aerial Vehicle Detection

  32. What We Know about Responsible AI Practices in Industry: A Half Decade of Empirical Research

    Aug 11, 2026Wesley Hanwen Deng, Agathe Balayn, Andrew Selbst +6Organizational ResearchEmpirical Study

  33. The Deliberative Deficit: An Empirical Critique of LLMs in Democratic Discourse

    Aug 10, 2026Maurice FlechtnerDeliberationLarge Language Model Decisions

  34. Hoverflie: An empirical investigation of rotor shrouds to transform micro air vehicles into multi-modal hovercraft

    Aug 7, 2026Mrinmoy Modak, Daniel S. DrewRotorcraftAutonomous Drones

  35. Optimal Neural Network Approximation via Empirical Least Squares with Deterministic Samples

    Aug 7, 2026Xinliang Liu, Tong Mao, Jinchao XuNeural ApproximationsSpectral Representation Method

  36. When Memory Lies: An Empirical Study of Spatial Memory Staleness in VLM Agents

    Aug 5, 2026Yushi Sun, Yanjie ZhangWeak Visual GroundingEmpirical Study

  37. SciRet: A Compute-Aware Empirical Study of Retrieval and Reranking for Scientific RAG

    Aug 4, 2026Kaysarul Anas Apurba, Md. Hasibul Hasan, Rofiqul Alam Shehab +1Scientific DiscoveryReranking

  38. LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs

    Aug 4, 2026Forough Majidi, Mohammad Mehdi Morovati, Foutse Khomh +1Large Language Model ServingAi-Based

  39. AI-Based Thesis Assessment: An Empirical Study of Human Evaluation Priorities and Their Impact on Automated Assessment

    Aug 1, 2026Garv Vikram Gursahaney, Baskhad Idrisov, Thorsten Fröhlich +1Peer ReviewArtificial Intelligence Evaluation

  40. Where Does Generative Difficulty Reside? An Empirical Study of Target Representations

    Aug 1, 2026Marcel Plocher, Bernhard Schölkopf, Andreas Geiger +1Star-VaeImage Generation

  41. An Empirical Study of Coordination Mode as the First-Class Citizen in From-Scratch Multi-Agent Coding

    Jul 30, 2026Yanyu Ren, Yunfeng Bai, Xizheng Wang +2Multi-Agent CommunicationCoordination

  42. AI and Its Impact on Creativity and Diversity: An Empirical Study of LLM-Generated Product Ideas

    Jul 30, 2026Christian Terwiesch, Lennart Meincke, Karan Girotra +3Scientific IdeationCreativity

  43. Empirical investigation of 3D CT Foundation Models and Unsupervised Adaptation for Head and Neck Cancer Recurrence Prediction

    Jul 29, 2026Bilel Guetarni, Feryal Windal, David Pasquier +1Radiomics3D Foundation Models

  44. Empirical Evaluation of Out-Of-Distribution Performance of Tabular Foundation Models

    Jul 28, 2026Malena Loza, David Chushig-Muzo, Eva Milara +3Tabular Foundation ModelsTabpfn

  45. An Empirical Study of Feature Selection Granularity

    Jul 27, 2026Muhammad Rajabinasab, Arthur ZimekFeature SelectionFeature Importance