Physical Plausibility

Momentum

9 papers in the last four weeks, up 29% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 63

All topics
CardsList
  1. Evaluating Physical Consistency and Plausibility in Generative Scenario Models for Autonomous Driving

    Oct 1, 2026Manasa Mariam Mammen, Zafer Kayatas, Stefan WagnerScenario GenerationAutonomous Driving

  2. PhysicsLENS: Diagnosing Physical Property Blindness in Video Generation Models

    Oct 1, 2026Isaiah Milkey, Som Sagar, Aditya Taparia +3Physical PlausibilityGenerative Video Models

  3. Ego2Act: Evaluating Goal-Directed Manipulation in Egocentric Video Generation

    Oct 1, 2026Patrick Amadeus Irawan, Iskandar Muda Rizky Parlambang, Rava Maulana +10Egocentric VideoVideo Generation

  4. MindWorldBench: Evaluating Mental-State-to-Behavior Reasoning in Image-to-Video Generation

    Sep 30, 2026Ruiqi Li, Xuanyi Liu, Sijia Li +9Camera-Conditioned Video GenerationPhysical Plausibility

  5. CRJudgeBench: Can AI Detect Plausible but Invalid Code Reviews?

    Sep 29, 2026Yue Pan, Jiawei Li, Ziyuan Zhang +2Code QualityRaw Judge Outputs

  6. Achieve What You Imagined: Learning to Align Actions with Visual Plans

    Sep 27, 2026Yuheng Qiao, Ziran Wei, Xiaohan Wang +5Contact-Rich Dexterous ManipulationAction Expert

  7. Know-Your-Scene (KYS)-SLAM: Hierarchical Semantic-Motion Priors for Feature Matching in Stereo Visual SLAM

    Sep 23, 2026Preeti Chatterjee, Jin Lu, Jin Sun +1Orb-Slam2Simultaneous Localization And Mapping

  8. World Models for Embodied Intelligence: From Plausible to Controllable to Actionable

    Sep 15, 2026Nanjie Yao, Hao Wang, Chong Cheng +10Embodied Artificial IntelligenceWorld Models

  9. IMPLY: Physically Anchored Consistency for World-Model Rollouts

    Sep 14, 2026Aman Mehta, Riya BaviskarSelf-ConsistencyWorld Models

  10. Principia: Relational Physics Tests for Video Models

    Sep 3, 2026Varun Varma Thozhiyoor, Shivam Tripathi, Venkatesh Babu Radhakrishnan +1Generative Video ModelsPhysics-Aware Models

  11. Common-Witness Certificates and Sharp Feature Bounds for Counterfactual Image Auditing

    Sep 3, 2026Usef Faghihi, Amir SakiWitnessesFinite-Sample Certificates

  12. GPS-Bench: A Governance Policy Benchmark for Automating Policy Analysis

    Sep 3, 2026Linh Le, Melanie Bui, My Chiffon Nguyen +2Policy EvaluationMulti-Agent Simulations

  13. VeriPhy: Agentic Physical Reasoning for World Model Evaluation and Refinement

    Sep 2, 2026Wenzhuo Xu, Yuchen Zhu, Chongjian Ge +8Physical PlausibilityGeneration Provenance

  14. Autonomous discovery of new structure-plausibility laws for explainable and rapid crystal diagnosis and screening

    Sep 1, 2026Zhilong Song, Lixue ChengCrystal Structure PredictionScreening

  15. Physically Plausible Video Generation via Visual-Semantic Chain-of-Events Conditioning

    Sep 1, 2026Zixuan Wang, Yixin Hu, Wen Li +4Camera-Conditioned Video GenerationLong Video Generation

  16. PAWBench: How Far Are We from Probabilistically Aligned World Modeling?

    Aug 27, 2026Yuandong Pu, Le Zhuo, Sayak Paul +11Generative Video ModelsPhysical Plausibility

  17. STRIVE: Probing Reasoning Limits in Graded Plausibility Generation and Evaluation

    Aug 5, 2026Bhiman Kumar Baghel, Anna Chrabaszcz, Tessa Warren +3Physical PlausibilityReasoning Skills

  18. Agents Catching Agents: Shortcut Cascades and Benchmark Gaming in Clinical Multi-Agent Systems

    Aug 4, 2026Sebastián Andrés Cajas Ordóñez, Agastya Munnangi, Aldo Marzullo +13Clinical Decision SupportClinical

  19. Beyond Epistemia: Epistemic Schizologia and Large Language Models as Techno-Semiotic Machines

    Jul 28, 2026Federico Cabitza, Gianluca ColomboEpistemic AsymmetryLinguistics

  20. Physics-Informed CNN-LSTM for Street-Scale Urban Flood Prediction: Reconciling Aggregate Accuracy and Street-Level Plausibility

    Jul 27, 2026Luc DCosta, Yidi Wang, Jonathan L. Goodall +1Accurate Flood PredictionSen1Floods11

  21. A Multi-Dimensional Evaluation of Explainability in Media Bias Detection

    Jul 22, 2026Ting Chen, Raina Zhang, Benjamin M. Ampel +1ExplainabilityMulti-Dimensional Evaluation

  22. Data-Poisoning Audits for Causal Effect Estimation

    Jul 22, 2026Kwangho KimCausal InferencesModel Auditing

  23. Apple-ππ: Benchmarking Thinking with Video Towards Law-Grounded Physical Intelligence

    Jul 17, 2026Runmao Yao, Kairui Hu, Yukang Cao +11Generative Video ModelsPhysical Plausibility

  24. From Plausible to Actionable: A Position on LLM Self-Explanations

    Jul 17, 2026Elize Herrewijnen, Benedetta Muscato, Gizem Gezici +1Explainable Artificial IntelligenceExplainable AI Methods

  25. Plausible Deniability Guarantees for Whistleblowers

    Jul 15, 2026Leo Richter, Matt J. KusnerΔ)$-Differential PrivacyModel Auditing

  26. PhysMRV: Physical Memory Retrieval and Verification for Physics Plausibility Reasoning

    Jul 11, 2026Wenyuan Wang, Lianyu Hu, Hao Wang +1Physical PlausibilityVideo-Language Models

  27. Alignment Plausibility: A New Standard for Assuring AI in Healthcare

    Jul 8, 2026Gwydion Williams, Sara Zannone, Bilal A MateenHealthcareClinical

  28. Geometric Collapse: When Vision Models Fail to Verify Physical Causality

    Jul 8, 2026Wentao Zhang, Jinhu Qi, Weiqiang Jin +3Object-Centric CuesVision Foundation Models

  29. URSA: Chemistry-Aware Benchmark for Utilitarian Retrosynthesis Assessment

    Jul 6, 2026Bogdan Zagribelnyy, Ivan Ilin, Nikita Bondarev +7ChemistryDrug Discovery

  30. Belief Contraction in Dynamic Epistemic Logic

    Jun 30, 2026Gaia Belardinelli, Snow ZhangDynamic Epistemic LogicLogic

  31. Accelerated Likelihood Maximization for Diffusion-based Versatile Content Generation

    Jun 30, 2026Hyunsoo Lee, Inwoo Hwang, Young Min KimDiffusion ModelsNovel Modular Learning Framework

  32. TempAct: Advancing Temporal Plausibility in Autoregressive Video Generation via Planner-Executor RL

    Jun 26, 2026Jing Wang, Xiangxin Zhou, Jiajun Liang +5Autoregressive Video GenerationAutoregressive Diffusion

  33. Physics Question Scene Graph: Fine-grained Evaluation of Physical Plausibility in Text-to-Video Generation

    Jun 24, 2026Atin Pothiraj, Jaemin Cho, Yue Zhang +2Generative Video ModelsPhysical Plausibility

  34. GEOPHYS: The Geometry of Physical Plausibility

    Jun 15, 2026Christian Internò, Alexander Pondaven, Habon Issa +8Physical PlausibilityPhysics-Aware Models

  35. How Should World Models Be Evaluated for Embodied Decision-Making? A Decision-Making-Centric Position

    Jun 13, 2026Yang Yu, Shiyuan Zhang, Yifei Sheng +2World ModelsEmbodied Artificial Intelligence

  36. UnpredictaBench: A Benchmark for Evaluating Distributional Randomness in LLMs

    Jun 4, 2026Amirhossein Abaskohi, Amirhossein Dabiriaghdam, Liang Luo +4Distributional InformationUser Simulation

  37. The Invisible Hand of Physics: When Video Diffusion Models Know More Than They Show

    Jun 3, 2026Parsa Esmati, Somjit Nath, Katja Hofmann +3Video Diffusion ModelsDiffusion Transformers

  38. NoRA: Evaluating Grounded Reasonableness in Visual First-person Normative Action Reasoning

    Jun 3, 2026Sichao Li, Sai Ma, Daniel Kilov +3Social NormsPhysical Plausibility

  39. Synthetic Hallucinations, Real Gains: Hard Negatives from Frontier Models for FIM Hallucination Mitigation

    Jun 2, 2026Mahdi Erfanian, Nelson Daniel Troncoso, Aashna Garg +4Large Language Model HallucinationCode Completion

  40. Plausibility Is Not Prediction: Contrastive Evidence for LLM-Based Cellular Perturbation Reasoning

    May 31, 2026Xinyu Yuan, Xixian Liu, Jianan Zhao +3Single-Cell Perturbation PredictionTranscriptomics

  41. YoCausal: How Far is Video Generation from World Model? A Causality Perspective

    May 28, 2026You-Zhe Xie, Yu-Hsuan Li, Jie-Ying Lee +3Video Diffusion ModelsCausal Reasoning

  42. Proprio: Latent Self-Scoring and Inference-Time Refinement for Physically Plausible Video Generation

    May 27, 2026Mariam Hassan, Kaouther Messaoud, Wuyang Li +1Generative Video ModelsPhysical Plausibility

  43. FlyRoute: Self-Evolving Agent Profiling via Data Flywheel for Adaptive Task Routing

    May 21, 2026Rongjun Li, Ziyu Zhou, Yihang WuSelf-Evolving AgentsProfiling

  44. Lost in Interpretation: The Plausibility-Faithfulness Trade-off in Cross-Lingual Explanations

    May 19, 2026Somnath Banerjee, Pranav Jha, Rima Hazra +1Explainable AI MethodsCross-Lingual Consistency

  45. Counterfactual Explanations Under Concept Drift

    May 17, 2026Marcin Kostrzewa, Jerzy Stefanowski, Maciej ZiębaCounterfactual ExplanationExplainable AI Methods

  46. Mechanism Plausibility in Generative Agent-Based Modeling

    May 12, 2026Patrick Zhao, David Huu Pham, Nicholas VincentAgent-Based ModelPhysical Plausibility

  47. Question Difficulty Estimation for Large Language Models via Answer Plausibility Scoring

    May 12, 2026Jamshid Mozafari, Bhawna Piryani, Adam JatowtPhysical Plausibility

  48. PhyGround: Benchmarking Physical Reasoning in Generative World Models

    May 11, 2026Juyi Lin, Arash Akbari, Yumei He +13Generative Video ModelsLong-Video Benchmarks

  49. Structural Ranking of the Cognitive Plausibility of Computational Models of Analogy and Metaphors with the Minimal Cognitive Grid

    May 2, 2026Alessio Donvito, Antonio LietoCognitive ScienceAnalogy

  50. BRITE: A Benchmark for Reliable and Interpretable T2V Evaluation on Implausible Scenarios

    Apr 24, 2026Advait Tilak, Jiwon Choi, Nazifa Mouli +1Text-To-Video Generation ModelAudio-Visual Consistency

  51. HumanScore: Benchmarking Human Motions in Generated Videos

    Apr 22, 2026Yusu Fang, Tiange Xiang, Tian Tan +4Generative Video ModelsHuman Motion Generation

  52. Plausible Reasoning and First-Order Plausible Logic

    Apr 21, 2026David BillingtonFirst-Order LogicLogic

  53. SwanNLP at SemEval-2026 Task 5: An LLM-based Framework for Plausibility Scoring in Narrative Word Sense Disambiguation

    Apr 17, 2026Deshan Sumanathilaka, Nicholas Micallef, Julian Hough +1Natural Language ProcessingDisambiguation