Causal Reasoning in Language Models

Latest papers 57

All topics
CardsList
  1. From Prompts to Tokens: Internalizing Causal Supervision in Vision-Language Model for Multi-Image Causal Reasoning

    Jun 10, 2026Haoping Yu, Yuanxi Li, Jing MaVisual ReasoningCausal Structure Learning

  2. LLM Explainability with Counterfactual Chains and Causal Graphs

    Jun 4, 2026Nirit Nussbaum-Hoffer, Nitay Calderon, Liat Ein-Dor +1LLM Reasoning with GraphsLLM Interpretability

  3. Multi-component Causal Tracing in Large Language Models

    Jun 2, 2026Zirui Yan, Dennis Wei, Dmitriy A. Katz +2LLM InterpretabilityCausal Reasoning in Language Models

  4. The Paradox of Outcome Optimization: A Causal Information-Theoretic Bound on Reasoning Shortcuts in LLMs

    May 30, 2026Zihan Chen, Yiming Zhang, Wenxiang Geng +2Process Reward ModelsRL for Language Model Reasoning

  5. Causal Interventions on Continuous Variables: A Case Study on Verb Bias in Steering Vectors for In-Context Learning

    May 28, 2026Zhenghao Herbert Zhou, R. Thomas McCoy, Robert FrankLanguage Model SteeringCausal Reasoning in Language Models

  6. The Abstraction Gap in Vision-Language Causal Reasoning

    May 27, 2026Chinh Hoang, Mohammad Rashedul HasanVLM EvaluationCausal Reasoning in Language Models

  7. Why LLMs Fail at Causal Discovery and How Interventional Agents Escape

    May 26, 2026Amartya Roy, Sonali ParbhooCausal DiscoveryCausal Reasoning in Language Models

  8. CausaLab: A Scalable Environment for Interactive Causal Discovery Toward AI Scientists

    May 25, 2026Junlin Yang, Dylan Zhang, Xiangchen Song +7Structural Causal ModelsLLM Agent Evaluation

  9. Causal Tongue-Tie: LLMs Can Encode Causal Direction, But Their Yes/No Outputs Fail to Express

    May 25, 2026Ziyi Ding, Xiao-Ping ZhangLLM EvaluationCausal Reasoning in Language Models

  10. Towards a Universal Causal Reasoner

    May 24, 2026Qirun Dai, Xiao Liu, Jiawei Zhang +3Causal Reasoning in Language ModelsCausal Reasoning

  11. MixRea: Benchmarking Explicit-Implicit Reasoning in Large Language Models

    May 19, 2026Yuanqing Cai, Ziyi Huang, Minhao Liu +3LLM EvaluationLLM Prompting

  12. CasualSynth: Generating Structurally Sound Synthetic Data

    May 17, 2026Zehua Cheng, Wei Dai, Jiahao Sun +1Structural Causal ModelsSynthetic Data Generation

  13. Why We Need World Models for AGI: Where LLMs Fail and How World Models May Outperform

    May 13, 2026Feisal Alaswad, Batoul Aljaddouh, Maher Alrahhal +2Latent Dynamics ModelingLong-Horizon Agent Evaluation

  14. CommonWhy: A Dataset for Evaluating Entity-Based Causal Commonsense Reasoning in Large Language Models

    May 13, 2026Armin Toroghi, Faeze Moradi Kalarde, Scott SannerAbductive ReasoningCausal Reasoning in Language Models

  15. PROMETHEUS: Automating Deep Causal Research Integrating Text, Data and Models

    May 13, 2026Sridhar MahadevanCausal World ModelsCausal Attribution

  16. CauSim: Scaling Causal Reasoning with Increasingly Complex Causal Simulators

    May 9, 2026Nicolás Astorga, Anita Kriz, Mihaela van der SchaarStructural Causal ModelsKnowledge Augmentation for Language Models

  17. SERE: Structural Example Retrieval for Enhancing LLMs in Event Causality Identification

    May 5, 2026Zhifeng Hao, Zhongjie Chen, Junhao Lu +5Causal Reasoning in Language ModelsCausal Reasoning

  18. Grounding Before Generalizing: How AI Differs from Humans in Causal Transfer

    Apr 27, 2026Liangru Xiang, Yuxi Ma, Zhihao Cao +2LLM GroundingCausal Structure Learning

  19. DeepImagine: Learning Biomedical Reasoning via Successive Counterfactual Imagining

    Apr 24, 2026Youze Zheng, Jianyou Wang, Yuhan Chen +8LLM Fine-TuningCounterfactual Reasoning in Language Models

  20. Implicit Causal Graph Construction in Text via Chain Discovery

    Apr 20, 2026Liesbeth Allein, Marie-Francine MoensCausal DiscoveryCausal Reasoning in Language Models

  21. CausalDetox: Causal Head Selection and Intervention for Language Model Detoxification

    Apr 16, 2026Yian Wang, Yuen Chen, Agam Goyal +1Causal Reasoning in Language ModelsLLM Safety

  22. CausalFlip: A Benchmark for LLM Causal Judgment Beyond Semantic Matching

    Feb 23, 2026Yuzhe Wang, Yaochen Zhu, Jundong LiLLM EvaluationCausal Reasoning in Language Models

  23. CausalBN-Bench: A Comprehensive Benchmark for Causal Learning Capability of LLMs

    Apr 9, 2024Yu Zhou, Xingyu Wu, Jibin Wu +2LLM EvaluationCausal Discovery