Temporal Reasoning in Language Models

Latest papers 35

All topics
CardsList
  1. Learning Situation-Conditioned Thinking Policies for Long-Term LLM Agents

    Oct 7, 2026Hong SuLLM Agent MemoryLong-Horizon LLM Agents

  2. A rubric landscape for evaluating clinical reasoning in large language models: what exists, what is missing, and what needs to be combined

    Oct 1, 2026Zhangshu Joshua Jiang, Zina Ibrahim, James T. TeoFaithfulness of Language Model ExplanationsTemporal Reasoning in Language Models

  3. OpenTSLM TeeMoE: A Unified Time-Series Language Model for Forecasting, Contextual Prediction, and Reasoning

    Sep 30, 2026Tony Chen, Timo Stoffregen, Maxwell Xu +8Temporal Reasoning in Language ModelsTime Series Forecasting

  4. Reasoning Externalization for Faithful Large Language Model Narratives of Stock Return Predictions

    Sep 30, 2026Sujung Kim, Seung Hwan Cho, Sangjin Park +1Numerical Reasoning in Language ModelsFaithfulness of Language Model Explanations

  5. StateTree: Enhancing Long-Term Dialogue Reasoning via Reinforcement Learning

    Sep 30, 2026Naen Xu, Wanqing Cui, Yibo Hu +5Temporal Reasoning in Language ModelsRL for Language Model Reasoning

  6. Concept-Grounded Attention: A Controlled Evaluation of Graph-Injected Attention, Temporal Versioning, and Epistemic Status

    Sep 30, 2026Sachin Dev Duggal, Pradyumna Swarnalatha Ramanna, Alexandros VassiliadesLLM GroundingTemporal Reasoning in Language Models

  7. PetriBench: Benchmarking LLM Reasoning over Dynamic State Spaces

    Sep 17, 2026Pyrros Koussios, Benjamin Jäger, John Hua Yao +3LLM EvaluationTemporal Reasoning in Language Models

  8. CliniCIRCA: A Modular LLM Framework for Constructing Longitudinal Mental Health Patient Journeys from Raw EHR Narratives

    Sep 17, 2026Aiwei Ivy Zhang, Nimra Ishfaq, Mohit Chandra +5Temporal Reasoning in Language ModelsMental Health

  9. EvolveScaler: Synthesizing Information-Evolution Contexts via Executable State Machines and Natural-Language Rendering

    Sep 8, 2026Ziliang Zhao, Zenan Xu, Shuting Wang +6Long-Context Language Model InferenceTemporal Reasoning in Language Models

  10. CordisBench: Can Language Models Reason About Component Lifecycles in Dynamic Agent Harnesses?

    Sep 1, 2026Damien Sileo, Dimitri KachlerTemporal Reasoning in Language ModelsAI Agent Benchmarks

  11. Synthetic Worlds for Temporal Evaluation and Knowledge Updating in LLMs

    Aug 31, 2026Jonathan Zheng, Zirui Shao, Alan Ritter +1Synthetic Data PretrainingKnowledge Editing

  12. Reconstructing the Right Episode: Evaluating Interleaved Conversational Memory Beyond Long Context

    Aug 26, 2026Zhexi Feng, Ruiyi Zhang, Yongbo Yang +1Conversational MemoryTemporal Reasoning in Language Models

  13. ChronoState: Hidden Elapsed-Time Conditioning for Temporal-State Action Selection in Frozen-Backbone Language Models

    Aug 10, 2026Sam Siavoshian, Omar Ramadan, Amir K. Saeed +3Temporal Reasoning in Language ModelsLanguage Modeling

  14. GeoBenchLLM: A Comprehensive Benchmark for Evaluating LLMs on Geo-Related Tasks

    Aug 7, 2026Rodrigo Ferreira Rodrigues, Karim Radouane, Jose G Moreno +1Spatial Reasoning BenchmarksLLM Evaluation

  15. RUMBA: Russian User Memory Benchmark

    Jul 23, 2026Elizaveta Shevtsova, Inna Glebkina, Mark Baushenko +2Temporal Reasoning in Language ModelsTemporal Reasoning

  16. PRISM Edit: One Vector for All Temporal Answers

    Jul 13, 2026Chen Huang, Qi Zheng, Ruiqin Zheng +2Temporal Reasoning in Language ModelsModel Editing

  17. Forecasting With LLMs: Improved Generalization Through Feature Steering

    Jun 25, 2026Humzah Merchant, Bradford LevyLanguage Model SteeringLLM Interpretability

  18. LibEvoBench: Probing Temporal Knowledge Stratification in Code Generation Models

    Jun 24, 2026Daniele Cipollone, Sergey Titov, Maliheh Izadi +2Software EngineeringTemporal Reasoning in Language Models

  19. From Recognition to Understanding: Unlocking Cognitive Time Series Reasoning with LLMs

    Jun 20, 2026Xin Qiu, Junlong Tong, Yao Zhang +3Time Series ReasoningTime Series QA

  20. Right Knowledge, Wrong Answer: Test-Time Steering for Temporal Fact Conflicts in Open-Weight Language Models

    Jun 18, 2026Elias Hossain, Sourav Saha, Umesh Chandra Biswas +1Knowledge Conflicts in Language ModelsTemporal Reasoning in Language Models

  21. MemTrace: Probing What Final Accuracy Misses in Long-Term Memory

    Jun 15, 2026Xianxuan Long, Zhikai Chen, Shenglai Zeng +3Temporal Reasoning in Language ModelsLLM Agent Memory

  22. DYNA : Dynamic Episodic Memory Networks for Augmenting Large Language Models with Temporal Knowledge Graphs in Continuous Learning

    Jun 14, 2026Ali Sarabadani, Mahtab TajvidiyanContinual Learning for LLMsMemory-Augmented Language Models

  23. Teaching Large Language Models When Not to Know: Learning Temporal Critique for Ex-Ante Reasoning

    May 14, 2026Chenlu Ding, Jiancan Wu, Yanchen Luo +3LLM PromptingLLM Fine-Tuning

  24. Large Language Models Lack Temporal Awareness of Medical Knowledge

    May 13, 2026Zihan Guan, Qiao Jin, Guangzhi Xiong +6HealthcareTemporal Reasoning in Language Models