Temporal Data Leakage

Momentum

2 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 19

All topics
CardsList
  1. Temporal Leakage in LLM Backtesting: Measurement, Validation, and Adjusted Scores

    Aug 4, 2026Zeyu Zhang, Bradly C. StadieLLM EvaluationLLM Auditing

  2. Distilling Temporal Search and Reasoning: Evolving LLMs for Future Prediction via Harness-Assisted Efficient Data Synthesis

    Jul 28, 2026Wanxu Cai, Zhengyu Chen, Huaisheng Zhu +3Data LeakageTemporal Reasoning

  3. Fenced Citation-Context Retrieval for Case Law: Temporal Leakage and Degree Control Across Two Jurisdictions

    Jul 19, 2026Yao Liu, Tien-Ping Tan, Zhilan LiuData LeakageLegal IR

  4. Hindcast: Replaying Prediction Markets to Evaluate LLM Forecasters

    Jul 15, 2026Xiao Ye, Jacob Dineen, Evan Zhu +3LLM EvaluationForecasting Benchmarks

  5. Pitfalls of Administrative Censoring in Survival Models with Time-Indexed Inputs

    Jul 11, 2026Yanqi Xu, Hui Dai, Carlos Fernandez-Granda +2Data LeakageSurvival Analysis

  6. MACROCAST: A Vintage-Consistent Time Series Foundation Model for Real-Time Macroeconomic Forecasting

    Jun 27, 2026Andrea Carriero, Davide Pettenuzzo, Shubhranshu ShekharData LeakageTime Series Forecasting

  7. WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning

    Jun 10, 2026Yizhou Chi, Eric Chamoun, Zifeng Ding +1Event Time PredictionLLM Agent Evaluation

  8. NumLeak: Public Numeric Benchmarks as Latent Labels in Foundation Models

    May 28, 2026Anany KotawalaData LeakageLLM Evaluation

  9. When Can We Trust Early Warnings? Leakage-Excluded Early Outcome Prediction from LMS Interaction Logs

    May 25, 2026Ngoc Luyen Le, Marie-Hélène Abel, Bertrand LaforgeData LeakageAI in Education

  10. Teaching Large Language Models When Not to Know: Learning Temporal Critique for Ex-Ante Reasoning

    May 14, 2026Chenlu Ding, Jiancan Wu, Yanchen Luo +3LLM PromptingLLM Fine-Tuning

  11. TEMPO: Temporal Enforcement via Mode-Separated Policy Optimization for Trustworthy LLM Backtesting

    May 13, 2026Zeyu Zhang, Bradly C. StadieLLM EvaluationRL for Language Model Reasoning

  12. Scaling Point-in-Time Language Models

    Apr 24, 2026Bryan Kelly, Semyon Malamud, Johannes Schwab +1Decoder-Only Language ModelsTemporal Data Leakage

  13. From Leakage to Fidelity: Reliable Benchmarking for Temporal Cascade Prediction

    Oct 29, 2025Jie Peng, Rui Wang, Qiang Wang +4Forecasting BenchmarksTemporal Data Leakage