cs.LGOct 7, 2026

Evaluating Sequence Assembly Strategies for Differentially Private Synthetic Time-Series Forecasting

Authors: Guoxiong Long, Huizhen Huang, Qikun Cai, Tao Huang, Chen Hou

Organizations: School of Computer and Big Data, Minjiang University, No. 200 Xiyuangong Road, Fuzhou, 350108, Fujian, China

Abstract

Differentially private time-series generators commonly produce fixed-length synthetic windows, whereas downstream forecasting models often require long continuous training sequences. How these windows are assembled after generation can therefore alter the effective synthetic data presented to a forecaster, even when the trained generator remains unchanged. We study this post-generation sequence assembly process by systematically varying overlap rates and window-weighting schemes and evaluating the resulting sequences in terms of boundary continuity, statistical and temporal fidelity, and Train-on-Synthetic-Test-on-Real (TSTR) forecasting utility. Across four types of public datasets (ETTh1, ETTm1, Weather, and Appliances) and five forecasting models, the results reveal a clear forecaster-dependent assembly principle: downstream TSTR utility is jointly shaped by the forecaster, overlap rate, and window-weighting scheme, leading to distinct assembly preferences across forecasting models. Increased overlap generally improves boundary continuity, but improvements in continuity or individual fidelity diagnostics do not consistently reduce forecasting error, indicating that these diagnostics alone are insufficient for selecting assembly configurations. Complete five-forecaster assembly grids, together with matched Train-on-Real-Test-on-Real (TRTR) references, further characterize these regularities and quantify assembly-dependent utility relative to real-data training. We then validate the identified principles through additional analyses of robustness and generator variability.

Figures & tables

Appendix figures & tables3 assets

Supplementary material from the paper’s appendix.

Appendix

Explore similar work

CardsList
  1. Benchmarking Time Series Generation Methods for Privacy-Preserving Forecasting

    Aug 11, 2026Luis Amorim, Vitor Cerqueira, Moises Santos +2Synthetic Data GenerationTime Series Forecasting

  2. Mix, Don't Pick: Why Synthetic Corpus Composition Matters for Time Series Foundation Model Pretraining

    Jun 6, 2026Aaryan Nagpal, Debdeep Sanyal, Murari Mandal +2Synthetic Data PretrainingTime Series Forecasting

  3. Does Synthetic Data Help? Empirical Evidence from Deep Learning Time Series Forecasters

    May 7, 2026Hugo Cazaux, Eyjólfur Ingi Ásgeirsson, Hlynur StefánssonSynthetic Data AugmentationSynthetic Data Generation