SutraNets: Sub-series Autoregressive Networks for Long-Sequence, Probabilistic Forecasting
Shane Bergsma, Timothy Zeyl, Lei Guo
Abstract
We propose SutraNets, a novel method for neural probabilistic forecasting of long-sequence time series. SutraNets use an autoregressive generative model to factorize the likelihood of long sequences into products of conditional probabilities. When generating long sequences, most autoregressive approaches suffer from harmful error accumulation, as well as challenges in modeling long-distance dependencies. SutraNets treat long, univariate prediction as multivariate prediction over lower-frequency sub-series. Autoregression proceeds across time and across sub-series in order to ensure coherent multivariate (and, hence, high-frequency univariate) outputs. Since sub-series can be generated using fewer steps, SutraNets effectively reduce error accumulation and signal path distances. We find SutraNets to significantly improve forecasting accuracy over competitive alternatives on six real-world datasets, including when we vary the number of sub-series and scale up the depth and width of the underlying sequence models.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 4add0849-63cd-4f1c-bcb6-c15fd3df5db0Cited by top-tier papers3
- CycleNet: Enhancing Time Series Forecasting through Modeling Periodic PatternsShengsheng Lin, Weiwei Lin, Xinyi Hu, Wentai Wu et al.NeurIPS 2024 · 213 citations
- xLSTM-Mixer: Multivariate Time Series Forecasting by Mixing via Scalar MemoriesMaurice Kraus, Felix Divo, Devendra Singh Dhami, Kristian KerstingNeurIPS 2025 · 27 citations
- Enhancing Multivariate Time Series Forecasting with Global Temporal RetrievalFanpu Cao, Lu Dai, Jindong Han, Hui XiongICLR 2026 · 7 citations
Builds on20
- Language Models are Few-Shot LearnersTom B. Brown, Benjamin Mann, Nick Ryder, Melanie Subbiah et al.NeurIPS 2020 · 64,255 citations
- Training language models to follow instructions with human feedbackLong Ouyang, Jeffrey Wu, Xu Jiang, Diogo Almeida et al.NeurIPS 2022 · 24,707 citations
- Informer: Beyond Efficient Transformer for Long Sequence Time-Series ForecastingHaoyi Zhou, Shanghang Zhang, Jieqi Peng, Shuai Zhang et al.AAAI 2021 · 7,289 citations
- Autoformer: Decomposition Transformers with Auto-Correlation for Long-Term Series ForecastingHaixu Wu, Jiehui Xu, Jianmin Wang, Mingsheng LongNeurIPS 2021 · 5,824 citations
- FEDformer: Frequency Enhanced Decomposed Transformer for Long-term Series ForecastingTian Zhou, Ziqing Ma, Qingsong Wen, Xue Wang et al.ICML 2022 · 2,912 citations
Related papers
- Probabilistic Transformer For Time Series AnalysisBinh Tang, David S. MattesonNeurIPS 2021 · 150 citations
- HN-MVTS: HyperNetwork-based Multivariate Time Series ForecastingAndrey V. Savchenko, Oleg KachanAAAI 2026
- Synergetic Learning of Heterogeneous Temporal Sequences for Multi-Horizon Probabilistic ForecastingLongyuan Li, Jihai Zhang, Junchi Yan, Yaohui Jin et al.AAAI 2021 · 20 citations
- Adversarial Sparse Transformer for Time Series ForecastingSifan Wu, Xi Xiao, Qianggang Ding, Peilin Zhao et al.NeurIPS 2020 · 264 citations
- C2FAR: Coarse-to-Fine Autoregressive Networks for Precise Probabilistic ForecastingShane Bergsma, Timothy Zeyl, Javad Rahimipour Anaraki, Lei GuoNeurIPS 2022 · 20 citations
