APT: Affine Prototype-Timestamp for Time Series Forecasting Under Distribution Shift
Yujie Li, Zezhi Shao, Chengqing Yu, Yisong Fu, Tao Sun, Yongjun Xu, Fei Wang
Abstract
Time series forecasting under distribution shift remains challenging, as existing deep learning models often rely on local statistical normalization (e.g., mean and variance) that fails to capture global distribution shift. Methods like RevIN and its variants attempt to decouple distribution and pattern but still struggle with missing values, noisy observations, and invalid channel-wise affine transformation. To address these limitations, we propose Affine Prototype-Timestamp(APT), a lightweight and flexible plug-in module that injects global distribution features into the normalization–forecasting pipeline. By leveraging timestamp-conditioned prototype learning, APT dynamically generates affine parameters that modulate both input and output series, enabling the backbone to learn from self-supervised, distribution-aware clustered instances. APT is compatible with arbitrary forecasting backbones and normalization strategies while introducing minimal computational overhead. Extensive experiments across six benchmark datasets and multiple backbone-normalization combinations demonstrate that APT significantly improves forecasting performance under distribution shift.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 60d34709-76b2-4f35-87dd-1d1c6a85c1ddBuilds on18
- Informer: Beyond Efficient Transformer for Long Sequence Time-Series ForecastingHaoyi Zhou, Shanghang Zhang, Jieqi Peng, Shuai Zhang et al.AAAI 2021 · 7,289 citations
- Are Transformers Effective for Time Series Forecasting?Ailing Zeng, Muxi Chen, Lei Zhang, Qiang XuAAAI 2023 · 3,619 citations
- Barlow Twins: Self-Supervised Learning via Redundancy ReductionJure Zbontar, Li Jing, Ishan Misra, Yann LeCun et al.ICML 2021 · 2,942 citations
- VICReg: Variance-Invariance-Covariance Regularization for Self-Supervised LearningAdrien Bardes, Jean Ponce, Yann LeCunICLR 2022 · 1,226 citations
- Reversible Instance Normalization for Accurate Time-Series Forecasting against Distribution ShiftTaesung Kim, Jinhee Kim, Yunwon Tae, Cheonbok Park et al.ICLR 2022 · 1,020 citations
Related papers
- IN-Flow: Instance Normalization Flow for Non-stationary Time Series ForecastingWei Fan, Shun Zheng, Pengyang Wang, Rui Xie et al.KDD 2025 · 2 citations
- Adaptive Normalization for Non-stationary Time Series Forecasting: A Temporal Slice PerspectiveZhiding Liu, Mingyue Cheng, Zhi Li, Zhenya Huang et al.NeurIPS 2023 · 162 citations
- CAST-Norm: Coupled Adaptive Spatio-Temporal Normalization for Multivariate Time Series ForecastingHaihua Xu, Ziyue Peng, Runchang Liang, Pengyang WangKDD 2026 · 2 citations
- TimeEmb: A Lightweight Static-Dynamic Disentanglement Framework for Time Series ForecastingMingyuan Xia, Chunxu Zhang, Zijian Zhang, Hao Miao et al.NeurIPS 2025 · 21 citations
- Online time series prediction using feature adjustmentXiannan Huang, Shuhan Qiu, Jiayuan Du, Chao YangICLR 2026 · 5 citations
