FreqMAE: Frequency-Aware Masked Autoencoder for Multi-Modal IoT Sensing
Denizhan Kara, Tomoyoshi Kimura, Shengzhong Liu, Jinyang Li, Dongxin Liu, Tianshi Wang, Ruijie Wang, Yizhuo Chen, Yigong Hu, Tarek F. Abdelzaher
摘要
This paper presents FreqMAE, a novel self-supervised learning framework that synergizes masked autoencoding (MAE) with physicsinformed insights to capture feature patterns in multi-modal IoT sensor data. FreqMAE enhances latent space representation of sensor data, reducing reliance on data labeling and improving accuracy for AI tasks. Differing from data augmentation-based methods like contrastive learning, FreqMAE's approach eliminates the need for handcrafted transformations. Adapting MAE for IoT sensing signals, we present three contributions from frequency domain insights: First, a Temporal-Shifting Transformer (TS-T) encoder that enables temporal interactions while distinguishing different frequency bands; Second, a factorized multi-modal fusion mechanism for leveraging cross-modal correlations and preserving unique modality features; Third, a hierarchically weighted loss function that emphasizes important frequency components and high Signalto-Noise Ratio (SNR) samples. Comprehensive evaluations on two sensing applications validate FreqMAE's proficiency in reducing labeling needs and enhancing resilience against domain shifts. CCS CONCEPTS • Computing methodologies → Artificial intelligence.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper4
- Fine-grained Control of Generative Data Augmentation in IoT SensingTianshi Wang, Qikai Yang, Ruijie Wang, Dachun Sun 等NeurIPS 2024 · 被引用 13 次
- Learning Disentangled Representation for Multi-Modal Time-Series Sensing SignalsRuichu Cai, Zhifan Jiang, Kaitao Zheng, Zijian Li 等WWW 2025 · 被引用 8 次
- AdaTS: Learning Adaptive Time Series Representations via Dynamic Soft ContrastsDenizhan Kara, Tomoyoshi Kimura, Jinyang Li, Bowen He 等NeurIPS 2025 · 被引用 3 次
- InfoMAE: Pair-Efficient Cross-Modal Alignment for Multimodal Time-Series Sensing SignalsTomoyoshi Kimura, Xinlin Li, Osama A. Hanna, Yatong Chen 等WWW 2025 · 被引用 3 次
它引用的顶会 Paper16
- Swin Transformer: Hierarchical Vision Transformer using Shifted WindowsZe Liu, Yutong Lin, Yue Cao, Han Hu 等ICCV 2021 · 被引用 31,683 次
- A Simple Framework for Contrastive Learning of Visual RepresentationsTing Chen, Simon Kornblith, Mohammad Norouzi, Geoffrey E. HintonICML 2020 · 被引用 24,064 次
- Bootstrap Your Own Latent - A New Approach to Self-Supervised LearningJean-Bastien Grill, Florian Strub, Florent Altché, Corentin Tallec 等NeurIPS 2020 · 被引用 9,171 次
- BEiT: BERT Pre-Training of Image TransformersHangbo Bao, Li Dong, Songhao Piao, Furu WeiICLR 2022 · 被引用 3,632 次
- SimMIM: a Simple Framework for Masked Image ModelingZhenda Xie, Zheng Zhang, Yue Cao, Yutong Lin 等CVPR 2022 · 被引用 1,129 次
相关 Paper
- Temporal-Frequency Masked Autoencoders for Time Series Anomaly DetectionYuchen Fang, Jiandong Xie, Yan Zhao, Lu Chen 等ICDE 2024 · 被引用 45 次
- Modality-Agnostic Self-Supervised Learning with Meta-Learned Masked Auto-EncoderHuiwon Jang, Jihoon Tack, Daewon Choi, Jongheon Jeong 等NeurIPS 2023 · 被引用 9 次
- TS-MTM: Temporal-Spectral Masked Time-Series Modeling for ForecastingPengcheng Zhang, Xiaocao Ouyang, Xin Li, Fan Yang 等KDD 2026
- FAT: Frequency-Aware Pretraining for Enhanced Time-Series Representation LearningRui Cheng, Xiangfei Jia, Qing Li, Rong Xing 等KDD 2025 · 被引用 2 次
- OpenMAE: Efficient Masked Autoencoder for Vibration Sensing with Open-domain Data EnrichmentChenzhi Hu, Yatong Chen, Denizhan Kara, Shengzhong Liu 等UbiComp 2025 · 被引用 4 次
