OmniZip: Learning a Unified and Lightweight Lossless Compressor for Multi-Modal Data
Yan Zhao, Zhengxue Cheng, Junxuan Zhang, Dajiang Zhou, Qunshan Gu, Qi Wang, Li Song
Abstract
Lossless compression is essential for efficient data storage and transmission. Although learning-based lossless compressors achieve strong results, most of them are designed for a single modality, leading to redundant compressor deployments in multi-modal settings. Designing a unified multi-modal compressor is critical yet challenging, as different data types vary largely in format, dimension, and statistics. Multi-modal large language models offer a promising resolution but remain too complex for practical use. Thus, we propose OmniZip, a unified and lightweight lossless compressor for multi-modal data (like image, text, speech, tactile, database, and gene sequence). Built on a lightweight backbone, OmniZip incorporates three key components to enable efficient multi-modal lossless compression: a modality-unified tokenizer that reversibly transforms diverse data into tokens, a modality-routing context learning mechanism that enables flexible multi-modal context modeling, and a modality-routing feedforward design that further enhances the model's nonlinear representation flexibility. A reparameterization training strategy is used to enhance model capacity. OmniZip outperforms or matches other state-of-the-art compressors on multiple modalities, achieving 42%, 57%, 62% and 42%, 53% higher compression efficiency than gzip on CLIC-M, TouchandGo, enwik9, LibriSpeech, and WikiSQL datasets, respectively. It also supports near real-time inference on resource-constrained edge devices, reaching about 1MB/s on MacBook CPUs and iPhone NPUs. Our code is released at https:// github.com/adminasmi/OmniZip-CVPR2026.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Builds on13
- Language Modeling Is CompressionGrégoire Delétang, Anian Ruoss, Paul-Ambroise Duquenne, Elliot Catt et al.ICLR 2024 · 243 citations
- iFlow: Numerically Invertible Flows for Efficient Lossless Compression via a Uniform CoderShifeng Zhang, Ning Kang, Tom Ryder, Zhenguo LiNeurIPS 2021 · 47 citations
- Large Language Models for Lossless Image Compression: Next-Pixel Prediction in Language Space is All You NeedKecheng Chen, Pingping Zhang, Hui Liu, Jie Liu et al.NeurIPS 2025 · 14 citations
- MSDZip: Universal Lossless Compression for Multi-source Data via Stepwise-parallel and Learning-based PredictionHuidong Ma, Hui Sun, Liping Yi, Yanfeng Ding et al.WWW 2025 · 9 citations
- L3TC: Leveraging RWKV for Learned Lossless Low-Complexity Text CompressionJunxuan Zhang, Zhengxue Cheng, Yan Zhao, Shihao Wang et al.AAAI 2025 · 8 citations
Related papers
- OmniZip: Audio-Guided Dynamic Token Compression for Fast Omnimodal Large Language ModelsKeda Tao, Kele Shao, Bohan Yu, Weiqiang Wang et al.CVPR 2026 · 32 citations
- OmniSIFT: Modality-Asymmetric Token Compression for Efficient Omni-modal Large Language ModelsYue Ding, Yiyan Ji, Jungang Li, Xuyang Liu et al.ICML 2026 · 22 citations
- Compression via Pre-trained Transformers: A Study on Byte-Level Multimodal DataDavid Heurtel-Depeiges, Anian Ruoss, Joel Veness, Tim GeneweinICML 2025
- UniCompress: Token Compression for Unified Vision-Language Understanding and GenerationZiyao Wang, Chen Chen, Jingtao Li, Weiming Zhuang et al.CVPR 2026 · 1 citation
- MoE-LC: General-Purpose Lossless Compression for Multi-modal Data via Entropy-Aware Multi-ExpertsZeyi Lu, Xiaoxiao Ma, Yujun Huang, Minxiao Chen et al.WWW 2026
