MoCoDiff: A Controllable Autoregressive Diffusion Model for Expressive Motion Generation
Wenfeng Song, Xuehan Wang, Shuai Li, Yi Chen, Yuting Guo, Zhenyu Wu, Xingliang Jin, Chenglizhao Chen, Fei Hou, Hongyu Wu, Aimin Hao
Abstract
Single content multiple styles ("walk"+Crouched style) ("walk"+Zombie style) ("walk"+Ninja style) Multiple content single style ("walk"+Airplane style)("jump"+Airplane style)("run"+Airplane style) Multiple content multiple styles ("walk"+Airplane style)("roll over"+No style) ("go upstairs"+Zombie style) ("go downstairs"+No style) ("sit"+Crouched style) Transition formulation actively suppresses drift, enforces smooth transitions across motion segments, and significantly improves temporal coherence over extended sequences. Experiments show that MoCoDiff achieves state-of-theart style fidelity, transition quality, and efficiency, while supporting flexible and interpretable multi-condition motion synthesis without retraining. The source code and model are available at https://github.com/ Xuehan0530/MoCoDiff-code.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 4d184a59-67cb-4a4a-aaa1-32528f60046fBuilds on27
- Adding Conditional Control to Text-to-Image Diffusion ModelsLvmin Zhang, Anyi Rao, Maneesh AgrawalaICCV 2023 · 6,759 citations
- AMASS: Archive of Motion Capture As Surface ShapesNaureen Mahmood, Nima Ghorbani, Nikolaus F. Troje, Gerard Pons-Moll et al.ICCV 2019 · 1,784 citations
- MotionGPT: Human Motion as a Foreign LanguageBiao Jiang, Xin Chen, Wen Liu, Jingyi Yu et al.NeurIPS 2023 · 698 citations
- Generating Diverse and Natural 3D Human Motions from TextChuan Guo, Shihao Zou, Xinxin Zuo, Sen Wang et al.CVPR 2022 · 462 citations
- Action2Motion: Conditioned Generation of 3D Human MotionsChuan Guo, Xinxin Zuo, Sen Wang, Shihao Zou et al.ACM MM 2020 · 394 citations
Related papers
- StyleMotif: Multi-Modal Motion Stylization using Style-Content Cross FusionZiyu Guo, Yizhak Ben-Shabat, Young Yoon Lee, Joseph Liu et al.ICCV 2025 · 4 citations
- Arbitrary Motion Style Transfer with Multi-Condition Motion Latent Diffusion ModelWenfeng Song, Xingliang Jin, Shuai Li, Chenglizhao Chen et al.CVPR 2024 · 18 citations
- UMSD: High Realism Motion Style Transfer via Unified Mamba-based DiffusionZiyun Qian, Zeyu Xiao, Xingliang Jin, Dingkang Yang et al.ACM MM 2025 · 3 citations
- MoST: Motion Style Transformer Between Diverse Action ContentsBoeun Kim, Jungho Kim, Hyung Jin Chang, Jin Young ChoiCVPR 2024
- MotionCraft: Crafting Whole-Body Motion with Plug-and-Play Multimodal ControlsYuxuan Bian, Ailing Zeng, Xuan Ju, Xian Liu et al.AAAI 2025 · 22 citations
