CineMaster: A 3D-Aware and Controllable Framework for Cinematic Text-to-Video Generation
Qinghe Wang, Yawen Luo, Xiaoyu Shi, Xu Jia, Huchuan Lu, Tianfan Xue, Xintao Wang, Pengfei Wan, Di Zhang, Kun Gai
2025年份
13被引次数
27顶会引用
摘要
Caption: The hot air balloon is circling above a tower. Caption: A car passes another car from behind.
Caption: A cat jumps down from the table.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper27
- EffiVMT: Video Motion Transfer via Efficient Spatial-Temporal Decoupled FinetuningYue Ma, Yulong Liu, Qiyuan Zhu, Xiangpeng Yang 等ICLR 2026 · 被引用 70 次
- Wan-Move: Motion-controllable Video Generation via Latent Trajectory GuidanceRuihang Chu, Yefei He, Zhekai Chen, Shiwei Zhang 等NeurIPS 2025 · 被引用 50 次
- NeoVerse: Enhancing 4D World Model with in-the-wild Monocular VideosYuxue Yang, Lue Fan, Ziqi Shi, Junran Peng 等CVPR 2026 · 被引用 42 次
- Unified In-Context Video EditingZixuan Ye, Xuanhua He, Quande Liu, Qiulin Wang 等ICLR 2026 · 被引用 37 次
- MultiShotMaster: A Controllable Multi-Shot Video Generation FrameworkQinghe Wang, Xiaoyu Shi, Baolu Li, Weikang Bian 等CVPR 2026 · 被引用 33 次
它引用的顶会 Paper30
- High-Resolution Image Synthesis with Latent Diffusion ModelsRobin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser 等CVPR 2022 · 被引用 13,123 次
- Directly Denoising Diffusion ModelsDan Zhang, Jingjing Wang, Feng LuoICML 2024 · 被引用 11,724 次
- Adding Conditional Control to Text-to-Image Diffusion ModelsLvmin Zhang, Anyi Rao, Maneesh AgrawalaICCV 2023 · 被引用 6,759 次
- Scalable Diffusion Models with TransformersWilliam Peebles, Saining XieICCV 2023 · 被引用 5,568 次
- Scaling Rectified Flow Transformers for High-Resolution Image SynthesisPatrick Esser, Sumith Kulal, Andreas Blattmann, Rahim Entezari 等ICML 2024 · 被引用 3,620 次
相关 Paper
- Framing Algorithmic Recourse for Anomaly DetectionDebanjan Datta, Feng Chen, Naren RamakrishnanKDD 2022 · 被引用 2 次
- VisToT: Vision-Augmented Table-to-Text GenerationPrajwal Gatti, Anand Mishra, Manish Gupta, Mithun Das GuptaEMNLP 2022 · 被引用 4 次
- Concadia: Towards Image-Based Text Generation with a PurposeElisa Kreiss, Fei Fang, Noah D. Goodman, Christopher PottsEMNLP 2022 · 被引用 13 次
- Context-aware Difference Distilling for Multi-change CaptioningYunbin Tu, Liang Li, Li Su, Zheng-Jun Zha 等ACL 2024
- Zero-Shot 4D Lidar Panoptic SegmentationYushan Zhang, Aljosa Osep, Laura Leal-Taixé, Tim MeinhardtCVPR 2025
