4DGT: Learning a 4D Gaussian Transformer Using Real-World Monocular Videos
Zhen Xu, Zhengqin Li, Zhao Dong, Xiaowei Zhou, Richard A. Newcombe, Zhaoyang Lv
摘要
Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1) Gaussian 2 (t-1)
Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 2 (t+1) Gaussian 1 Gaussian 3 Veloci ty Velocity Rotation Velocit y t life-span t1 DinoV2 Dynamic Gaussian Reconstruction Figure 1: We propose a scalable 4D dynamic reconstruction model trained only on real-world monocular RGB videos. The feed-forward 4DGS (section 3.1) representation enables us to render the geometry and appearance of the dynamic scene from novel views in real-time. Even without explicit supervision, the model can learn to distinguish dynamic contents from the background and produce realistic optical flows. The figure shows an enlarged set of Gaussians for the purpose of visualization. The embedded rendered videos only play in Adobe Reader or KDE Okular.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper11
- NeoVerse: Enhancing 4D World Model with in-the-wild Monocular VideosYuxue Yang, Lue Fan, Ziqi Shi, Junran Peng 等CVPR 2026 · 被引用 42 次
- Shape of Motion: 4D Reconstruction From a Single VideoQianqian Wang, Vickie Ye, Hang Gao, Weijia Zeng 等ICCV 2025 · 被引用 29 次
- DGGT: Feedforward 4D Reconstruction of Dynamic Driving Scenes using Unposed ImagesXiaoxue Chen, Ziyi Xiong, Yuantao Chen, Gen Li 等CVPR 2026 · 被引用 24 次
- ActionMesh: Animated 3D Mesh Generation with Temporal 3D DiffusionRemy Sabathier, David Novotný, Niloy J. Mitra, Tom MonnierCVPR 2026 · 被引用 16 次
- ART: Articulated Reconstruction TransformerZizhang Li, Cheng Zhang, Zhengqin Li, Henry Howard-Jenkins 等CVPR 2026 · 被引用 12 次
它引用的顶会 Paper33
- An Image is Worth 16x16 Words: Transformers for Image Recognition at ScaleAlexey Dosovitskiy, Lucas Beyer, Alexander Kolesnikov, Dirk Weissenborn 等ICLR 2021 · 被引用 21,477 次
- 3D Gaussian Splatting for Real-Time Radiance Field RenderingBernhard Kerbl, Georgios Kopanas, Thomas Leimkühler, George DrettakisSIGGRAPH 2023 · 被引用 5,687 次
- Depth Anything V2Lihe Yang, Bingyi Kang, Zilong Huang, Zhen Zhao 等NeurIPS 2024 · 被引用 2,305 次
- LRM: Large Reconstruction Model for Single Image to 3DYicong Hong, Kai Zhang, Jiuxiang Gu, Sai Bi 等ICLR 2024 · 被引用 813 次
- FlashAttention-3: Fast and Accurate Attention with Asynchrony and Low-precisionJay Shah, Ganesh Bikshandi, Ying Zhang, Vijay Thakkar 等NeurIPS 2024 · 被引用 727 次
相关 Paper
- DGS-LRM: Real-Time Deformable 3D Gaussian Reconstruction From Monocular VideosChieh Hubert Lin, Zhaoyang Lv, Songyin Wu, Zhen Xu 等NeurIPS 2025 · 被引用 15 次
- Gaussian-Flow: 4D Reconstruction with Dynamic 3D Gaussian ParticleYoutian Lin, Zuozhuo Dai, Siyu Zhu, Yao YaoCVPR 2024
- MoVieS: Motion-Aware 4D Dynamic View Synthesis in One SecondChenguo Lin, Yuchen Lin, Panwang Pan, Yifan Yu 等CVPR 2026 · 被引用 38 次
- Flux4D: Flow-based Unsupervised 4D ReconstructionJingkang Wang, Henry Che, Yun Chen, Ze Yang 等NeurIPS 2025 · 被引用 10 次
- Deblur4DGS: 4D Gaussian Splatting from Blurry Monocular VideoRenlong Wu, Zhilu Zhang, Mingyang Chen, Zifei Yan 等AAAI 2026 · 被引用 17 次
