CoTracker3: Simpler and Better Point Tracking by Pseudo-Labeling Real Videos
Nikita Karaev, Yuri Makarov, Jianyuan Wang, Natalia Neverova, Andrea Vedaldi, Christian Rupprecht
2025Year
37Citations
Abstract
Figure 1. Scaling point trackers with unsupervised videos. Left: We compare our CoTracker3 to other point trackers. Each model is pre-trained on synthetic data (Kubric) and then fine-tuned on real videos using our simple unsupervised training protocol. Our model and training protocol outperform SoTA by a large margin using only 0.1% of the real training data. Right: CoTracker3 is robust to occlusions.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 9dfe4b06-d5a1-473f-aad8-4bb23c28fd73Builds on12
- Fourier Features Let Networks Learn High Frequency Functions in Low Dimensional DomainsMatthew Tancik, Pratul P. Srinivasan, Ben Mildenhall, Sara Fridovich-Keil et al.NeurIPS 2020 · 4,036 citations
- Is Space-Time Attention All You Need for Video Understanding?Gedas Bertasius, Heng Wang, Lorenzo TorresaniICML 2021 · 2,927 citations
- LightGlue: Local Feature Matching at Light SpeedPhilipp Lindenberger, Paul-Edouard Sarlin, Marc PollefeysICCV 2023 · 936 citations
- DISK: Learning local features with policy gradientMichal J. Tyszkiewicz, Pascal Fua, Eduard TrullsNeurIPS 2020 · 652 citations
- PointOdyssey: A Large-Scale Synthetic Dataset for Long-Term Point TrackingYang Zheng, Adam W. Harley, Bokui Shen, Gordon Wetzstein et al.ICCV 2023 · 255 citations
Related papers
- ReTracker: Exploring Image Matching for Robust Online Any Point TrackingDongli Tan, Xingyi He, Sida Peng, Yiqing Gong et al.ICCV 2025 · 2 citations
- AnthroTAP: Learning Point Tracking with Real-World MotionInès Hyeonsu Kim, Seokju Cho, Jahyeok Koo, Junghyun Park et al.CVPR 2026 · 5 citations
- Generalizable Structure-Aware Keypoint Correspondence for Category-Unified 3D Single Object TrackingJie Xiao, Yinchao Ma, Yuyang Tang, Dengqing Yang et al.CVPR 2026
- VideoCutLER: Surprisingly Simple Unsupervised Video Instance SegmentationXudong Wang, Ishan Misra, Ziyun Zeng, Rohit Girdhar et al.CVPR 2024
- Multi-View 3D Point TrackingFrano Rajic, Haofei Xu, Marko Mihajlovic, Siyuan Li et al.ICCV 2025 · 2 citations
