Extreme Rotation Estimation in the Wild
Hana Bezalel, Dotan Ankri, Ruojin Cai, Hadar Averbuch-Elor
摘要
We present a technique and benchmark dataset for estimating the relative 3D orientation between a pair of Internet images captured in an extreme setting, where the images have limited or non-overlapping field of views. Prior work targeting extreme rotation estimation assume constrained 3D environments and emulate perspective images by cropping regions from panoramic views. However, real images captured in the wild are highly diverse, exhibiting variation in both appearance and camera intrinsics. In this work, we propose a Transformer-based method for estimating relative rotations in extreme real-world settings, and contribute the ExtremeLandmarkPairs dataset, assembled from scene-level Internet photo collections. Our evaluation demonstrates that our approach succeeds in estimating the relative rotations in a wide variety of extremeview Internet image pairs, outperforming various baselines, including dedicated rotation estimation techniques and contemporary 3D reconstruction methods.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper6
- Emergent Extreme-View Geometry in 3D Foundation ModelsYiwen Zhang, Joseph Tung, Ruojin Cai, David Fouhey 等CVPR 2026 · 被引用 5 次
- Long-Tail Internet Photo ReconstructionYuan Li, Yuanbo Xiangli, Hadar Averbuch-Elor, Noah Snavely 等CVPR 2026 · 被引用 4 次
- Beyond the Frame: Generating 360° Panoramic Videos from Perspective VideosRundong Luo, Matthew Wallingford, Ali Farhadi, Noah Snavely 等ICCV 2025 · 被引用 2 次
- Scene Grounding in the WildTamir Cohen, Leo Segre, Shay Shomer Chai, Shai Avidan 等CVPR 2026 · 被引用 1 次
- PoseCrafter: Extreme Pose Estimation with Hybrid Video SynthesisQing Mao, Tianxin Huang, Yu Zhu, Jinqiu Sun 等NeurIPS 2025 · 被引用 1 次
它引用的顶会 Paper21
- High-Resolution Image Synthesis with Latent Diffusion ModelsRobin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser 等CVPR 2022 · 被引用 13,123 次
- SegFormer: Simple and Efficient Design for Semantic Segmentation with TransformersEnze Xie, Wenhai Wang, Zhiding Yu, Anima Anandkumar 等NeurIPS 2021 · 被引用 9,661 次
- DISK: Learning local features with policy gradientMichal J. Tyszkiewicz, Pascal Fua, Eduard TrullsNeurIPS 2020 · 被引用 652 次
- Prompt-to-Prompt Image Editing with Cross-Attention ControlAmir Hertz, Ron Mokady, Jay Tenenbaum, Kfir Aberman 等ICLR 2023 · 被引用 361 次
- DUSt3R: Geometric 3D Vision Made EasyShuzhe Wang, Vincent Leroy, Yohann Cabon, Boris Chidlovskii 等CVPR 2024 · 被引用 302 次
相关 Paper
- Extreme Rotation Estimation Using Dense Correlation VolumesRuojin Cai, Bharath Hariharan, Noah Snavely, Hadar Averbuch-ElorCVPR 2021
- PanoVGGT: Feed-Forward 3D Reconstruction from Panoramic ImageryYijing Guo, Mengjun Chao, Luo Wang, Tianyang Zhao 等CVPR 2026 · 被引用 11 次
- Ray3D: ray-based 3D human pose estimation for monocular absolute 3D localizationYu Zhan, Fenghai Li, Renliang Weng, Wongun ChoiCVPR 2022 · 被引用 62 次
- SPEC: Seeing People in the Wild with an Estimated CameraMuhammed Kocabas, Chun-Hao P. Huang, Joachim Tesch, Lea Müller 等ICCV 2021 · 被引用 181 次
- Wide-Baseline Relative Camera Pose Estimation With Directional LearningKefan Chen, Noah Snavely, Ameesh MakadiaCVPR 2021
