ICCVArtificial Intelligence
IEEE/CVF International Conference on Computer Vision
7,544Papers indexed
2019-2025Years covered
Recent papers
- "Principal Components" Enable a New Language of ImagesXin Wen, Bingchen Zhao, Ismail Elezi, Jiankang Deng et al.2025 · 1 citation
- : Symmetry Understanding of 3D Shapes via Chirality DisentanglementWeikang Wang, Tobias Weißberg, Nafie El Amrani, Florian Bernard2025 · 3 citations
- -Gaussian: 4D Radiative Gaussian Splatting for Continuous-Time Tomographic ReconstructionWeihao Yu, Yuanhao Cai, Ruyi Zha, Zhiwen Fan et al.2025 · 5 citations
- -Attn: Decomposed Attention for Large Vision-and-Language ModelsChia-Wen Kuo, Sijie Zhu, Fan Chen, Xiaohui Shen et al.2025 · 1 citation
- FinMMR: Make Financial Numerical Reasoning More Multimodal, Comprehensive, and ChallengingZichen Tang, Haihong E, Jiacheng Liu, Zhongjun Yang et al.2025 · 1 citation
- -GAN: Physics-Inspired GAN for Generating SAR Images Under Limited DataXidan Zhang, Yihan Zhuang, Qian Guo, Haodong Yang et al.2025 · 7 citations
- -AVAS: Can Physics-Integrated Audio-Visual Modeling Boost Neural Acoustic Synthesis?Susan Liang, Chao Huang, Yunlong Tang, Zeliang Zhang et al.2025 · 4 citations
- -Net: A Physics-Informed Spatio-Temporal Model for Global Surface ReconstructionHao Zheng, Yuting Zheng, Hanbo Huang, Chaofan Sun et al.2025
- : An Affordance-Aware Hierarchical Model for General Robotic ManipulationRongtao Xu, Jian Zhang, Minghao Guo, Youpeng Wen et al.2025 · 3 citations
- -World: Intra-Inter Tokenization for Efficient Dynamic 4D Scene ForecastingZhimin Liao, Ping Wei, Ruijie Zhang, Shuaijia Chen et al.2025 · 1 citation
- 2.5 Years in Class: A Multimodal Textbook for Vision-Language PretrainingWenqi Zhang, Hang Zhang, Xin Li, Jiashuo Sun et al.2025 · 2 citations
- 2D Gaussian Splatting-Based Sparse-View Transparent Object Depth Reconstruction Via Physics Simulation for Scene UpdateJeongyun Kim, Seunghoon Jeong, Giseop Kim, Myung-Hwan Jeon et al.2025 · 1 citation
- 2HandedAfforder: Learning Precise Actionable Bimanual Affordances from Human VideosMarvin Heidinger, Snehal Jauhri, Vignesh Prasad, Georgia Chalvatzaki2025
- 3D Gaussian Map with Open-Set Semantic Grouping for Vision-Language NavigationJianzhe Gao, Rui Liu, Wenguan Wang2025 · 5 citations
- 3D Gaussian Splatting Driven Multi-View Robust Physical Adversarial Camouflage GenerationTianrui Lou, Xiaojun Jia, Siyuan Liang, Jiawei Liang et al.2025 · 2 citations
- 3D Mesh Editing Using Masked LRMsWill Gao, Dilin Wang, Yuchen Fan, Aljaz Bozic et al.2025 · 6 citations
- 3D Test-Time Adaptation via Graph Spectral Driven Point ShiftXin Wei, Qin Yang, Yijie Fang, Mingrui Zhu et al.2025
- 3D-MOOD: Lifting 2D to 3D for Monocular Open-Set Object DetectionYung-Hsu Yang, Luigi Piccinelli, Mattia Segù, Siyuan Li et al.2025 · 2 citations
- 3DGraphLLM: Combining Semantic Graphs and Large Language Models for 3D Scene UnderstandingTatiana Zemskova, Dmitry A. Yudin2025 · 7 citations
- 3DGS-LM: Faster Gaussian-Splatting Optimization with Levenberg-MarquardtLukas Höllein, Aljaz Bozic, Michael Zollhöfer, Matthias Nießner2025 · 10 citations
- 3DRealCar: An In-the-Wild RGB-D Car Dataset with 360-Degree ViewsXiaobiao Du, Yida Wang, Haiyang Sun, Zhuojie Wu et al.2025 · 10 citations
- 3DSRBENCH: A Comprehensive 3D Spatial Reasoning BenchmarkWufei Ma, Haoyu Chen, Guofeng Zhang, Yu-Cheng Chou et al.2025 · 15 citations
- 4D Gaussian Splatting SLAMYanyan Li, Youxu Fang, Zunjie Zhu, Kunyi Li et al.2025 · 3 citations
- 4D Visual Pre-Training for Robot LearningChengkai Hou, Yanjie Ze, Yankai Fu, Zeyu Gao et al.2025 · 1 citation
