3D Scene Assertion Verification
Jun Lin, Jiayu Ding, Xiangtian Si, Xitong Cao, Lixin Hong, Zhang Chen, Chenxi Lv, Wenqian Wang
摘要
Existing 3D Visual Question Answering (3D-VQA) methods rely on generative outputs that can be ambiguous in decision-making settings. We introduce 3D Scene Assertion Verification, a task that verifies natural language assertions in 3D scenes with strict binary judgments. We present 3DSAV, a large-scale diagnostic benchmark with 22.5k samples across six semantic types. To address this task, we propose DualLPSS, which uses dual-stage subspace routing for type-aware cross-modal fusion and scene-guided assertion focusing. Experiments show that DualLPSS achieves state-of-the-art performance on 3DSAV and handles complex logical assertions better than existing 3D-VQA baselines.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
它引用的顶会 Paper16
- 3D-LLM: Injecting the 3D World into Large Language ModelsYining Hong, Haoyu Zhen, Peihao Chen, Shuhong Zheng 等NeurIPS 2023 · 被引用 662 次
- Evaluating Object Hallucination in Large Vision-Language ModelsYifan Li, Yifan Du, Kun Zhou, Jinpeng Wang 等EMNLP 2023 · 被引用 344 次
- Chat-Scene: Bridging 3D Scene and Large Language Models with Object IdentifiersHaifeng Huang, Yilun Chen, Zehan Wang, Rongjie Huang 等NeurIPS 2024 · 被引用 230 次
- Language Conditioned Spatial Relation Reasoning for 3D Object GroundingShizhe Chen, Pierre-Louis Guhur, Makarand Tapaswi, Cordelia Schmid 等NeurIPS 2022 · 被引用 173 次
- ScanQA: 3D Question Answering for Spatial Scene UnderstandingDaichi Azuma, Taiki Miyanishi, Shuhei Kurita, Motoaki KawanabeCVPR 2022 · 被引用 135 次
相关 Paper
- DSPNet: Dual-vision Scene Perception for Robust 3D Question AnsweringJingzhou Luo, Yang Liu, Weixing Chen, Zhen Li 等CVPR 2025
- SAVVY: Spatial Awareness via Audio-Visual LLMs through Seeing and HearingMingfei Chen, Zijun Cui, Xiulong Liu, Jinlin Xiang 等NeurIPS 2025 · 被引用 18 次
- Diagnosing Spatial Consistency across Perspectives and Viewpoints in Large Vision-Language ModelsYoonji Kim, Jieun Kim, Yujin Jeong, Sung-Bae ChoACL 2026
- 3DSRBENCH: A Comprehensive 3D Spatial Reasoning BenchmarkWufei Ma, Haoyu Chen, Guofeng Zhang, Yu-Cheng Chou 等ICCV 2025 · 被引用 15 次
- Do 3D Large Language Models Really Understand 3D Spatial Relationships?Xianzheng Ma, Tao Sun, Shuai Chen, Yash Bhalgat 等ICLR 2026 · 被引用 7 次
