CReFT-CAD: Boosting Orthographic Projection Reasoning for CAD via Reinforcement Fine-Tuning
Ke Niu, Zhuofan Chen, Haiyang Yu, Yuwen Chen, Teng Fu, Mengyang Zhao, Bin Li, Xiangyang Xue
摘要
Computer-Aided Design (CAD) is pivotal in industrial manufacturing, with orthographic projection reasoning foundational to its entire workflow-encompassing design, manufacturing, and simulation. However, prevailing deep-learning approaches employ standard 3D reconstruction pipelines as an alternative, which often introduce imprecise dimensions and limit the parametric editability required for CAD workflows. Recently, some researchers adopt vision-language models (VLMs), particularly supervised fine-tuning (SFT), to tackle CAD-related challenges. SFT shows promise but often devolves into pattern memorization, resulting in poor out-of-distribution (OOD) performance on complex reasoning tasks. To tackle these limitations, we introduce CReFT-CAD, a two-stage finetuning paradigm: first, a curriculum-driven reinforcement learning stage with difficulty-aware rewards to steadily build reasoning abilities; second, supervised post-tuning to refine instruction following and semantic extraction. Complementing this, we release TriView2CAD, the first large-scale, open-source benchmark for orthographic projection reasoning, comprising 200,000 synthetic and 3,000 real-world orthographic projections with precise dimensional annotations and six interoperable data modalities. Benchmarking leading VLMs on orthographic projection reasoning, we show that CReFT-CAD significantly improves reasoning accuracy and OOD generalizability in real-world scenarios, providing valuable insights to advance CAD reasoning research. The code and adopted datasets are available at https://github.com/KeNiu042/CReFT-CAD.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper4
- CME-CAD: Heterogeneous Collaborative Multi-Expert Reinforcement Learning for CAD Code GenerationKe Niu, Haiyang Yu, Zhuofan Chen, Zhengtao Yao 等CVPR 2026 · 被引用 18 次
- Pointer-CAD: Unifying B-Rep and Command Sequences via Pointer-based Edges & Faces SelectionDacheng Qi, Chenyu Wang, Jingwei Xu, Tianzhe Chu 等CVPR 2026 · 被引用 10 次
- From Intent to Execution: Multimodal Chain-of-Thought Reinforcement Learning for Precise CAD Code GenerationKe Niu, Haiyang Yu, Zhuofan Chen, Mengyang Zhao 等AAAI 2026 · 被引用 5 次
- Bidirectional Query-Driven Generation of Parametric CAD SketchYang Liu, Daxuan Ren, Yijie Ding, Jianmin Zheng 等CVPR 2026
它引用的顶会 Paper12
- DeepCAD: A Deep Generative Network for Computer-Aided Design ModelsRundi Wu, Chang Xiao, Changxi ZhengICCV 2021 · 被引用 290 次
- CAD-Recode: Reverse Engineering CAD Code From Point CloudsDanila Rukhovich, Elona Dupont, Dimitrios Mallis, Kseniya Cherenkova 等ICCV 2025 · 被引用 16 次
- From 2D CAD Drawings to 3D Parametric Models: A Vision-Language ApproachXilin Wang, Jia Zheng, Yuanchao Hu, Hao Zhu 等AAAI 2025 · 被引用 14 次
- Draw Step by Step: Reconstructing CAD Construction Sequences from Point Clouds via Multimodal DiffusionWeijian Ma, Shuaiqi Chen, Yunzhong Lou, Xueyang Li 等CVPR 2024 · 被引用 14 次
- DeNoising-MOT: Towards Multiple Object Tracking with Severe OcclusionsTeng Fu, Xiaocong Wang, Haiyang Yu, Ke Niu 等ACM MM 2023 · 被引用 11 次
相关 Paper
- ReCAD: Reinforcement Learning Enhanced Parametric CAD Model Generation with Vision-Language ModelsJiahao Li, Yusheng Luo, Yunzhong Lou, Xiangdong ZhouAAAI 2026 · 被引用 4 次
- VideoRFT: Incentivizing Video Reasoning Capability in MLLMs via Reinforced Fine-TuningQi (Cheems) Wang, Yanrui Yu, Ye Yuan, Rui Mao 等NeurIPS 2025 · 被引用 103 次
- Op-CAD: Benchmarking and Investigating Operation-oriented CAD GenerationYixue Bai, Yufei Gu, Zeke XieICML 2026
- Enhancing Geometric Perception in VLMs via Translator-Guided Reinforcement LearningHao Yu, Shuning Jia, Guanghao Li, Wenhao Jiang 等ICLR 2026 · 被引用 2 次
- How RL Unlocks the Aha Moment in Geometric Interleaved ReasoningXiangxiang Zhang, Caijun jia, Siyuan Li, he dingyu 等ICML 2026
