CReFT-CAD: Boosting Orthographic Projection Reasoning for CAD via Reinforcement Fine-Tuning
Ke Niu, Zhuofan Chen, Haiyang Yu, Yuwen Chen, Teng Fu, Mengyang Zhao, Bin Li, Xiangyang Xue
Abstract
Computer-Aided Design (CAD) is pivotal in industrial manufacturing, with orthographic projection reasoning foundational to its entire workflow-encompassing design, manufacturing, and simulation. However, prevailing deep-learning approaches employ standard 3D reconstruction pipelines as an alternative, which often introduce imprecise dimensions and limit the parametric editability required for CAD workflows. Recently, some researchers adopt vision-language models (VLMs), particularly supervised fine-tuning (SFT), to tackle CAD-related challenges. SFT shows promise but often devolves into pattern memorization, resulting in poor out-of-distribution (OOD) performance on complex reasoning tasks. To tackle these limitations, we introduce CReFT-CAD, a two-stage finetuning paradigm: first, a curriculum-driven reinforcement learning stage with difficulty-aware rewards to steadily build reasoning abilities; second, supervised post-tuning to refine instruction following and semantic extraction. Complementing this, we release TriView2CAD, the first large-scale, open-source benchmark for orthographic projection reasoning, comprising 200,000 synthetic and 3,000 real-world orthographic projections with precise dimensional annotations and six interoperable data modalities. Benchmarking leading VLMs on orthographic projection reasoning, we show that CReFT-CAD significantly improves reasoning accuracy and OOD generalizability in real-world scenarios, providing valuable insights to advance CAD reasoning research. The code and adopted datasets are available at https://github.com/KeNiu042/CReFT-CAD.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 3ddd5c27-220b-4105-8ec0-659d67c3733aCited by top-tier papers4
- CME-CAD: Heterogeneous Collaborative Multi-Expert Reinforcement Learning for CAD Code GenerationKe Niu, Haiyang Yu, Zhuofan Chen, Zhengtao Yao et al.CVPR 2026 · 18 citations
- Pointer-CAD: Unifying B-Rep and Command Sequences via Pointer-based Edges & Faces SelectionDacheng Qi, Chenyu Wang, Jingwei Xu, Tianzhe Chu et al.CVPR 2026 · 10 citations
- From Intent to Execution: Multimodal Chain-of-Thought Reinforcement Learning for Precise CAD Code GenerationKe Niu, Haiyang Yu, Zhuofan Chen, Mengyang Zhao et al.AAAI 2026 · 5 citations
- Bidirectional Query-Driven Generation of Parametric CAD SketchYang Liu, Daxuan Ren, Yijie Ding, Jianmin Zheng et al.CVPR 2026
Builds on12
- DeepCAD: A Deep Generative Network for Computer-Aided Design ModelsRundi Wu, Chang Xiao, Changxi ZhengICCV 2021 · 290 citations
- CAD-Recode: Reverse Engineering CAD Code From Point CloudsDanila Rukhovich, Elona Dupont, Dimitrios Mallis, Kseniya Cherenkova et al.ICCV 2025 · 16 citations
- From 2D CAD Drawings to 3D Parametric Models: A Vision-Language ApproachXilin Wang, Jia Zheng, Yuanchao Hu, Hao Zhu et al.AAAI 2025 · 14 citations
- Draw Step by Step: Reconstructing CAD Construction Sequences from Point Clouds via Multimodal DiffusionWeijian Ma, Shuaiqi Chen, Yunzhong Lou, Xueyang Li et al.CVPR 2024 · 14 citations
- DeNoising-MOT: Towards Multiple Object Tracking with Severe OcclusionsTeng Fu, Xiaocong Wang, Haiyang Yu, Ke Niu et al.ACM MM 2023 · 11 citations
Related papers
- ReCAD: Reinforcement Learning Enhanced Parametric CAD Model Generation with Vision-Language ModelsJiahao Li, Yusheng Luo, Yunzhong Lou, Xiangdong ZhouAAAI 2026 · 4 citations
- VideoRFT: Incentivizing Video Reasoning Capability in MLLMs via Reinforced Fine-TuningQi (Cheems) Wang, Yanrui Yu, Ye Yuan, Rui Mao et al.NeurIPS 2025 · 103 citations
- Op-CAD: Benchmarking and Investigating Operation-oriented CAD GenerationYixue Bai, Yufei Gu, Zeke XieICML 2026
- Enhancing Geometric Perception in VLMs via Translator-Guided Reinforcement LearningHao Yu, Shuning Jia, Guanghao Li, Wenhao Jiang et al.ICLR 2026 · 2 citations
- How RL Unlocks the Aha Moment in Geometric Interleaved ReasoningXiangxiang Zhang, Caijun jia, Siyuan Li, he dingyu et al.ICML 2026
