LLM 기반 텍스트-CAD 생성·편집 통합 프레임워크
기존에는 텍스트로 CAD 모델을 생성하는 작업과 이를 수정(편집)하는 작업이 분리되어 있어 실용성이 떨어졌습니다. 이 논문은 대형 언어 모델(LLM)을 활용해 모델의 생성과 편집을 하나로 통합한 'PR-CAD' 프레임워크를 제안합니다. 강화학습 기반의 에이전트를 통해 사용자의 의도를 파악하고 정밀하게 설계를 수정하여, 기존 대비 월등한 수준의 제어력과 정확도를 달성하며 CAD 모델링의 효율을 크게 높였습니다.
컴퓨터 과학 > 계산 및 언어 arXiv:2604.19773 (cs) [2026년 3월 27일 제출]
제목: PR-CAD: 대형 언어 모델을 위한 점진적 정제를 통한 통합적이고 제어 가능하며 충실한 텍스트-CAD 생성 저자: Jiyuan An, Jiachen Zhao, Fan Chen, Liner Yang, Zhenghao Liu, Hongyan Wang, Weihua An, Meishan Zhang, Erhong Yang
초록: 전통적으로 CAD(컴퓨터 지원 설계) 모델의 구축은 노동 집약적인 수동 작업과 전문적인 지식에 의존해 왔습니다. 최근 대형 언어 모델(LLM)의 발전은 텍스트-투-CAD(Text-to-CAD) 생성 연구에 영감을 주었습니다. 그러나 기존의 접근 방식들은 생성(Create)과 편집(Edit) 작업을 서로 분리된 별개의 작업으로 취급하여 실용성을 제한했습니다.
본 논문에서는 제어 가능하고 충실한 텍스트-투-CAD 모델링을 위해 생성과 편집을 통합하는 점진적 정제(Progressive Refinement) 프레임워크인 PR-CAD를 제안합니다. 이를 뒷받침하기 위해 여러 CAD 표현 방식은 물론 정성적 및 정량적 설명을 아우르는, CAD의 전체 라이프사이클을 포괄하는 고품질의 상호작용 데이터셋을 큐레이션했습니다. 이 데이터셋은 편집 작업의 유형을 체계적으로 정의하고 인간의 실제 작업과 매우 유사한 상호작용 데이터를 생성합니다.
LLM에 최적화된 CAD 표현 방식을 기반으로, 의도 이해(Intent Understanding), 매개변수 추정(Parameter Estimation), 정밀 편집 위치 파악(Precise Edit Localization)을 단일 에이전트에 통합한 강화학습 기반 추론 프레임워크를 제안합니다. 이를 통해 설계 생성과 정제(수정) 작업을 모두 수행할 수 있는 '올인원(All-in-one)' 솔루션을 제공합니다.
광범위한 실험 결과, 생성과 편집 작업 간, 그리고 정성적 및 정량적 모달리티 간에 강력한 상호 보완 및 강화 효과가 있음을 입증했습니다. 공개 벤치마크에서 PR-CAD는 생성 및 정제 시나리오 모두에서 최고 수준의 제어 가능성(Controllability)과 충실성(Faithfulness)을 달성했으며, 사용자 친화적임과 동시에 CAD 모델링 효율성을 크게 향상시키는 것으로 입증되었습니다.
주제: 계산 및 언어 (cs.CL), 인공지능 (cs.AI) 인용: arXiv:2604.19773 [cs.CL] (또는 이 버전의 경우 arXiv:2604.19773v1 [cs.CL]) https://doi.org/10.48550/arXiv.2604.19773 DataCite를 통해 발급된 arXiv DOI
제출 이력: 출처: Jiyuan An [이메일 보기] [v1] 2026년 3월 27일 금요일 12:13:20 UTC (10,655 KB)