Text2CAD-Bench:基于LLM的文本到参数化CAD生成的基准测试
TLDR
提出Text2CAD-Bench基准,系统评估文本到参数化CAD生成的几何复杂度与实际领域。
评分理由
The paper's strength lies in its systematic benchmark design with 600 human-curated examples spanning four complexity levels and dual-style prompts, addressing a gap in existing benchmarks. Weaknesses include reliance on evaluating existing models without proposing a new method, and limited detail on the benchmark's construction or validation in the abstract.
Read-first 评分解释
综合优先阅读分 48.3,由主题、引用、图谱、方法、可复现性和近期性等信号加权得到。 原始总分保留为 67。
研究版图角色
前沿论文
排序敏感性
稳定性:volatile;排名波动范围:39。
关键词评分
深度分析
创新点
- 首个系统评估文本到CAD在几何复杂度和应用多样性方面的基准
- 具有四个级别(L1-L4)的分层基准,从基本图元到机械零件以外的实际领域
- 双风格提示:面向非专业用户的几何描述和符合专家级惯例的程序化序列
方法
我们构建了Text2CAD-Bench,一个包含600个人工精选示例的基准,涵盖四个级别的几何复杂度和应用多样性,每个示例配有几何和程序化提示。我们在此基准上评估了主流通用LLM和领域特定模型。
关键结果
当前模型在基本几何上表现合理,但在复杂拓扑和高级特征上显著下降。