Awesome AI4CAD Hub 论文 · 数据集 · 项目
← 返回论文列表

MUSE:面向可制造、功能性和可装配性的文本到CAD生成的基准测试

arXiv 2026 69 method

TLDR

MUSE是一个用于文本到CAD生成的基准,通过VLM评估B-Rep组件的可制造性、功能性和可装配性。

评分理由

The paper addresses a critical gap in Text-to-CAD evaluation by moving beyond geometric similarity to engineering-relevant criteria. Its strengths include a structured three-stage protocol and human-validated VLM judge, but reliance on VLM may introduce biases and experiments show limited success even for strong models.

Read-first 评分解释

综合优先阅读分 69,由主题、引用、图谱、方法、可复现性和近期性等信号加权得到。 原始总分保留为 89。

方法质量 25%
100

检查可见的摘要与分析字段,寻找实验、数据集、基线、指标和局限性等方法证据。 命中信号:基准、数据集、评估、实验、指标、验证

近期性 8%
100

使用温和的时间衰减,让近期论文更容易浮现,同时保留较早基础工作的价值。 年份:2026

主题相关性 42%
55.6

使用现有 LLM 关键词相关性评分,并归一化到 0-100。 关键词:AI for CAD、computer-aided design、neural CAD、generative CAD、parametric CAD、B-Rep、boundary representation、constructive solid geometry、CSG、sketch extrusion、CAD generation、CAD reconstruction、text-to-CAD、image-to-CAD、point cloud to CAD、CAD program

可复现性 25%
50

检查链接和可见文本中的论文、代码、数据集、工件与仓库信号。 论文:有;代码:无;数据:无;命中信号:代码、数据集、GitHub

研究版图角色

前沿论文方法锚点

排序敏感性

稳定性:sensitive;排名波动范围:3。

关键词评分

text-to-CAD
10
B-Rep
9
boundary representation
9
CAD generation
9
AI for CAD
7
generative CAD
7
CAD program
7
computer-aided design
6
CAD reconstruction
6
neural CAD
5
parametric CAD
5
sketch extrusion
3
constructive solid geometry
2
CSG
2
image-to-CAD
1
point cloud to CAD
1

深度分析

创新点

  • 引入MUSE,一个专注于复杂、可编辑的B-Rep装配体并配有结构化设计规范的Text-to-CAD基准。
  • 三阶段评估协议(代码检查、几何检查、设计意图对齐),使用设计特定评分标准评估功能性、可制造性和可装配性。
  • 采用基于评分标准的VLM评判器实现可扩展评估,并通过人工标注验证其可靠性。

方法

MUSE将实际设计实例与结构化设计规范配对,并通过三阶段协议评估生成的CAD模型:代码检查、几何检查和设计意图对齐。最后阶段使用设计特定评分标准和VLM评判器评估功能性、可制造性和可装配性,并通过人工验证评判器的可靠性。

关键结果

实验揭示了从可执行代码到有效几何再到工程就绪设计的失败级联;即使最强的LLM在细粒度工程标准上也仅取得有限成功。

标签

AI