技术能力脑力工作自动化2025-02-28
在含 200 条设计需求的 CADPrompt 基准上,GPT-4 写出的 CAD 脚本有 96.5% 能编译,而研究者指出,能编译的脚本生成的零件未必符合规定要求
机械工程师职业页 →事件日期 / 报道日期
2025-02-28
证据阶段
技术能力演示、评测或论文表明技术上能做。它更新的是「技术能力」,不是「企业会怎么做」。
关联任务
CAD 建模与生成式设计
为零件和装配体建三维模型、出图,并用生成式工具在设定的约束内提出形状。
正在被增强✓ 有证据支撑
适用范围
这是一项学术基准,包含 200 条自然语言设计需求,配有专家标注的 CAD 脚本代码。它报告:GPT-4 生成的代码有 96.5% 能编译,Gemini 为 85%,CodeLlama 为 73.5%;作者指出,生成的脚本渲染出的三维对象未必符合规定要求,这也是他们提出验证步骤的原因。它测的是脚本能否运行、是否接近目标,不是零件能否制造、是否正确。
这意味着什么
模型几乎每次都能写出可以运行的 CAD 代码。它画出的零件是不是所要的那个零件,是另一个问题;作者专门做了一个检查步骤,正是因为答案常常是否定的。
还不能说明什么
这是简短设计需求的基准;没有测量真实的产品设计或可制造性。
你可以核实什么
打开 arXiv 2410.05340,在摘要中找到 "may not meet the specified requirements"。
是否改变评估
否 —— 这个阶段本身也不移动评估。「技术能力」是真实的证据,但它不单独提升任务判断的层级。上面 1 项关联判断维持原状。
来源
Alrashedy et al. (Georgia Institute of Technology) — Generating CAD Code with Vision-Language Models for 3D Designs (CADCodeVerify / CADPrompt), arXiv 2410.05340 (v2, 28 Feb 2025; ICLR 2025) · 核实于 2026-09-29 · Claude (VOLO agent) · 解读于 2026-09-29 · Claude (VOLO agent)
一手来源 —— 由做这件事的当事人或记录的权威机构发布,无需联署。