如何评估用于 CAD 与 GIS 的 MCP Server
给工程团队和 GIS 团队的采购清单:把 AI Agent 接进 Rhino、FreeCAD、QGIS 时,什么区分了「演示品」和「可部署系统」。
工程软件对不精确的惩罚很重。约束树被破坏的 CAD 模型,比没有模型更糟;坐标系搞错的 GIS 分析,可能偏差上千倍,却照样渲染得很漂亮。
这就是为什么 CAD 与 GIS 集成的评估标准,跟通用开发工具完全不同。下面是如果我们自己去采购,会用的那份清单。
1. 它理解模型语义,还是只理解 API?
每一个正经的 CAD / GIS 软件都有脚本 API。那不是重点。重点是集成方是否理解 API 背后正在操作的那些概念。
对 Rhino 来说,这意味着单位、公差、图层结构和图块实例,而不是被打散的几何体。对 FreeCAD 来说,意味着特征树、约束和父子引用。对 QGIS 来说,意味着坐标参考系、图层溯源和排版出图。
要问的是:当 Agent 改完模型后,交出来的东西人还能继续往下做吗?
2. 买之前,你能不能看到工具面?
生产级集成会公开它的工具。你应该能读到一份清单,理解每个工具做什么,并知道哪些是只读的。
凡是宣称"软件能做的 Agent 都能做"的,那描述的不是功能,而是不可控的影响半径。
3. 输入非法时会发生什么?
这是演示级与生产级之间最锋利的分界线。
- 演示级: 调用抛异常,会话直接结束。
- 生产级: 调用返回结构化错误,指明是哪个参数不合法、触犯了哪条约束,并且会话继续。
后者才能让 Agent 循环真正有产出:它能读懂错误并自我修正,就像一个面对编译器的开发者。
4. 工作可回滚吗?
问这三个问题:
- 破坏性操作会不会自动创建检查点?
- 我能不能只恢复单个对象,而不是整个文件?
- 回滚与宿主软件自身的撤销栈能否正确配合?
答不上第二个问题的集成,只适合在沙箱里用。
5. 数据流向哪里?
对大多数工作室而言,正确答案是"哪里都不去"。集成在本地运行,Agent 和本地 Server 通信,模型数据不出网。
如果供应商提供云端处理,他们应当能精确说明:传输了什么、存在哪里、存多久、能否完全关闭。在 AEC 与制造业,这往往不是偏好,而是合同条款。
6. 你的 IT 团队能部署它吗?
决定能否上线的,往往不是几何问题:
- 是否支持 SSO 和基于角色的权限?
- 能不能在内网/隔离网运行?
- 构建产物有没有签名?能不能提供 SBOM?
- 审计日志能不能导出到你们在用的 SIEM?
如果这些问题换来的是耸肩,那就准备好打一场漫长的采购仗。
7. 第二个月还撑得住吗?
对集成的真正考验,是新鲜感过去之后。看看团队能不能回答:
- 宿主软件升级时,有哪些东西坏了?
- Agent 给出错误结果时,多久能查出原因?
- 能不能知道上周二到底跑了哪些操作?
第三点需要审计日志,第二点需要溯源,第一点需要供应商把宿主版本适配当成产品面来对待,而不是事后补救。
精简评分表
| 评估项 | 权重 | 好的回答长什么样 | | --- | --- | --- | | 模型语义 | 高 | 单位、约束、结构都被保留 | | 公开工具面 | 高 | 每个工具都列出风险等级 | | 错误处理 | 高 | 结构化、可恢复、具体 | | 可回滚性 | 高 | 自动检查点、可限定范围恢复 | | 数据本地化 | 中 | 默认本地,不外传 | | 企业就绪度 | 中 | SSO、隔离网、签名构建、SBOM | | 长期可用性 | 中 | 有日期的宿主版本支持、公开的更新日志 |
一句话版本
如果只能问一个问题,问这个:我能不能事先说清楚,你的 Agent 被允许对我的文件做什么?
有真答案的供应商,会给你一份策略文档和一份工具清单。这就是"能惊艳一屋子人的演示"和"技术总监真会批准的系统"之间的差别。
在你的真实文件上试一次
装上集成,保留默认的只读策略,看看你的 Agent 面对真实场景状态会做什么。