企业 AI 的系统集成:立项前必须问清的七个问题
企业 AI 项目延期,最常见的原因不是模型效果不好,是"接进现有系统"这件事比预想的复杂得多。
"要接 ERP"这五个字,可能意味着两周,也可能意味着四个月。差别不在技术难度,在于七个立项时就能问清、却几乎没人问的问题。
---
问题一:有没有 API,文档是不是最新的
为什么问:这决定了是"调接口"还是"想办法"。
要拿到的证据:一份接口文档,且能找到一个人说得清它是不是当前版本。
警惕的回答:
- "应该有吧" → 等于没有
- "有,但文档是三年前的" → 需要按"没有"来估工作量
- "厂商说可以做" → 那是另一笔费用和另一个工期
---
问题二:有没有测试环境
为什么问:没有测试环境意味着所有联调都在生产上做,风险和效率都完全不同。
要拿到的证据:能实际访问到的测试环境地址和账号。
如果没有:这件事要在项目计划里单独列一项,因为搭测试环境本身可能就是几周,而且往往需要业务系统厂商配合。
---
问题三:谁能给权限,要多久
为什么问:技术上一天能接完的东西,权限审批可能走一个月。
要拿到的证据:一个具体的人名,和一个大致的审批周期。
这一项在国企、金融、医疗类机构尤其关键——审批链条长且不可压缩,必须提前启动,不能等开发完了再去申请。
---
问题四:数据是只读还是要写
为什么问:这是风险等级的分水岭。
| 只读 | 要写 | |
|---|---|---|
| 风险 | 低 | 高(可能产生错误数据) |
| 回滚 | 不需要 | 必须有 |
| 审批 | 相对容易 | 通常需要更高层级 |
| 建议 | 第一个项目就做 | 第一个项目尽量避免 |
强烈建议:第一个项目做只读。先证明系统能看懂数据,再谈让它改数据。
如果确实要写,第一步做成"生成待确认的操作,由人点确认",观察一段时间后再考虑放开。
---
问题五:接口的稳定性和容量
为什么问:很多内部系统的接口是给低频调用设计的。AI 系统的调用模式可能完全不同——每次对话可能触发多次查询。
要问清的三件事:
- 有没有调用频率限制
- 高峰期的响应时间
- 接口挂了会不会影响业务系统本身
最后一条最重要。如果 AI 系统的调用可能拖垮业务系统,那必须有限流和熔断——这是架构要求,不是可选项。
---
问题六:字段的真实含义
为什么问:字段名和它的实际含义经常对不上,尤其在老系统里。
典型情况:
- 一个叫
status的字段,实际存着五种含义混在一起的值 - 一个叫
remark的字段,业务上被当成正式的分类依据在用 - 同一个概念在两个系统里字段名不同、取值口径也不同
要拿到的证据:能找到一个人,逐字段说清含义和取值范围。
如果找不到这个人:这个集成的工作量要按两三倍估。逆向理解一个没人说得清的数据结构,是最耗时的工作之一。
---
问题七:这个系统会不会变
为什么问:如果业务系统本身在改造中,那接口随时可能变。
要问清:未来半年有没有升级、迁移、更换的计划。
如果有:要么等,要么在设计上做隔离层——不要把 AI 系统直接绑在一个即将被替换的接口上。
---
集成难度分级
用上面七个问题过一遍,通常能落到这三档:
| 档 | 特征 | 相对工作量 |
|---|---|---|
| 简单 | 有 API、有文档、有测试环境、只读、字段清楚 | 基准 |
| 中等 | 缺其中一两项,或需要写入 | 2–3 倍 |
| 困难 | 没有 API、字段无人能解释、或系统正在改造 | 难以估计,需要先做预研 |
"困难"档的正确处理不是硬上,是先做一个小的预研,把不确定性搞清楚再报工期。在不确定的情况下给出一个确定的工期,是项目延期最常见的起点。
---
一个常被忽略的选择:不集成
有时候更合适的方案是先不接。
判据:这个任务,不接业务系统能不能做出 80% 的价值?
很多场景的答案是"能":
- 制度问答——只需要文档,不需要接系统
- 知识辅助——同上
- 报表解读——可以先用导出的文件
先做不需要集成的部分,能带来三个好处:
1. 快——几周就能上线,团队建立信心
2. 积累数据——知道用户实际问什么,这些数据会告诉你真正需要接哪个系统
3. 降低沉没成本——万一场景不成立,损失的只是几周
很多项目一上来就规划要接五个系统,结果半年后还在等权限审批,而那五个系统里可能有三个根本用不上。
---
怎么验收集成部分
集成的验收和答案质量的验收是两回事,要分开量:
| 指标 | 建议门槛 |
|---|---|
| 字段映射正确率 | 100%(逐字段核对,不是抽样) |
| 接口异常处理覆盖率 | 100%(超时/报错/空返回各有处理) |
| 限流与熔断有效性 | 实测触发过 |
| 权限隔离正确率 | 100% |
| 端到端响应时长 | 按场景定,建议 3 秒以内 |
答案质量部分口径沿用开源评测框架 RAGAS(docs.ragas.io)。
"字段映射正确率"必须逐字段核对而不是抽样——一个映射错的字段可能长期不被发现,因为它不报错,只是值不对。这是集成层最典型的隐蔽错误。
"限流与熔断"必须实测触发过。没有实测过的保护机制,和没有是一样的——一个从来没被触发过的保护,你并不知道它触发时会发生什么。验收时应该主动制造一次超限,看它是否按预期拦下。
---
相关阅读
- 企业 AI 私有化部署怎么选:公有云、混合与本地部署的成本结构
- 企业 AI 系统的安全治理:四类特有风险
- 企业做 AI 项目前需要准备哪些资料
- 企业 AI 项目多少钱:把预算拆成四段再谈价
---
*本文说明的是方法与判断标准,不代表任何未公开项目的实施细节。文中引用的开源评测框架,出处已在正文标明,读者可自行核验。*