企业 AI 的系统集成:立项前必须问清的七个问题

企业 AI 项目延期,最常见的原因不是模型效果不好,是"接进现有系统"这件事比预想的复杂得多

"要接 ERP"这五个字,可能意味着两周,也可能意味着四个月。差别不在技术难度,在于七个立项时就能问清、却几乎没人问的问题。

---

问题一:有没有 API,文档是不是最新的

为什么问:这决定了是"调接口"还是"想办法"。

要拿到的证据:一份接口文档,且能找到一个人说得清它是不是当前版本

警惕的回答

  • "应该有吧" → 等于没有
  • "有,但文档是三年前的" → 需要按"没有"来估工作量
  • "厂商说可以做" → 那是另一笔费用和另一个工期

---

问题二:有没有测试环境

为什么问:没有测试环境意味着所有联调都在生产上做,风险和效率都完全不同

要拿到的证据:能实际访问到的测试环境地址和账号。

如果没有:这件事要在项目计划里单独列一项,因为搭测试环境本身可能就是几周,而且往往需要业务系统厂商配合。

---

问题三:谁能给权限,要多久

为什么问:技术上一天能接完的东西,权限审批可能走一个月

要拿到的证据:一个具体的人名,和一个大致的审批周期。

这一项在国企、金融、医疗类机构尤其关键——审批链条长且不可压缩,必须提前启动,不能等开发完了再去申请

---

问题四:数据是只读还是要写

为什么问:这是风险等级的分水岭

只读要写
风险(可能产生错误数据)
回滚不需要必须有
审批相对容易通常需要更高层级
建议第一个项目就做第一个项目尽量避免

强烈建议:第一个项目做只读。先证明系统能看懂数据,再谈让它改数据。

如果确实要写,第一步做成"生成待确认的操作,由人点确认",观察一段时间后再考虑放开。

---

问题五:接口的稳定性和容量

为什么问:很多内部系统的接口是给低频调用设计的。AI 系统的调用模式可能完全不同——每次对话可能触发多次查询。

要问清的三件事

  • 有没有调用频率限制
  • 高峰期的响应时间
  • 接口挂了会不会影响业务系统本身

最后一条最重要如果 AI 系统的调用可能拖垮业务系统,那必须有限流和熔断——这是架构要求,不是可选项。

---

问题六:字段的真实含义

为什么问字段名和它的实际含义经常对不上,尤其在老系统里。

典型情况:

  • 一个叫 status 的字段,实际存着五种含义混在一起的值
  • 一个叫 remark 的字段,业务上被当成正式的分类依据在用
  • 同一个概念在两个系统里字段名不同、取值口径也不同

要拿到的证据:能找到一个人,逐字段说清含义和取值范围。

如果找不到这个人:这个集成的工作量要按两三倍估。逆向理解一个没人说得清的数据结构,是最耗时的工作之一。

---

问题七:这个系统会不会变

为什么问:如果业务系统本身在改造中,那接口随时可能变。

要问清:未来半年有没有升级、迁移、更换的计划。

如果有:要么等,要么在设计上做隔离层——不要把 AI 系统直接绑在一个即将被替换的接口上

---

集成难度分级

用上面七个问题过一遍,通常能落到这三档:

特征相对工作量
简单有 API、有文档、有测试环境、只读、字段清楚基准
中等缺其中一两项,或需要写入2–3 倍
困难没有 API、字段无人能解释、或系统正在改造难以估计,需要先做预研

"困难"档的正确处理不是硬上,是先做一个小的预研,把不确定性搞清楚再报工期。在不确定的情况下给出一个确定的工期,是项目延期最常见的起点。

---

一个常被忽略的选择:不集成

有时候更合适的方案是先不接

判据:这个任务,不接业务系统能不能做出 80% 的价值?

很多场景的答案是"能":

  • 制度问答——只需要文档,不需要接系统
  • 知识辅助——同上
  • 报表解读——可以先用导出的文件

先做不需要集成的部分,能带来三个好处:

1. ——几周就能上线,团队建立信心

2. 积累数据——知道用户实际问什么,这些数据会告诉你真正需要接哪个系统

3. 降低沉没成本——万一场景不成立,损失的只是几周

很多项目一上来就规划要接五个系统,结果半年后还在等权限审批,而那五个系统里可能有三个根本用不上

---

怎么验收集成部分

集成的验收和答案质量的验收是两回事,要分开量

指标建议门槛
字段映射正确率100%(逐字段核对,不是抽样)
接口异常处理覆盖率100%(超时/报错/空返回各有处理)
限流与熔断有效性实测触发过
权限隔离正确率100%
端到端响应时长按场景定,建议 3 秒以内

答案质量部分口径沿用开源评测框架 RAGAS(docs.ragas.io)。

"字段映射正确率"必须逐字段核对而不是抽样——一个映射错的字段可能长期不被发现,因为它不报错,只是值不对。这是集成层最典型的隐蔽错误。

"限流与熔断"必须实测触发过。没有实测过的保护机制,和没有是一样的——一个从来没被触发过的保护,你并不知道它触发时会发生什么。验收时应该主动制造一次超限,看它是否按预期拦下。

---

相关阅读

  • 企业 AI 私有化部署怎么选:公有云、混合与本地部署的成本结构
  • 企业 AI 系统的安全治理:四类特有风险
  • 企业做 AI 项目前需要准备哪些资料
  • 企业 AI 项目多少钱:把预算拆成四段再谈价

---

*本文说明的是方法与判断标准,不代表任何未公开项目的实施细节。文中引用的开源评测框架,出处已在正文标明,读者可自行核验。*