自动化失败,多数不是技术问题
谈到流程自动化,企业通常先想到把重复工作交给系统,关注的是正常情况下的步骤顺序。但上线后真正带来麻烦的,往往是意料之外的情况:数据缺失、接口超时、规则冲突,或是需要人工判断的灰色地带。
- 数据不完整或格式异常
- 外部系统响应延迟或失败
- 业务规则在运行中发生变化
- 需要人工判断的灰色地带
先画异常分支,再画正常流程
可靠的自动化,应当把异常处理当作流程的一部分来设计,而不是在系统上线后再补充。每条自动化链路,都需要预先回答出错之后会发生什么。
- 每个步骤可能失败的原因
- 失败后的默认行为是什么
- 哪些异常必须转交人工
- 失败信息如何被记录与复盘
明确边界:什么可以自动,什么必须保留人工
自动化的边界,取决于动作是否可逆、影响范围是否可控,而不是取决于技术能否做到。
- 只读与查询类操作,边界相对宽松
- 发送消息、修改记录、对外发布等会改变外部状态的操作,需要确认与权限
- 涉及承诺、金额、合同的环节,必须保留人工审核
回滚与接管:让自动化可以被停下来
自动化系统必须能够被检查、被暂停、被接管。运行中留下清楚的记录,出错时才能知道发生了什么、影响到了哪里、如何恢复。
- 保留关键过程记录
- 预设停止与回滚方式
- 明确人工接管的入口与责任人
互花的判断
流程自动化的价值,不在于替代更多环节,而在于让重复工作更稳定、更可检查、更可恢复。先想清楚出错之后怎么办,自动化才能真正进入日常经营,而不是变成新的隐患。