| 平均处理时间、一次解决率、抽样正确率、投诉率 |
| 内部文档问答 | 员工常花时间查制度、流程、产品或技术资料 | 查找时间、人工转问次数、答案采纳率 |
| 报表与会议摘要 | 材料格式相对固定,重复阅读需求高 | 报告产出时间、摘要采纳率、修订次数 |
| 合同或单据字段抽取 | 字段较明确,适合设计人工复核 | 字段正确率、审核时间、返工率 |
| 销售与采购流程辅助 | 可支持信息整理、比对、草拟和初步建议 | 转化率、响应时间、处理周期、人工作业节省 |
不建议一开始就挑最高风险、最复杂、责任边界最模糊的场景。如果数据散乱、流程未标准化,或合规要求很高但治理机制尚未建立,应先补数据和流程,再谈生成式 AI。
AI 落地的难点常不在模型本身,而在数据能否被安全、正确、及时地调用。Talyx 对 RAND Corporation 2024 研究的整理指出,该研究访谈了 65 位资深数据科学家与工程师,并归纳出几个常见 AI 项目失败根因:问题定义被误解、训练数据不足、技术导向而非问题导向、基础设施不足,以及问题本身超出可行范围。
PoC 前至少要检查:
如果数据不可用,模型再强也只能做展示;如果权限设计不清,项目很可能卡在信息安全、隐私、法务、合规或审计环节。
PoC,也就是概念验证,不应只是会议室里的演示版。更好的做法,是把 PoC 当作第一版产品:接真实用户、真实数据、真实流程,并提前定义成功、扩大和停止条件。
一个能进入运营的 PoC,至少要回答:
这一步的关键不是证明 AI 会回答,而是证明 AI 能在现有流程中被稳定使用,并让某个业务指标变好。
扩大 AI 不是多开几个账号。每扩到一个部门,都会遇到新的数据来源、权限规则、流程差异、合规要求和 KPI。
尤其当 AI 从查询、摘要、草拟,走向 AI agents(智能体)或更自主的 agentic AI 时,更应该循序渐进。McKinsey 2025 调查摘要显示,在任何单一职能中,报告已规模化部署 AI agents 的受访者都不超过 10%。McKinsey 另指出,安全与风险是扩展 agentic AI 的首要障碍,而不准确和网络安全仍是最常被提到的 AI 风险。
更稳妥的扩展顺序是:
AI 项目如果只量模型准确率,很容易忽略真正的运营价值。更好的 KPI 设计,是先量当前基准,再用多层指标判断是否值得扩大。
| KPI 类型 | 可用指标 | 适合场景 |
|---|---|---|
| 效率 | 平均处理时间、周转时间、每案人工分钟、报告产出时间 | 客服、报表、单据、文档问答 |
| 质量 | 抽样正确率、人工采纳率、返工率、投诉率 | 客服回复、合同抽取、内容草拟 |
| 使用 | 周活跃用户、任务覆盖率、重复使用率、人工转问次数 | 内部助手、知识检索、部门工具 |
| 业务结果 | 转化率、响应速度、案件结案率、每案成本 | 销售、客服、采购、运营流程 |
| 风险治理 | 人工升级率、政策违规次数、敏感数据处理例外、审计缺陷 | 高风险数据、对外回复、agentic AI |
KPI 一开始不必很多,但必须和流程连在一起。如果 PoC 只能证明 AI 能生成一段文字,却不能证明流程更快、更准、更省人力或更可控,就还不能算真正落地。
很多项目从供应商 Demo 或模型能力出发,最后做出看起来很炫、但没人每天需要的功能。Talyx 对 RAND 研究的整理也把「技术导向而非问题导向」列为常见失败根因之一。
如果业务端想降低客服工时,IT 端在优化模型准确率,管理层期待成本下降,法务又担心风险,项目就会在不同目标之间拉扯。问题定义被误解同样被列为 AI 项目失败根因之一。
AI 如果拿不到正确的文档、客户资料、工单记录或交易数据,就只能回答通用问题。即使答案不错,如果输出不能回到 CRM、ERP、文档库或工单系统,用户仍要手动复制粘贴,价值会被流程成本抵消。基础设施不足也是 Talyx 对 RAND 研究整理出的常见失败根因之一。
AI 使用率提高,不代表已经完成规模化落地。一篇整理 McKinsey 调查的报道指出,虽然 88% 的组织已在至少一个业务职能使用 AI,但近三分之二仍停在实验或早期试点阶段。如果 PoC 没有进入真实流程、没有业务负责人、没有 KPI,最后往往只会停在展示阶段。
信息安全、隐私、合规、审计和权限控制如果等到上线前才处理,项目很可能被迫返工。对 agentic AI 尤其如此,因为更自主的系统通常需要更清楚的数据边界、行动权限、人工复核和责任归属;McKinsey 指出,安全与风险是扩展 agentic AI 的首要障碍。
| 可以优先做 | 建议先暂缓 |
|---|---|
| 每周或每月高频发生的重复任务 | 一年只发生少数几次的特殊任务 |
| 数据已电子化且来源明确 | 数据分散在个人文件、口头经验或非正式记录中 |
| 规则相对清楚,答案可追溯 | 问题定义不清,部门各说各话 |
| 错误可人工复核与修正 | 错误会直接造成重大合规、财务或安全后果 |
| 有业务负责人愿意改流程 | 只有 IT 或顾问推动,使用部门不投入 |
| KPI 可量化,例如时间、正确率、成本、投诉率 | 只说要创新、要 AI 化,但没有效果定义 |
落在右栏的场景不是永远不能做,而是要先补数据、标准化流程、厘清责任和治理,再导入 AI。
启动任何 AI 项目前,可以用这 10 个问题快速检查:
企业 AI 落地要从流程改造出发,而不是从模型采购出发。模型是必要能力,但不是落地本身。真正决定项目能否从 PoC 走向运营的,是数据是否可用、权限是否清楚、流程是否愿意改变、风险是否可控,以及 KPI 是否能证明价值。