# 催收质检从抽检变成全量

某持牌消费金融公司 · 消费金融 · 试点 8 周

某持牌消费金融公司把催收质检从 8% 抽检改成全量过评测集。8 周试点结束时，合规漏检从 11.2% 降到 2.4%，单通质检 CPRT 从 4.8 元降到 1.1 元。

- 全量：质检覆盖，原先抽检 8%
- 2.4%：合规漏检，原先 11.2%
- ¥1.1：单通质检 CPRT，原先 ¥4.8

服务：[FDE](/services/fde)、[Agent 试点](/services/pilot)、[AgentOps](/services/agentops)

## 原来卡在哪

坐席规模上来之后，质检仍靠抽检。监管问询要补材料时，才发现话术漂移、禁催时段和敏感表述漏过去了。通用质检模型在他们的方言和产品话术上误报高，业务不敢全量启用。

## 怎么做

1. 从近 12 个月录音里抽出 1,200 通，标出 12 类失败：禁催、威胁、费率误述、未核对身份等。
2. 评测集先冻结，再把质检智能体接到现有质检台，不另做一套控制台。
3. 命中高风险类别必须人工复核；低风险类别写入工单备注，抽检仍保留作对照。
4. 上线门禁用任务成功率、漏检率和单通 CPRT，不用「模型准确率」。

## 试点结束时留下什么

试点第 6 周全量切换。抽检对照连续两周与全量质检结论一致后，质检编制从「听录音」改成「审例外」。后续按月回归评测集，话术一改就重跑，避免上线即腐烂。

- 接到质检台的智能体，含人工复核队列
- 1,200 通标注评测集与 12 类失败口径
- 单通质检 CPRT 基线与月度回归方式
- AgentOps：漏检率、接管率、CPRT 看板

## 相关

- [Agent 试点](/services/pilot)：6–8 周做成一个可上线场景。
- [术语：CPRT](/glossary/cprt)：单通质检为什么不看 Token 单价。
- [装备制造售后](/cases/manufacturing-aftersales)：同一套评测门禁，换到工单场景。
