本课定位
用梳理、挖掘、筛选、标注、迭代五步,把分散的客户语言转成有来源、有层级、有优先级的最小可用词库。
学习目标
- 从一方与二方信息源收集真实需求表达。
- 用统一字段完成去重、聚类、分层与优先级判断。
- 建立词库版本、负责人和反馈闭环。
文章大纲
1. 先定义词库的使用场景
- 服务选题、销售赋能、网站架构还是监测;不同用途字段不同。
2. 第一步:梳理内部事实
- 客群、产品、场景、购买角色、销售问题和服务工单。
3. 第二步:挖掘外部语言
- 站内搜索、公开社区、搜索建议、竞品公开内容和客户访谈。
- 记录来源日期,不把工具生成词当用户事实。
4. 第三至四步:筛选与标注
- 去重、聚类、相关性、业务价值、证据可得性、L1-L5、角色与地区。
- 用双人抽样校准解决标注不一致。
5. 第五步:迭代
- 内容表现、销售反馈、站内搜索和新产品共同触发更新。
- 建立新增、合并、停用和迁移规则。
案例设计
为 20 人销售团队使用的 CRM 建立 25 条最小词库,从“客户跟进乱”一直覆盖到迁移与用户评价。
动手练习
用至少三类来源收集 30 条原始表达,清洗后形成首版词库。
提交物
一张至少含原文、来源、角色、场景、层级、优先级、证据和状态字段的词库。
验收标准
- 至少 30 条原始表达,且每条都有来源与日期。
- 清洗与合并保留原始记录,不可丢失追溯关系。
- 抽查 10 条时,两位标注者的一致结论达到预先约定门槛。
发布前核验清单
- [ ] 客户、客服与销售数据已脱敏并符合授权范围。
- [ ] 未把工具预测量写成真实用户需求规模。
- [ ] 优先级公式公开,缺失数据明确标注。
- [ ] 词库有版本号、所有者和下次复盘日。
来源与边界
五步流程依据白皮书 2.5.3;数据源与字段由课程补充,正式项目应遵守企业数据治理要求。