客服原话里真正能变成选题的,往往不是整段对话,而是其中反复出现的任务、卡点和判断分歧。去掉隐私与无关细节的做法可以归纳为三步:先按“可复述的问题”而不是“谁说了什么”来记录,再把身份、订单、联系方式、情绪化表达和一次性偶发信息剥离,最后只保留能独立成立的问题描述。下面用一个假设情境把这个决策过程走一遍。
假设你负责一个销售手工材料的网站,客服转来三段对话记录。第一段里,一位顾客说自己在结算页反复填写地址,最后放弃下单;第二段里,另一位顾客问“你们那个教程里的胶水能不能用在布料上”;第三段里,有人抱怨“上周买的那个套装少了一件,订单号是……”。
这三段话如果原样进入选题库,问题很明显:第一段带着可识别的下单行为,第二段带着具体商品指向,第三段直接包含订单号。它们能说明存在某种摩擦,但不能说明这种摩擦有多普遍,也不能说明原因一定在页面上。缺少完整数据和后台权限时,这一点尤其要写清楚。
提炼的第一步是做一次改写:把“谁遇到了什么”改成“什么任务在什么环节受阻”。可以按下面的顺序处理。
做完这一步,第一段可能变成“结算页地址填写反复失败导致中断”,第二段变成“教程内容与辅料适用范围之间缺少对应说明”,第三段变成“套装缺件后的处理路径不清晰”。这三条都不再指向某个具体的人,但仍然指向可验证的问题。
判断标准不是“敏感不敏感”,而是“这个细节对复现问题有没有必要”。
必须去掉的:能单独或组合识别个人的信息;订单、支付、物流等交易标识;顾客对客服个人的评价;与问题无关的家庭、健康、职业信息;一次性促销活动带来的偶发表述。
可以留下的:问题发生的页面或环节;用户试图完成的任务;用户已经尝试过的操作;用户对结果的预期与实际看到的差异;同一问题在不同对话中重复出现的次数区间。
这里有一个容易走偏的地方:有人为了“保留语境”,把整段对话脱敏后照搬。脱敏只解决了身份问题,没有解决无关细节问题。一段对话里可能八成内容都是寒暄和情绪,真正能支撑选题的只有一两句。留下整段,反而会让后续判断被无关信息带偏。
继续上面的假设情境。把三段话转成问题描述后,你发现只有第一段指向一个可以在没有后台权限的情况下验证的动作:结算页地址填写。第二段需要商品和教程的对应关系数据,第三段需要订单系统权限,两者在当前条件下都无法推进。
于是最小动作是:用一台未登录的浏览器,按新用户路径走一遍结算页地址填写,记录每一步需要输入什么、哪一步可能出现反复修改、页面是否给出明确的错误提示。这个动作不需要客服记录之外的任何数据。
动作的结果会直接决定下一步。如果走查中确实出现地址字段反复报错或提示含糊,就可以把“结算页地址填写反馈不清晰”列为待验证选题,下一步是补充不同地址格式的测试;如果走查顺利,没有出现客服描述中的卡点,就不能据此断定顾客描述不实,因为还可能存在设备差异、浏览器差异、网络状况或顾客操作顺序不同等合理解释。此时下一步不是写选题,而是回到客服记录里确认触发条件是否被完整记录。
这个例子的关键在于:从原话到选题,中间必须经过一次“可复现性”筛选。能复现的进入验证,不能复现的标注为待补充条件,而不是直接当成结论。
客服原话是线索,不是证据。以下推断在缺少完整数据或权限时都不成立。
把这些边界写进选题记录,比写一个漂亮的标题更有用。它让后来接手的人知道这条选题目前站在什么证据上,以及还差什么才能推进。
如果这类提炼会持续发生,可以用一个固定格式减少每次的重复判断。每一行只记录四件事:脱敏后的问题描述、触发环节、当前证据等级、下一步最小动作。证据等级可以粗略分为“仅客服提到”“已走查未复现”“已走查复现”“已有多来源指向”几档,不必追求精确量化。
这样做的好处是,隐私和无关细节在进入记录时就已经被剥离,后续讨论围绕问题本身展开,而不是围绕某个顾客的遭遇展开。当有人问“这条选题为什么还不能写”,答案就在证据等级和下一步动作里,而不需要重新翻原始对话。
回到最初的问题:从客服原话提炼选题,去掉隐私与无关细节不是一次性的清洗,而是一个持续的判断过程。先问这个细节对复现问题是否必要,再问当前证据支持到哪一步,最后只把可执行的最小动作写进下一步。这样得到的选题,既不会泄露个体信息,也不会因为细节缺失而失去方向。