做法是先把客服原话拆成“可公开的问题结构”和“必须留在内部的身份信息”两层,再只把前者带进选题。一个反常现象是:原话删得越干净,选题反而越容易失真;真正要删的不是情绪和场景,而是能指向具体个人的字段。
客服原话通常同时包含三类信息:用户身份(姓名、订单号、手机号、地址、账号)、个体情境(具体时间、金额、家庭情况)和问题结构(在什么环节卡住、期望什么结果、试过什么办法)。如果只按“敏感词”整段删除,问题结构也会被一起删掉,剩下的往往是一句无法判断的抱怨。
另一种相反做法是原话照搬,把订单号和聊天截图直接放进选题记录。这会让后续写作者无法判断哪些细节可以公开,也容易在二次传播中暴露用户。
对“删干净后选题变差”这个现象,至少有两种合理解释。
区分这两种解释的证据,是看被删内容能否在不指向个人的前提下复述。把原话里的姓名、订单号替换成占位描述后,如果问题仍然讲得通,说明删掉的是隐私;如果替换后问题变得无法判断,说明原话本身缺少问题结构,需要回访补充,而不是继续删。
把每条客服原话改写成固定字段,再决定哪些字段进入选题库。假设有一条原话是“我昨天下午用尾号 1234 的卡付了 299,结果权益没到账,你们是不是骗人”。可以按下面的方式处理:
这个动作的结果是,选题不再依赖某个用户的订单,但保留了用户真正卡住的位置。下一步可以据此判断:是补一篇流程说明,还是在原有页面里增加一个状态解释段落。
必须删除或替换的,是能单独或组合指向具体个人的字段,包括姓名、联系方式、账号、订单号、精确地址、精确时间和可识别的交易金额。
可以保留的,是问题发生的环节、用户使用的功能名称、用户期望与实际结果的差距、用户已经尝试过的操作。这些内容不指向个人,却能决定选题是否具体。
需要谨慎处理的是情绪化表达。情绪本身可以保留为“用户对规则透明度不满”,但不要把带有侮辱或人身指向的原句直接放进公开选题。
复查时不要只问“还有没有敏感信息”,而要问三个可核对的问题:把这条选题交给不了解该用户的同事,他能否说出问题发生在哪个环节;把原话里的数字和时间全部替换后,问题是否仍然成立;如果这条选题被公开引用,是否有人能据此定位到具体用户。
如果第一个问题答不上来,说明问题结构缺失;如果第二个问题答不上来,说明选题过度依赖个体情境;如果第三个问题答“能”,说明还有字段需要替换。只有三个问题都通过,这条原话才适合进入选题库。