可判定的输出,核心不是“看起来做对了”,而是提前写清输入、动作和可观察结果三者的对应关系。假设你正在站长交流里读到一篇讲站点日志排查的文章,想把其中“先看状态码分布,再定位异常路径”的知识变成一道实操题:如果只写“请排查日志”,学员交什么都无法判定;如果写成“给定一份含状态码、路径、时间的日志片段,标出你认为最值得先查的三条路径,并说明每条依据”,就有了可判定的边界。关键在于,判定标准要落在提交物上,而不是落在“理解程度”上。
同一篇文章知识,可以出成两类题,判定方式完全不同。
如果你要判的是“会不会按步骤做”,就选判动作;如果要判“能不能在信息不全时取舍”,就选判结论。两者混在一道题里,最容易出现“操作对了但分析没写”或“分析合理但没动手”的争议。一个实际动作是:出题前先写下这道题的最低通过提交物是什么,只有这一项写清楚,后面的评分点才有落点。
假设这样一个情境:某站点原本访问量稳定,日志里状态码以 200 为主;最近一周,同一批路径开始出现较多 404 和 301 混排,同时抓取频次没有明显下降。文章里讲的是“按状态码分布定位异常”,但前提已经变了——原来可以直接按状态码排序找异常,现在需要先区分“路径本身变了”还是“跳转链没收敛”。
这时题干必须把变化前后写出来,让学员在两种决策间选:
这两种选择成立的条件不同:前者适合变化集中、可追溯到具体改动;后者适合变化弥散、更像规则层问题。题干里把这两个条件写出来,学员才知道自己该往哪边走,判卷人也有依据判断选择是否合理。
可判定的输出,评分点应当能被另一个人独立复核。做法是把每个评分点写成“提交物中是否出现某类信息”,而不是“分析是否到位”。
这里有一个容易忽略的点:请求量、抓取量或某项统计归零,不能单独证明处理正确。它也可能是采集周期变化、日志切割、过滤规则调整造成的。所以评分点里不要写“流量恢复即通过”,而要写“是否说明了该现象的其他合理解释,并给出区分方法”。这样判定才不会被单一数字带偏。
假设学员提交了这样一份答案:列出三条 404 路径,附上各自首次出现时间,判断为“路径改动未同步”,下一步动作是“核对最近一次内容调整记录”。按上面的评分点,这份答案可以判定为通过,因为它有具体路径、有可核对信息、有判断条件、有下一步动作。
如果另一份答案只写“日志有异常,建议检查网站”,则无法判定通过,因为它没有可复核的对象。这个对比说明:判定标准不是越严越好,而是要让“通过”和“不通过”的边界在提交物上可见。出题人可以先拿一份假想答案走一遍评分点,如果自己都无法稳定判断,就说明题干还缺条件。
实操题跑过一轮后,你会得到两类反馈:一类是学员普遍卡在同一个判定点,另一类是评分点之间互相矛盾。前者说明题干缺少必要前提,应该把变化条件写得更明确;后者说明你把动作题和结论题混在了一起,应该拆成两道,或者明确以哪一类为主。
一个可执行的动作是:每次只调整一个变量,比如只增加一条前提信息,或只合并一个评分点,然后观察判定争议是否减少。如果争议仍然集中在“依据是否充分”上,就把依据要求改成必须引用题干中的具体字段,例如状态码、时间、路径三者至少引用两项。这样调整后,判定会从主观印象转向对提交物字段的核对,下一步的出题和改题才有稳定基础。