可判定的输出,核心不是“做完一道题”,而是让答案能被第三方按同一标准判对错。前提是你已经把文章里的知识拆成了可观察动作;如果文章只给方向、不给判定边界,那么再努力设计实操题,也只能得到主观评价。下面先给成立条件,再给一个会让整套设计失效的反例,最后说明下一步该改什么。
同一篇文章可以设计出三类实操题,判定难度完全不同。
把这三类混在一道题里,是最常见的失败来源。比如让读者“优化一个页面并说明为什么”,动作和理由都能写,但判定时你既无法确认改动是否完整,也无法确认理由是否来自文章。更稳的做法是拆成两题:一题只交改动结果,一题只交条件判断。
完成线要写成“满足以下任意一条即通过”或“以下条件全部满足才通过”,并明确哪些属于必须项、哪些属于加分项。假设你从一篇讲页面结构知识的文章出题,可以这样设置:
这里的数字只是举例说明判定方法,不是行业标准。关键是每个数字都能在答案里被直接看到,而不是靠阅卷人回忆文章。无法被直接看到的条件,比如“理解是否到位”,不要写进完成线。
已有实际业务的读者,往往面对的是“前提变了,做法要不要跟着变”。这时实操题不应只设一个标准答案,而应要求答题者先写出前提,再给对应做法。例如:
假设你手上有一个内容量不大、更新频率低的站点,文章里给出的内链做法是按主题聚类集中添加;如果站点变成每日更新、栏目交叉频繁,同一做法是否仍然成立?要求答题者写出:在哪种更新频率和栏目结构下沿用原做法,在哪种情况下需要改成按单篇相关度添加,并各给一条判断依据。
判定时只看两件事:前提是否写清楚,做法是否与前提对应。这样即使两个人给出相反结论,只要各自的前提和依据成立,都可以判为通过。反过来,如果答题者只写“要灵活处理”,没有写出任何前提,就不通过。
如果文章本身只给了结论,没有给条件,那么无论完成线写得多细,实操题都会退化成背诵检查。比如文章只写“标题要包含核心词”,没有说明在什么页面类型、什么搜索意图下需要调整,那么出题时你只能要求答题者复述这句话,或者凭个人经验补条件。后者会让判定重新变得主观。
这时正确的动作不是继续加题,而是回到文章,把缺失的条件补上:哪些页面适用、哪些页面不适用、判断依据是什么。补完之后,再按前面的三类题重新设计。这个动作的结果会直接影响下一步——如果条件仍然补不出来,说明这篇文章暂时不适合做可判定的实操题,应先换成有明确边界的材料。
不要一次设计十道题。先选文章里条件最清楚的一个知识点,按“前提—动作—完成线”写一道题,然后找一个人按完成线判一次。如果判定过程中出现两次以上“这条算不算满足”的犹豫,说明完成线还不够可观察,应先改完成线,而不是增加题量。只有当一道题能被稳定判对错时,再把它复制到其他知识点上,整套实操题才有意义。