可判定的输出不是“写一篇推广方案”这种任务描述,而是让批改者只看提交物就能回答三个问题:目标是什么、依据在哪、下一步做什么。在推广学院这类学习场景里,把文章知识转成实操题,最容易被忽略的一步是给输出设定可观察的判定点,而不是给知识设定记忆点。下面从一个常见矛盾切入,说明两种做法的取舍条件。
读过一篇讲渠道选择的文章后,出题人往往想直接让学生“为一个新产品选渠道并说明理由”。这题贴近真实,但提交上来的答案可能都对,也可能都含糊:有人说选搜索,有人说选社群,理由各自成立,批改者很难给出稳定结论。于是出现两种解释。
解释一:知识本身就没有唯一答案,所以判定标准只能放宽。解释二:题目缺的不是答案,而是约束条件——预算、周期、目标人群、可观测指标只要补齐,原本开放的题就会收敛到可比较的范围。这两种解释对应的出题方式完全不同,需要先分清是哪一种。
判断方法很直接:给同一道题补上具体约束,看候选方案的排序是否发生变化。如果补约束前后,学生给出的选择几乎不变,说明题目考察的其实是立场偏好,不是文章里的判断方法;如果补约束后选择明显分化,且分化理由能对应文章中的判断依据,说明缺的是约束而非标准。
假设一个例子:文章讲的是冷启动阶段优先验证需求,而非铺量。题目若只写“为某工具选推广渠道”,多数人会凭印象作答。若补上“两周内、无付费预算、需要拿到至少若干条真实使用反馈”,那么选择会向能直接触达目标人群、且能快速回收反馈的渠道集中。这里的数字只是说明比较方法,不代表任何真实项目结果。
能区分的证据还包括:学生能否指出自己排除某个选项的具体理由。能指出理由的,说明在应用文章中的判断条件;只能给出结论的,说明还在复述观点。出题时把“说明排除理由”写进要求,判定点就从“选得对不对”变成“推理是否完整”。
做法A是开放题加评分维度。适合目标是训练判断和表达,代价是批改成本高、不同批改者结论可能不一致。适用条件是班次小、有统一评分维度、且允许答案多样。做法B是约束题加可判定输出。适合目标是检验能否把文章方法落到具体决策,代价是题目设计更费工夫,且约束一旦失真,学生学到的是应付条件而非真实判断。
选择依据可以看一个信号:如果多数提交物在“理由”部分高度雷同,说明约束不够,题目没有产生区分度;如果多数提交物卡在理解题意上,说明约束过多或表述不清,应先减条件而不是加评分细则。
把输出拆成固定字段,判定点就落在字段是否填实,而不是文字是否漂亮。可以要求提交物包含:
其中“下一步动作”是最能暴露理解程度的一栏。只写“继续优化”属于不可判定;写成“若反馈量低于预期,则把渠道从A换到B,并观察反馈来源是否变化”,批改者就能判断学生是否真的掌握了文章里的调整逻辑。这里的A、B是占位,实际填写时应替换为具体渠道名称。
一个可执行的动作是:先写出评分时你会问的三个问题,再倒推题目需要提供哪些约束。例如你希望批改时能问“目标是否可观察”“依据是否对应文章条件”“排除理由是否成立”,那么题目里就必须给出目标场景、可用资源和时间范围。做完这一步,通常会发现问题不在学生答得散,而在题目没给足判定所需的信息。
这个动作的结果会直接影响下一步:如果倒推后发现约束多到题目像操作手册,说明该题更适合作为练习而非考核;如果约束刚好能区分选项,就可以把它固定为可重复使用的实操题。推广学院的学习材料若本身偏原则性,出题时更要把原则翻译成条件,否则判定标准只能停留在“看起来有道理”。
最后提醒一点:请求量、提交量或某项统计归零,不能单独证明出题方式正确,也可能是样本太小、题目太难或提交渠道不畅。判定输出是否合格,仍要回到提交物本身能否被稳定批改。