评价:分数之外还能看什么
本文性质: 实证 + 假设(Evidence / Hypothesis) 证据标签: 观察 Observation/模型 Model/假设 Hypothesis/实证 Evidence
本篇涉及的证据类型:实证 Evidence/假设 Hypothesis/模型 Model/观察 Observation。凡属本院课堂观察与教学模型的部分,均不作效果承诺。
一次考试结束,分数发下去,学生看到的是自己在人群里的位置。下一次他要做什么,分数通常不告诉他。评价的信息量不足,是很多学习改进停在中途的原因。
只给分数,学生学到的是排序
本院家长访谈里最常听到的一句话是:孩子知道考了多少分,但不知道下一步该练什么。分数是一个结果指标,它回答了比谁高比谁低,没有回答哪一步断了、下一步补哪里。当评价只提供排序信息时,学生的自然反应是调整投入的意愿,而不是调整方法。于是提高成绩的办法只剩下一个:多花时间。
评价的信息量决定下一次行动
Black 与 Wiliam 1998 年的综述把形成性评价与学习结果联系起来,此后被大量引用;但 Bennett 2011 年在同一期刊上提出,早期综述中的部分效应量被高估,且形成性评价在实践中形态差异极大,难以当成一个统一干预。综合来看,比较稳妥的说法是:指向下一步行动的反馈与学习结果存在正向关联,但关联的大小取决于反馈是否具体、是否及时,它不是把分数换一种写法就能得到的。
一次评价里放三样东西
本院课程研发部建议一次评价里放三样东西:第一,结果,也就是做对了什么、做错了什么;第二,依据,说明判断的标准是什么,让学生看见尺度;第三,一个下一步动作,只给一个,且小到当天能做完。三样东西合起来,评价才从排序变成导航。这套结构属本院内部评价建议。
描述性评价不是取消标准
第一,描述性评价不是取消标准,没有标准的描述只是感受。第二,反馈越具体越费时间,因此不可能每一次都做全套,只能择要。第三,若评价只描述不给动作,学生仍会停在原地,三样之中缺了第三步,前两步的效果会大幅打折。
今天就能开始
下次批改时,在分数旁边只加一句话:下一步做哪一个具体动作。
本文依据
- 观察来源: 本院家长访谈与教师批改习惯记录:多数反馈只含结果不含下一步动作——属访谈观察,未做统计检验。
- 模型出处: 结果/依据/一个下一步动作的三段结构,为本院课程研发部内部评价建议,非外部研究成果。
- 待验证项: 三段结构相对单纯给分的增益幅度,本院尚无对照数据。
- 外部文献: Black & Wiliam 1998(Assessment in Education);Bennett 2011(Assessment in Education);Hattie & Timperley 2007。