识别不是回忆:为什么多项选择测验夸大了学习

多项选择测验感觉像是检索练习,但它们通常衡量的是识别度。研究内容是什么,以及如何修正格式。这篇文章首先发表在电子学习行业。

来源:eLearning行业 | 在线教育博客

测试熟悉程度,而不是记忆力

检索实践是学习科学中最可靠的可复制发现之一。要求学习者从记忆中提取信息比要求他们再次复习相同的材料可以产生更好的长期保留效果。 Roediger 和 Karpicke 在 2000 年代中期反复证明了这一点,并且这种效应在各个学科领域、年龄组和延迟中都持续存在。所以我们都添加了测验。每个模块后都会进行知识检查。下一部分之前有五个问题的门。课程结束时进行评论。

大多数测验都是多项选择题,因为多项选择题的编写成本低廉,自动评分也很简单,并且可以在手机上运行。这种便利带来的成本很少出现在完成报告中:多项选择题根本不需要测试检索。它经常测试识别能力,而识别能力比回忆更容易、更浅、更宽容。结果是一个测验看起来像检索练习,得分像成功,并且对表现的预测很差。

问题可以要求的两件事

回忆要求学习者在没有任何支持的情况下从记忆中重建信息。 “触发升级路径的三个条件是什么?”屏幕上没有任何东西可以依靠。学习者要么产生它,要么不产生它。

识别要求学习者判断呈现给他们的东西是否熟悉。 “以下哪一个是触发升级路径的条件?A/B/C/D。”答案就在屏幕上。任务就是把它挑出来。

这些感觉像是同一个问题的不同表现。从认知上来说,他们不是。识别可以通过模糊的熟悉感来支持(措辞看起来像幻灯片 14 中的内容),而学习者无法生成、应用或解释内容。熟悉是一种快速、省力的信号,而它正是格式良好的答案选项免费提供的信号。

实践中的切入点

学习者自己的判断遵循分数。