AI教育

IMPACT ENGLISH · SINCE 2002

学习数据:被记录下来的那些

2026-10-01 19:13:44 AI教育研究组 24374

本文性质: 观察 + 假设(Observation / Hypothesis) 证据标签: 观察 Observation/模型 Model/假设 Hypothesis/实证 Evidence

本篇涉及的证据类型:观察 Observation/假设 Hypothesis。凡属本院课堂观察与教学模型的部分,均不作效果承诺。

每做一道题、每听一段音频、每停留三秒,都可能被记下来。数据本身不坏,但家长和学生往往不知道被记了什么、用来做什么。

家长最常问的两个问题

本院在家长课堂上收集到的高频提问有两类。第一类是「这些数据安全吗」,第二类是「数据能不能告诉我孩子哪里弱」。两个问题指向同一件事:多数使用者并不清楚学习类工具记录了什么、这些记录留在哪里、被谁使用。座谈中能完整说出所使用工具数据条款内容的比例很低,多数人只看过弹窗第一屏。这不是疏忽,是这类信息的设计门槛本来就高。属座谈观察。

学习分析的能见与不能见

学习分析(learning analytics)领域把可用数据分成若干层:点击与停留时长、答题正确率、重试次数属于行为层;能力诊断、掌握度估计属于推断层。行为层数据相对可靠,但它测的是操作,不是理解——同一道题做对,可能是真会,也可能是排除法或猜。推断层依赖模型假设,不同系统对同一个学生的估计可能不同。Tsai 与 Gašević 2021 年综述学习分析应用时归纳出三类问题:数据质量与覆盖不足、模型可解释性不够、以及把预测结果当成结论使用。Long 与 Siemens 2011 年提出这一领域的定义与研究议程时,也把「数据可见与使用边界」列为核心议题。这一组属实证与综述结论。

本院的使用口径:三条数据纪律

本院在涉及学习工具的使用上给了三条纪律。第一,能不开的权限不开:一个只用来背单词的工具,不需要通讯录与位置权限。第二,先看数据用来做什么,再看它写得多长:重点看「与谁共享」「保留多久」「能否删除」这三项。第三,把数据当线索不当结论:系统说某类题薄弱,只作为下一步抽查的方向,不作为能力判断。第三条尤其重要,因为诊断结果会影响学生对自我的判断,而这种判断一旦形成很难被一次小测推翻。以上为本院内部使用建议。

边界

有三条边界。第一,不同工具与地区的数据规则差别很大,本文不针对任何具体产品,也不提供法律意见。第二,本文不主张不用工具,而是主张知道自己在交换什么。第三,学习分析本身有正面价值:掌握度估计能帮老师发现集体性误解,这在没有数据时很难察觉。本院没有做过数据使用方式与学习效果的研究。

今天就能开始

打开手机上任意一个学习类应用,找到数据设置,只看三项:与谁共享、保留多久、能否删除;看完再决定要不要继续用。

本文依据

  • 观察来源: 本院家长课堂座谈记录(2023 年至今):多数家长未完整阅读所用工具的数据条款;属座谈观察,未做统计检验。
  • 模型出处: 「三条数据纪律」为本院内部使用建议,非外部研究成果。
  • 待验证项: 数据可见度提高是否改变使用行为,需行为实验检验;本院尚无该研究。
  • 外部文献: Tsai & Gašević 2021(学习分析应用的三类问题);Long & Siemens 2011(学习分析的定义与研究议程)。
首页 课程 研究 微信