一个学习平台使用 AI 来自动为学生选择题目。
它应该根据每个学生的水平提供合适的练习。
一开始,这个系统看起来运行良好。
有的学生得到更难的题目,有的则得到更简单的。
但几周后,老师们发现了一个问题:
AI 把一些题目判定为“简单”,但很多学生却做不出来。
而有些被认为“困难”的题目却很快被解决。
这个平台本来是想让学习更加公平。
那为什么 AI 会频繁判断错误?
问题: 为什么一个学习 AI 会错误地评估题目的难度?
答案将在明天解锁。
这个 AI 通常是通过间接方式来判断难度的。
例如,它会分析学生完成题目的时间
或者错误的次数。
但这些数据并不能说明全部情况。
短题目可能表达不清而让人困惑。
长题目却可能逻辑很简单。
此外,难度还取决于学生已有的知识。
同一道题对不同学生来说感觉不同。
结果: AI 可以很好地衡量表现 —— 但题目“感觉有多难”, 取决于远不止时间和错误率。