
自动评分:智能化AI私有化阅卷系统的价值与意义
改了三百份卷子之后你会发现一个现象:前面改的卷子普遍比后面改的严。不是故意的,是手累了眼花了标准不知不觉就松了。
进一步说,人工阅卷的准确性受多种因素影响:批改者的精力状态、对评分标准的理解、对不同表述方式的接受度、连续工作后的疲劳程度。这些因素叠加起来导致评分标准很难从头到尾保持一致。
AI系统在评分一致性方面有天然优势。同一道题改第一份和第一千份用的是完全一样的标准不存在疲劳和情绪波动。光一致性这一项就比人工阅卷的准确性稳定很多。至少不会出现前面改严了后面改松了的问题。
说到这个,某校使用系统一学年后做了一次满意度调查:82%的学生认为评分比以前更公正了,76%的学生表示现在查分时能清楚看到扣分理由不再觉得分数是”黑箱”。老师方面91%认为审核系统给分比自己从头改更省心也更准确。
每次月考出成绩后总有学生拿着卷子来找老师:这道题我觉得不该扣这么多分。老师重新看看有时候确实改错了有时候是标准理解的问题。这种事在主观题上太常见了。
评分透明化是未来的方向。当每一分的评分依据都清晰可查时,考试评价的公信力会大大提升。学生对评价体系的信任是教育有效性的重要基础。