Flipsson教育科技
AI 伦理

把评分交给AI时,公正由谁来守护

AI自动评分很方便,但公正性的责任仍留在人这边。本文梳理在评价中运用AI时必须坚守的原则。

把评分交给AI时,公正由谁来守护 缩略图

如果AI能在几分钟内批改完几百份论述题答卷,老师的加班一定会大幅减少。然而当一名学生问“为什么我的分数是这样”时,不能回答“是AI这么打的”。实际上就有教室发生过这样的事:使用了非标准语的方言表达的答卷被统一打了低分,学生们纷纷喊冤。评价的便利可以由AI提供,但评价公正性的责任始终留在老师身上。要运用AI评分,就得先定好如何担起这份责任。

AI评分会漏掉的东西

自动评分很快,却无法完全代替人的判断。速度快并不等于评价公正。

  • 语境理解不足:可能把有创意的、或有意反转意图的答案判为错答。
  • 表达偏见:容易对文句流畅的答卷给高分,从而评的是形式而非内容。
  • 语言与背景歧视:可能对使用非标准语表达的学生、或特定背景的学生不利。
  • 无法说明:很多情况下给不出为何是这个分数的依据。

打分与正当地解释这个分数,是完全不同的两件事,而后者属于人。

公正运用的原则

把AI评分作为辅助工具安全运用是有方法的。核心是把AI放在一次分类工具的位置上,而不是最终决定者的位置上。

  1. 人做最终确认:AI给的分数只是初稿,由老师复核后确定。
  2. 限制高利害评价:在升学、升级这类重大评价中避免单独使用。
  3. 公开标准:把评分标准事先告知学生,给出可预期性。
  4. 异议流程:一旦对分数有疑问,要开通向人请求复核的通道。

无法向学生解释的分数,再快也不是公正的分数。

尤其是成绩与学生升学出路直接挂钩的评价,越是要降低对AI的依赖、提高人的判断比重。单纯的客观题评分可以积极使用AI,而考察思考深度的论述题则必须由人在最后过目——像这样分配角色,效率与公正就能兼得。

核心要点

AI评分的核心问题不是“有多快”,而是“有多公正、多可解释”。第一,认清语境、表达、背景歧视以及无法说明这些局限。第二,由人做最终确认,在高利害评价中避免单独使用。第三,公开标准并开通异议流程。AI可以做提高评分速度的助手,却当不了对公正负责的评价者。只有当人守住那个责任的位置,自动化才终于赢得信任。对学生来说,分数不只是一个数字,而是关于自己的努力被如何读解的讯息。在不把这条讯息整个交给机器、而由人负责到底的课堂里,学生才会信任评价,并重新获得走向下一次挑战的力量。

登录后参与互动
评论 0

来发表第一条评论吧。

同一主题 · AI 伦理
推荐文章