AI 倫理
把評分交給 AI 時,公平由誰來守
AI 自動評分很方便,但公平的責任仍然留在人身上。本文點出在評量中運用 AI 時該守住的原則。
如果 AI 能在幾分鐘內批改完幾百張申論答案卷,老師的加班一定會大幅減少。但是當一位學生問「為什麼我的分數是這樣?」時,總不能回答「是 AI 這樣打的」。實際上也發生過這樣的事:某個班級裡,用非標準語的方言(韓語的地方方言)寫成的答案被一律打了低分,學生們大喊冤枉。評量的方便可以由 AI 提供,但評量公平的責任,到最後都留在老師身上。要運用 AI 評分,就得先決定好要怎麼守住那份責任。
AI 評分會漏掉的東西
自動評分很快,卻無法完全取代人的判斷。速度快,並不等於評量公平。
- 對脈絡的理解不足:可能把有創意、或刻意反轉題意的答案判成錯誤。
- 表達偏誤:容易對流暢的句子給出寬鬆的分數,變成評形式而不是評內容。
- 語言與背景的歧視:對非標準語的表達,或特定背景的學生可能不利。
- 無法說明:很多時候提不出「為什麼是這個分數」的依據。
打分數,和正當地說明那個分數,完全是兩回事,而後者是人的責任。
公平運用的原則
把 AI 評分當成輔助工具安全使用,是有方法的。關鍵是把 AI 放在初步分類工具的位置,而不是最終決定者。
- 由人做最終確認:AI 給的分數只是草稿,由老師檢視後定案。
- 限制高風險評量:升學、升級這類重大的評量,避免單獨使用。
- 公開標準:事先把評分標準告訴學生,給他們可預測性。
- 申訴流程:對分數有疑問時,開一條向人請求複查的路。
無法向學生說明的分數,再快也不是公平的分數。
尤其成績越是直接牽動學生生涯出路的評量,越要降低對 AI 的依賴、提高人的判斷比重。單純的選擇題評分積極交給 AI,看思考深度的申論題則一定由人在最後看過一遍——像這樣分工,效率與公平就能一起顧到。
重點整理
AI 評分的核心問題不是「有多快」,而是「有多公平、多能說明」。第一,認清脈絡、表達、背景歧視與無法說明這些侷限。第二,由人做最終確認,在高風險評量中避免單獨使用。第三,公開標準並開放申訴流程。AI 可以是加快評分速度的助手,卻當不了為公平負責的評量者。當人守住那個負責的位置,自動化才總算贏得信任。對學生來說,分數不只是一個數字,而是一則訊息——關於自己的努力被怎麼讀懂。不把那則訊息整個丟給機器、由人負責到最後的教室裡,學生才會信任評量,也才會重新拿到走向下一次挑戰的力氣。
登入後參與互動

來發表第一則留言吧。