AI 評量
用 AI 自動生成評分規準並一致套用的實戰工作流程
介紹如何用 AI 生成實作評量的評分規準草案,並一致地套用到學生答案上的流程。
製作實作評量的評分規準時,項目之間的界線常常變得模糊。若區分「優秀」與「普通」的標準無法用一句話講清楚,最後每次評分都會搖擺。昨天看起來是普通的答案,今天看起來卻像是優秀。AI 在評分規準草案的生成與標準套用的一致性這兩處,會帶來出乎意料的大幫助。它減輕從一張白紙擠出項目的負擔,也協助你對 30 個人套用同一把尺。
第 1 階段:用 AI 快速產出評分規準草案
請不要從白紙開始,而是給出評量目標與年級程度,取得四級量尺的評分規準草案。例如輸入「國中二年級自然科探究報告,變因控制、資料解讀、結論妥適性 3 個向度,各 4 個等級」,就會產出敘述草案。接著老師一定要動手修改。直接沿用 AI 草案,會留下與學校現實脫節的敘述。
- 把 AI 寫出的標準改成可觀察的行為動詞。不要寫「理解」,而要像「能區分並標示出兩個以上的變因」這樣,讓評分者用眼睛就能確認。
- 把等級之間的差異用量化方式寫明。放進像「1 項依據」與「2 項以上依據」這種可以數的標準,界線就會變清楚。
- 向度數量收攏在 3~4 個。一貪心,項目就會變多,評分因此崩潰。
第 2 階段:確保套用的一致性
就算評分規準寫得好,由人套用到 30 個人身上時還是會搖擺。這時把 AI 當成輔助評分者來運用。
- 把學生答案與定案的評分規準一起輸入。
- 請 AI 一併輸出各向度的等級與判斷依據的句子。
- 老師只快速讀依據句子,同意或修改。檢視依據而不是分數,既快又準。
不只拿到分數,還要一併拿到「為什麼是這個等級」的依據,向學生與家長說明時才會輕鬆。
常見錯誤與檢查清單
- 評分規準項目一超過 6 個,評分負擔就會暴增。請壓縮成3~4 個核心向度。
- 不要把 AI 的依據句子原封不動交給學生,請先用老師自己的語言修過一遍。機械式的語氣會削弱信任。
- 同一份答案跑兩次結果就搖擺,代表標準的文字寫得模糊。只把那個項目重新寫具體。
- 在評分規準上各附一行滿分範例與未達標準範例,套用時的搖擺會明顯減少。
和學生一起使用的評分規準
把評分規準只當成評分工具,實在可惜。在評量之前先向學生公開,評分標準就直接成為學習目標。知道自己會被用什麼來評量的學生,會朝那個方向準備。實際上像下面這樣運用,效果很大。
- 出作業之前一起讀評分規準,並用範例說明每個向度是什麼意思。
- 讓學生親自用評分規準,去評一份寫得好的答案和一份不足的答案。
- 對照彼此的評分結果,討論同一份答案為什麼會有不同的評價。
走過一次這個流程,學生成果的水準會明顯提升。知道標準才動筆的文章,和不知道就寫的文章,從一開始就不一樣。
重點整理
評分規準的本質是評分的約定。AI 能快速把這份約定草擬出來,並協助你均勻地套用到 30 個人身上。建議先從草案生成與依據輸出這兩件事開始導入。一份好好修整過的評分規準,下個學期、下個年級都能重複使用,因此最初投入的 30 分鐘是最划算的買賣。
登入後參與互動

來發表第一則留言吧。