批改時間去了哪裡
把一次作文或試卷批改拆開,教師的時間大致花在四個環節:逐份閱讀與理解、對照準則逐項給分、撰寫評語、以及統計與記錄。其中「對照準則給分」與「撰寫重複性評語」佔比最高,也最機械:同一班學生的錯誤高度重複,教師往往在寫第三十次同一句評語。AI 能實質接手的,就是這兩個環節。
AI評改真正省時的環節
- 逐項初評:系統按評分準則對每一項先給初步分數,教師由「從零開始評」變成「覆核與修正」
- 重複性評語:常見錯誤的解釋由系統生成,教師只需處理個別化的部分
- 統計與分析:全班的分項表現、常見錯誤分佈自動彙整。人手做這部分最耗時,偏偏它是最有教學價值的資訊
- 多輪修改的跟進:學生修改後的再批改由系統初評,令「一稿一改」變成「多稿多改」而不增加教師負擔
不能省、也不應省的環節
最終決定權必須在教師:每一個對學生有影響的分數,都應經教師確認。設計得好的系統,覆核很快,逐分附上考生答案原文,教師一眼判斷同意與否。設計得差的只給總分、不給理據,教師被迫重改一次,時間不省反增。
另外兩樣不能外判給 AI:對個別學生學習狀況的判斷(AI 看到這一份卷,教師看到這個學生一年的軌跡),以及高風險評估(呈分試、校內考試的最終裁決)。正確的分工是 AI 做量、教師做質。
校內試行的正確方法
建議以「一個科組、一個學期」為單位試行:選一個批改負擔重、願意嘗試的科組(中文或英文寫作是常見起點),設定清晰的使用範圍(例如中四級議論文),試行期內保持正常批改標準。兩個極端都要避免:全校一次過上馬,培訓與支援跟不上;一兩位教師零散試用,數據又太少,無法作採購決定。
試行期要同步做兩件事:每兩星期收集一次教師回饋(十分鐘會議即可),以及記錄使用數據。學期結束時,科組有充分證據決定擴展、調整還是放棄。
如何量度省時效果
方法簡單,但要在試用前開始。請參與教師先記錄一次基準:批改一份指定類型作業平均需時多久,計時三至五份取平均即可。試用一個月後,同樣方法再量一次。兩個數字之差乘以全年批改量,就是可寫入報告的量化成效,例如「中文科作文批改時間由每份約 15 分鐘減至約 6 分鐘,全年釋放約 X 小時用於備課及公開課準備」。
同時記錄質的改變:學生每篇作文的修改次數、收到回饋的等候日數。「學生兩日內收到逐項評語」對報告與家長溝通的說服力,不亞於教師省時。