英文作文發回來,上面寫著78分。學生先處理這個數字帶來的判斷:夠不夠好、比上次高多少、同學拿幾分。頁邊回饋得排在這些念頭後面。台灣高中生或大學生需要成績放進學期紀錄,老師無法拿掉分數,卻能調整出現順序。先給描述性回饋與修改時間,學生用過意見之後,再公開分數。
數字很快就結束搜尋
分數把複雜表現壓成量尺上一個位置,適合成績登記、檢定與課程決定。它很難直接告訴學生下一稿要改什麼。同樣是78分,一篇文章可能論點準確、段落銜接鬆散、冠詞錯誤反覆出現,還有兩句太接近資料原文。另一篇也許文法乾淨,證據卻很薄。
一張虛構封面寫著:78分。主張清楚。冠詞有誤。請看第二段。
分數與評語同時出現在頁面時,數字最容易處理。半秒內就能回答「我考得怎樣」。文字回饋需要較慢的工作:找到對應段落、理解評分標準、比較改法、安排下一步。趕時間的學生可能掃過幾行字,和同學交換分數,接著把作文收進書包。
老師可以替較慢的工作保留一段時間。
評語會和分數搶注意力
Ruth Butler的1988年實驗把12個五、六年級班級分配到三種條件:只收評語、只收數字成績、同時收到成績與評語。論文摘要報告132位隨機選出學生的結果,涵蓋高、低學業表現。只收評語的學生,興趣與作業表現最高。只給成績和成績加評語的整體模式接近,部分高成就學生在預期後續評分時呈現不同反應。
「成績加評語」沒有自動合併兩者優點。分數傳遞的評價訊號,可能蓋過針對任務的資訊。
Anastasiya Lipnevich與Jeffrey Smith找來464位普通心理學課程學生,研究相近問題。參與者修改一題申論考試,條件交錯包含詳細回饋、暫定成績、稱讚,以及回饋來源。兩人的2009年實驗發現,針對作業內容的詳細回饋與較高修訂成績密切相連。描述性回饋單獨出現時表現最好。暫定成績大致壓低後續表現,稱讚在部分條件下改變了這個效果。學生以為回饋來自老師或電腦,在這項任務中差異很小。
這些控制實驗有清楚邊界。Butler研究兒童完成聚合與發散任務。Lipnevich與Smith只研究一篇心理學申論,沒有追蹤一學期的第二語言發展。資料也無法證明每位學生看到分數後都會忽略評語,更不支持學校停止登記成績。較合適的應用,是在還能修訂時,把改善與評價拆成兩個時刻。
把發回作業分成兩次
以虛構的全民英檢寫作班為例。星期二,老師發下第一稿,標出兩種要跨稿追蹤的語言錯誤,再寫一則讀者回應:「第二段的例子和主張之間缺了一步。」分數欄先蓋住。學生有17分鐘替問題分類,重寫一句,再補上說明邏輯關係的銜接句。同伴只讀修訂後的段落,指出哪一句讓論證變清楚。
星期四交回修訂稿後,老師公布評分規準各項分數,附上一句話說明哪個描述等級改變。分數仍然存在,只是等回饋循環完成才出現。
| 第一次發回 | 修訂之後 |
|---|---|
| 兩種要追蹤的錯誤 | 評分規準分數 |
| 一個讀者無法理解之處 | 與前稿相比的變化 |
| 一項明確修訂要求 | 課程成績紀錄 |
回饋量也要小到能用。整頁每個錯誤都標滿,學生難以選擇,老師也會耗盡時間。巧克教育談少改幾種錯誤並跨稿追蹤的文章,解釋窄而穩定的目標如何留下變化紀錄。
回饋後面要有動作
「組織很好」提供愉快訊息,沒有帶來下一個決定。「把第6句移到例子前面,再補一句說明例子如何支持主張」會產生看得見的修訂。頁邊只寫「冠詞」是類別名稱。請學生找出四個漏掉限定詞的名詞片語,才把名稱轉成提取與編輯。
第一次收到回饋時,可以固定做四件事:
- 先用2分鐘讀完所有評語,不拿筆。
- 用自己的話把每則評語改寫成動作。
- 選一項改變意思的動作,再選一項改善語言準確度的動作。
- 交出修改過的句子,附一行說明改了哪裡。
老師接著檢查學生如何回應,無須立刻重讀全文。學生若誤解評語,問題會在分數把注意力拉向排名之前現形。
我們偏好在幾天內確實有修訂時延後給分。期末外部考試沒有第二稿,分級決定也可能急需結果。申請期限逼近時,學生同樣需要立即看到紀錄。這些情況很難拆成兩次,老師可以用短談話把注意力帶到一則能採取行動的評語。
稱讚也需要精準
稱讚可能把注意力拉向身分,和分數拉向排名的作用相似。「你很有寫作天分」沒有提供下一段的路線。「第三段例子包含日期、行動者與結果,讀者能查核你的主張」則指出可重複的特徵。學生能把三個特徵帶到下一段,無須維護一個關於天分的標籤。
下次發作文時,用可撕便條蓋住分數。封面只留兩個提示:指出最先修改的句子,再寫出修改後讀者會多懂什麼。等學生回答並完成修改,再讓他揭開便條。