學習心理學網路教材

Week 17:促進學習的評量與回饋

形成性評量回饋迴圈:學生作品、規準、教師回饋、學生修正、自我監控。
W17-01|回饋迴圈:週 17 是評量與回饋核心,需圖像化。 等級:必要;第 1-4 節:形成性評量與回饋

主要來源:Educational Psychology Ch14-Ch15;Human Learning Ch5、Ch14、Ch17。
避重邊界:大二認知心理學講義已補充評量三角形與證據中心設計。本週從教室實作角度談評量如何促進學習,而不只是總結成績。

本週定位

評量不是教學結束後才發生。每一次提問、小考、作業、討論、草稿回饋與自我檢核,都是蒐集學習證據的方式。若評量只用來排名,學生容易把它視為威脅;若評量能提供下一步資訊,就能成為學習的一部分。

本週要建立評量素養:評量要對齊目標、產生有效證據、提供可用回饋,並注意公平與焦慮。

學習目標

讀完本週後,你應能:

  1. 分辨形成性評量與總結性評量。
  2. 說明信度、效度、標準化與實用性。
  3. 設計能促進學習的回饋。
  4. 用評分規準提升透明度與自我調節。
  5. 說明評量調整與公平的關係。

1. 形成性與總結性評量

形成性評量發生在學習過程中,目的是提供調整資訊。總結性評量通常在單元或課程結束時,用來總結學習結果。

同一工具可能有不同用途。小考若只計分排名,是總結性;若用來發現迷思概念並安排補救,就是形成性。重點不在形式,而在使用方式。

對大一學生,形成性評量特別重要,因為他們常不會準確判斷自己是否理解。短測、出口單、草稿回饋、自我檢核都能幫助學生校準。

2. 好評量的四個品質

信度是評量結果的一致性。若同一份作業不同助教給分差異很大,信度就有問題。

效度是評量是否真的測到想測的能力。若目標是案例分析,卻只考名詞定義,效度不足。

標準化是指施測與評分條件一致,讓結果比較公平。例如相同時間、相同說明、相同規準。

實用性是評量是否能在現實資源中執行。再理想的評量若需要教師無法負擔的批改時間,也難以持續。

3. 回饋要能被使用

低品質回饋常只有評價:「很好」「不清楚」「要加油」。高品質回饋要讓學生知道如何修正。

好回饋通常包含:

  1. 對準目標。
  2. 指出具體表現。
  3. 解釋為何有效或不足。
  4. 提供下一步。
  5. 讓學生有機會使用回饋修正。

如果學生收到回饋後沒有機會修改,回饋就容易變成成績說明,而不是學習工具。

4. 評分規準與自我調節

評分規準能把隱性標準外顯。對新手來說,「分析深入」太抽象;規準可以拆成:理論正確、證據充分、介入對齊、評估可行、倫理考量。

規準不只給教師評分,也可以給學生自評與同儕互評。學生若能用規準看自己的草稿,就開始發展自我監控能力。

5. 評量與焦慮

評量會引發情緒。若學生把每次評量都視為能力審判,焦慮會升高。降低焦慮的策略包括:清楚範圍、提供練習題、使用低風險形成性評量、允許修正、把回饋對準策略而非人格。

但降低焦慮不等於取消挑戰。好的評量應該有挑戰,但流程可預期、標準透明、錯誤可用來學習。

6. 評量公平與調整

公平評量要讓學生有合理機會展示目標能力。若目標不是速度,就不應讓速度成為主要障礙;若目標不是口語表達,就可允許書面或其他形式展示理解。

特殊需求調整不是給特權,而是移除與目標無關的障礙。例如延長時間、提供安靜空間、允許輔具、改變呈現方式,都可能讓評量更接近真正能力。

教學活動

活動一:評量用途判斷

教師列出 8 種評量做法,學生判斷它們目前是形成性還是總結性,並改寫成更能促進學習的版本。

活動二:回饋改寫

把「內容不夠深入」改寫成可用回饋。例如:「你指出學生拖延,但沒有說明拖延如何被負向增強維持。請補上行為前情境、短期後果與替代行為。」

自學任務

拿一份自己寫過的作業,設計 4 欄評分規準。再用規準自評,寫出一個具體修正行動。

檢核題

  1. 形成性評量與總結性評量的差異是什麼?
  2. 效度不足的評量可能造成什麼問題?
  3. 好回饋為什麼需要給學生修正機會?
  4. 評量調整為什麼不等於不公平?

參考答案

  1. 形成性用於學習過程中的調整,總結性用於總結學習結果。
  2. 可能測到錯的能力,導致教師與學生做出錯誤判斷。
  3. 沒有修正機會,學生只能知道結果,不能把回饋轉成學習。
  4. 調整是移除與目標無關的障礙,讓學生更能展示目標能力。