คลังความรู้

สร้างเกณฑ์การให้คะแนนแบบรูบริก (Rubric) ให้เป็นเครื่องมือวิจัยที่เชื่อถือได้

คู่มือ · 28 ก.ย. 69

แท็ก: รูบริก, การประเมินตามสภาพจริง, เครื่องมือวิจัย, ความสอดคล้องของผู้ประเมิน, kappa

งานวิจัยในชั้นเรียนจำนวนมากวัดผลจากชิ้นงาน การนำเสนอ หรือทักษะปฏิบัติ ซึ่งแบบทดสอบถูก–ผิดวัดไม่ได้ เครื่องมือที่เหมาะคือรูบริก Brookhart (2013) นิยามรูบริกว่าเป็นชุดเกณฑ์ที่สอดคล้องกัน พร้อมคำอธิบายระดับคุณภาพของงาน รูบริกที่ดีมี 2 องค์ประกอบ คือ เกณฑ์ที่สะท้อน "การเรียนรู้" ไม่ใช่แค่ "ทำงานครบ" และคำอธิบายแต่ละระดับที่ชัดพอให้ครูสองคนให้คะแนนตรงกัน

รูบริก 2 แบบ

แบบองค์รวม (holistic)
ให้คะแนนภาพรวมครั้งเดียว เร็ว เหมาะคัดกรองหรือสรุปผล แต่บอกจุดที่ต้องพัฒนาได้น้อย
แบบแยกองค์ประกอบ (analytic)
ให้คะแนนทีละเกณฑ์ เช่น เนื้อหา การจัดลำดับ การใช้ภาษา เหมาะกับงานวิจัยเพราะวิเคราะห์พัฒนาการรายด้านได้

ขั้นตอนสร้างรูบริก

  1. ขั้นที่ 1 เริ่มจากจุดประสงค์การเรียนรู้หรือตัวชี้วัด แล้วเลือกเกณฑ์ 3–5 ข้อที่สะท้อนการเรียนรู้นั้นจริง
  2. ขั้นที่ 2 กำหนดจำนวนระดับ (นิยม 4 ระดับ) แล้วเขียนคำอธิบายแต่ละระดับเป็นพฤติกรรมที่สังเกตได้ หลีกเลี่ยงคำกว้าง ๆ อย่าง "ดี" หรือ "ค่อนข้างดี"
  3. ขั้นที่ 3 ให้ผู้เชี่ยวชาญตรวจความสอดคล้องของเกณฑ์กับจุดประสงค์ด้วยค่า IOC (ดูคู่มือ "ตรวจคุณภาพเครื่องมือวิจัย" ในคลังความรู้)
  4. ขั้นที่ 4 ทดลองใช้กับชิ้นงานจริง 10–20 ชิ้น โดยครู 2 คนให้คะแนนแยกกัน แล้วหาความสอดคล้องระหว่างผู้ประเมิน
  5. ขั้นที่ 5 ปรับคำอธิบายระดับที่ให้คะแนนไม่ตรงกัน และแนบตัวอย่างชิ้นงานแต่ละระดับ (anchor) เพื่อใช้อ้างอิง

ความสอดคล้องระหว่างผู้ประเมิน

ร้อยละความตรงกัน
นับชิ้นงานที่ครูสองคนให้ระดับเดียวกัน หารด้วยจำนวนชิ้นงานทั้งหมด เข้าใจง่ายแต่ไม่ได้หักส่วนที่ตรงกันโดยบังเอิญ
ค่าแคปปาของโคเฮน (Cohen's kappa)
หักส่วนที่ตรงกันโดยบังเอิญแล้วแนวทางของ Landis และ Koch (1977): 0.41–0.60 = ปานกลาง · 0.61–0.80 = ค่อนข้างสูง · 0.81–1.00 = เกือบสมบูรณ์

ข้อควรระวัง

  • แยกรูบริกออกจากรายการตรวจสอบ (checklist) รายการตรวจสอบบอกแค่ "มี/ไม่มี" ไม่ได้บอกระดับคุณภาพ
  • อย่าให้เกณฑ์ด้านความเรียบร้อยหรือความตรงเวลามีน้ำหนักมากกว่าเกณฑ์ที่วัดการเรียนรู้
  • แจ้งรูบริกให้นักเรียนรู้ล่วงหน้า รูบริกจะเป็นทั้งเครื่องมือวัดผลและเครื่องมือช่วยการเรียนรู้

แหล่งอ้างอิง

  • Brookhart, S. M. (2013). How to create and use rubrics for formative assessment and grading. ASCD.
  • Landis, J. R., & Koch, G. G. (1977). The measurement of observer agreement for categorical data. Biometrics, 33(1), 159–174.
กลับคลังความรู้