คลังความรู้
สร้างเกณฑ์การให้คะแนนแบบรูบริก (Rubric) ให้เป็นเครื่องมือวิจัยที่เชื่อถือได้
คู่มือ · 28 ก.ย. 69
แท็ก: รูบริก, การประเมินตามสภาพจริง, เครื่องมือวิจัย, ความสอดคล้องของผู้ประเมิน, kappa
งานวิจัยในชั้นเรียนจำนวนมากวัดผลจากชิ้นงาน การนำเสนอ หรือทักษะปฏิบัติ ซึ่งแบบทดสอบถูก–ผิดวัดไม่ได้ เครื่องมือที่เหมาะคือรูบริก Brookhart (2013) นิยามรูบริกว่าเป็นชุดเกณฑ์ที่สอดคล้องกัน พร้อมคำอธิบายระดับคุณภาพของงาน รูบริกที่ดีมี 2 องค์ประกอบ คือ เกณฑ์ที่สะท้อน "การเรียนรู้" ไม่ใช่แค่ "ทำงานครบ" และคำอธิบายแต่ละระดับที่ชัดพอให้ครูสองคนให้คะแนนตรงกัน
รูบริก 2 แบบ
- แบบองค์รวม (holistic)
- ให้คะแนนภาพรวมครั้งเดียว เร็ว เหมาะคัดกรองหรือสรุปผล แต่บอกจุดที่ต้องพัฒนาได้น้อย
- แบบแยกองค์ประกอบ (analytic)
- ให้คะแนนทีละเกณฑ์ เช่น เนื้อหา การจัดลำดับ การใช้ภาษา เหมาะกับงานวิจัยเพราะวิเคราะห์พัฒนาการรายด้านได้
ขั้นตอนสร้างรูบริก
- ขั้นที่ 1 เริ่มจากจุดประสงค์การเรียนรู้หรือตัวชี้วัด แล้วเลือกเกณฑ์ 3–5 ข้อที่สะท้อนการเรียนรู้นั้นจริง
- ขั้นที่ 2 กำหนดจำนวนระดับ (นิยม 4 ระดับ) แล้วเขียนคำอธิบายแต่ละระดับเป็นพฤติกรรมที่สังเกตได้ หลีกเลี่ยงคำกว้าง ๆ อย่าง "ดี" หรือ "ค่อนข้างดี"
- ขั้นที่ 3 ให้ผู้เชี่ยวชาญตรวจความสอดคล้องของเกณฑ์กับจุดประสงค์ด้วยค่า IOC (ดูคู่มือ "ตรวจคุณภาพเครื่องมือวิจัย" ในคลังความรู้)
- ขั้นที่ 4 ทดลองใช้กับชิ้นงานจริง 10–20 ชิ้น โดยครู 2 คนให้คะแนนแยกกัน แล้วหาความสอดคล้องระหว่างผู้ประเมิน
- ขั้นที่ 5 ปรับคำอธิบายระดับที่ให้คะแนนไม่ตรงกัน และแนบตัวอย่างชิ้นงานแต่ละระดับ (anchor) เพื่อใช้อ้างอิง
ความสอดคล้องระหว่างผู้ประเมิน
- ร้อยละความตรงกัน
- นับชิ้นงานที่ครูสองคนให้ระดับเดียวกัน หารด้วยจำนวนชิ้นงานทั้งหมด เข้าใจง่ายแต่ไม่ได้หักส่วนที่ตรงกันโดยบังเอิญ
- ค่าแคปปาของโคเฮน (Cohen's kappa)
- หักส่วนที่ตรงกันโดยบังเอิญแล้วแนวทางของ Landis และ Koch (1977): 0.41–0.60 = ปานกลาง · 0.61–0.80 = ค่อนข้างสูง · 0.81–1.00 = เกือบสมบูรณ์
ข้อควรระวัง
- แยกรูบริกออกจากรายการตรวจสอบ (checklist) รายการตรวจสอบบอกแค่ "มี/ไม่มี" ไม่ได้บอกระดับคุณภาพ
- อย่าให้เกณฑ์ด้านความเรียบร้อยหรือความตรงเวลามีน้ำหนักมากกว่าเกณฑ์ที่วัดการเรียนรู้
- แจ้งรูบริกให้นักเรียนรู้ล่วงหน้า รูบริกจะเป็นทั้งเครื่องมือวัดผลและเครื่องมือช่วยการเรียนรู้
แหล่งอ้างอิง
- Brookhart, S. M. (2013). How to create and use rubrics for formative assessment and grading. ASCD.
- Landis, J. R., & Koch, G. G. (1977). The measurement of observer agreement for categorical data. Biometrics, 33(1), 159–174.