Menu

Bolehkah ChatGPT menilai jawaban tentang rubrik jawaban pendek?

Bolehkah ChatGPT menilai jawaban tentang rubrik jawaban pendek?

Dalam simulasi penilaian pukul 20.00, guru VIII SMP menempelkan jawaban tentang rubrik jawaban pendek ke ChatGPT lalu menerima skor tanpa jejak alasan yang cukup. Itu skenario buatan untuk memeriksa sebuah keputusan, bukan pengalaman penulis. Penilaian otomatis kasus ini belum saya uji; persoalannya tetap dapat diperiksa melalui bukti yang dibutuhkan.

Ilustrasi pendidikan books; bukan dokumentasi kelas
Ilustrasi, bukan bukti pelaksanaan: Wikimedia in Education illustration books — VHargyono (WMF). Sumber: Wikimedia Commons. Lisensi: CC0 1.0. Tanpa perubahan isi; ditampilkan dengan ukuran responsif.

Posisi yang saya pertahankan

ChatGPT tidak layak menjadi pemutus tunggal nilai pada tugas rubrik jawaban pendek. Nilai harus dapat dipertanggungjawabkan terhadap jawaban siswa dan tujuan memberi skor alasan dengan kriteria eksplisit. Bantuan membuat daftar pertanyaan pemeriksaan masih dapat dipertimbangkan, tetapi tanggung jawab membaca bukti tetap pada guru. Kalimat balikan yang lancar bukan alasan untuk menyerahkan keputusan yang berdampak pada siswa.

Kasus acuannya adalah: Jawaban contoh menyatakan tanaman layu karena kurang air, tanpa merujuk data kelembapan. Penalaran yang seharusnya diperiksa: Rubrik dapat memisahkan klaim, bukti data, dan hubungan penjelas; satu unsur benar tidak mewakili seluruh jawaban. Dua jawaban yang memakai kosakata berbeda dapat mempertahankan hubungan itu. Sebaliknya, jawaban yang mirip dengan acuan secara bahasa bisa salah pada batas konsep. Karena itu penilaian perlu mengacu pada hubungan, bukan kemiripan kalimat.

Risiko yang sering tersembunyi oleh skor

Satu jebakan pada rubrik jawaban pendek ialah: Mencocokkan kata kunci air saja dapat memberi skor pada alasan yang tidak sesuai data. Jika skor AI tidak menunjuk letak hubungan yang salah, guru tidak memperoleh dasar untuk menyusun bantuan. Meminta skor 0 sampai 100 menambah kesan presisi, tetapi rancangan rubrik tetap harus menjelaskan bukti yang membedakan dua nilai. Angka yang rinci tanpa kriteria tidak membuat keputusan lebih dapat diaudit.

Batas lain harus ikut dibaca: Rubrik memerlukan diskusi antarpenilai ketika kalimat siswa berbeda dari contoh. Saya menolak memasukkan seluruh jawaban siswa beserta nama ke ChatGPT hanya agar pengolahan terasa praktis. Untuk latihan pemeriksaan, gunakan contoh buatan dalam artikel ini. Jika sekolah hendak memakai pekerjaan nyata, kebutuhan data, izin penggunaan, dan kebijakan yang berlaku harus ditetapkan oleh pihak yang bertanggung jawab sebelum data dibagikan.

Bantahan terhadap posisi ini

Argumen lawan yang kuat ialah guru perlu bantuan ketika jawaban rubrik jawaban pendek banyak dan waktu membaca sempit. Pemeriksaan awal yang konsisten bisa membantu menemukan respons yang perlu perhatian. Keberatan ini sah: menuntut guru memeriksa semuanya tanpa dukungan juga mempunyai biaya. Namun dukungan harus menghasilkan daftar bukti yang bisa dicek, bukan sekadar skor yang harus dipercaya.

Pada kasus rubrik jawaban pendek, kompromi yang dapat diuji adalah meminta ChatGPT mengusulkan pertanyaan balikan tanpa memberi nilai. Guru lalu memeriksa apakah pertanyaan itu sesuai dengan tujuan memberi skor alasan dengan kriteria eksplisit. Bila pertanyaan justru membocorkan seluruh jawaban, terlalu rumit untuk VIII SMP, atau mengabaikan batas kasus, pertanyaan ditolak. Seleksi ini tidak membutuhkan klaim bahwa AI selalu benar atau selalu salah.

Permintaan yang dibatasi

Baca kasus buatan tentang rubrik jawaban pendek berikut: Jawaban contoh menyatakan tanaman layu karena kurang air, tanpa merujuk data kelembapan. Jangan beri skor dan jangan menebak identitas atau kemampuan siswa. Ajukan dua pertanyaan untuk memeriksa alasan berdasarkan kasus. Pisahkan informasi yang ada dari asumsi. Acuan guru: Rubrik dapat memisahkan klaim, bukti data, dan hubungan penjelas; satu unsur benar tidak mewakili seluruh jawaban.

Apa yang tidak berhasil

Permintaan kepada ChatGPT gagal memenuhi tujuan bila keluarannya hanya mengganti kata pada jawaban acuan. Guru membutuhkan pertanyaan yang dapat mengungkap penalaran baru: Siapkan tiga jawaban jangkar yang menunjukkan tingkat bukti berbeda. Kegagalan di sini adalah kriteria penolakan rancangan, belum merupakan laporan keluaran model yang diamati. Respons aktual harus disimpan sebelum ada klaim tentang mutu atau konsistensi model.

Keputusan untuk besok

Pilih satu jawaban buatan tentang rubrik jawaban pendek, tulis dua pertanyaan sendiri, lalu bandingkan dengan usulan ChatGPT jika akses tersedia. Simpan alasan menerima atau menolak tiap pertanyaan. Gunakan rubrik tiga kriteria dan contoh jawaban anonim buatan untuk pembahasan siswa; Google Forms tetap alat penyajian bila diperlukan. Jangan pindahkan nilai ke mesin sebelum bukti keputusan dapat dijelaskan kepada siswa yang dinilai.

Sumber dan status naskah

Artikel ini disusun pada 8 Oktober 2026 dan diberi tanggal arsip editorial. Tanggal posting bukan tanggal uji atau bukti bahwa tulisan telah terbit pada hari tersebut. Semua contoh, durasi, dan rubrik adalah rancangan; belum saya uji. Tidak ada pengalaman siswa nyata yang dilaporkan.

Rujukan alat: Google Formulir — petunjuk resmi. Dokumentasi mendukung pengenalan alat, bukan klaim hasil kelas atau ketersediaan setiap fungsi pada akun Anda. Contoh dan keputusan pedagogis merupakan analisis editorial penulis naskah ini.

Bacaan konteks AI: UNESCO — Guidance for generative AI in education and research. Posisi dalam artikel adalah argumen editorial, bukan kutipan keputusan UNESCO tentang kasus ini.

Bacaan terkait di blog

Ads middle content1

Ads middle content2