Menu

Bolehkah ChatGPT menilai jawaban tentang skala sikap?

Bolehkah ChatGPT menilai jawaban tentang skala sikap?

Dalam simulasi penilaian pukul 20.00, guru IX SMP menempelkan jawaban tentang skala sikap ke ChatGPT lalu menerima skor tanpa jejak alasan yang cukup. Itu skenario buatan untuk memeriksa sebuah keputusan, bukan pengalaman penulis. Penilaian otomatis kasus ini belum saya uji; persoalannya tetap dapat diperiksa melalui bukti yang dibutuhkan.

Ilustrasi pendidikan books; bukan dokumentasi kelas
Ilustrasi, bukan bukti pelaksanaan: Wikimedia in Education illustration books — VHargyono (WMF). Sumber: Wikimedia Commons. Lisensi: CC0 1.0. Tanpa perubahan isi; ditampilkan dengan ukuran responsif.

Posisi yang saya pertahankan

ChatGPT tidak layak menjadi pemutus tunggal nilai pada tugas skala sikap. Nilai harus dapat dipertanggungjawabkan terhadap jawaban siswa dan tujuan membedakan respons survei dari ukuran kemampuan. Bantuan membuat daftar pertanyaan pemeriksaan masih dapat dipertimbangkan, tetapi tanggung jawab membaca bukti tetap pada guru. Kalimat balikan yang lancar bukan alasan untuk menyerahkan keputusan yang berdampak pada siswa.

Kasus acuannya adalah: Butir contoh berbunyi saya percaya diri menjelaskan pecahan, dengan empat pilihan tingkat persetujuan. Penalaran yang seharusnya diperiksa: Persetujuan mengukur laporan diri pada butir itu, bukan bukti siswa mampu menjelaskan pecahan. Dua jawaban yang memakai kosakata berbeda dapat mempertahankan hubungan itu. Sebaliknya, jawaban yang mirip dengan acuan secara bahasa bisa salah pada batas konsep. Karena itu penilaian perlu mengacu pada hubungan, bukan kemiripan kalimat.

Risiko yang sering tersembunyi oleh skor

Satu jebakan pada skala sikap ialah: Nilai sikap tinggi diubah menjadi nilai kompetensi matematika. Jika skor AI tidak menunjuk letak hubungan yang salah, guru tidak memperoleh dasar untuk menyusun bantuan. Meminta skor 0 sampai 100 menambah kesan presisi, tetapi rancangan rubrik tetap harus menjelaskan bukti yang membedakan dua nilai. Angka yang rinci tanpa kriteria tidak membuat keputusan lebih dapat diaudit.

Batas lain harus ikut dibaca: Empat pilihan tanpa netral dapat memaksa respons; pilihan tersebut perlu alasan desain. Saya menolak memasukkan seluruh jawaban siswa beserta nama ke ChatGPT hanya agar pengolahan terasa praktis. Untuk latihan pemeriksaan, gunakan contoh buatan dalam artikel ini. Jika sekolah hendak memakai pekerjaan nyata, kebutuhan data, izin penggunaan, dan kebijakan yang berlaku harus ditetapkan oleh pihak yang bertanggung jawab sebelum data dibagikan.

Bantahan terhadap posisi ini

Argumen lawan yang kuat ialah guru perlu bantuan ketika jawaban skala sikap banyak dan waktu membaca sempit. Pemeriksaan awal yang konsisten bisa membantu menemukan respons yang perlu perhatian. Keberatan ini sah: menuntut guru memeriksa semuanya tanpa dukungan juga mempunyai biaya. Namun dukungan harus menghasilkan daftar bukti yang bisa dicek, bukan sekadar skor yang harus dipercaya.

Pada kasus skala sikap, kompromi yang dapat diuji adalah meminta ChatGPT mengusulkan pertanyaan balikan tanpa memberi nilai. Guru lalu memeriksa apakah pertanyaan itu sesuai dengan tujuan membedakan respons survei dari ukuran kemampuan. Bila pertanyaan justru membocorkan seluruh jawaban, terlalu rumit untuk IX SMP, atau mengabaikan batas kasus, pertanyaan ditolak. Seleksi ini tidak membutuhkan klaim bahwa AI selalu benar atau selalu salah.

Permintaan yang dibatasi

Baca kasus buatan tentang skala sikap berikut: Butir contoh berbunyi saya percaya diri menjelaskan pecahan, dengan empat pilihan tingkat persetujuan. Jangan beri skor dan jangan menebak identitas atau kemampuan siswa. Ajukan dua pertanyaan untuk memeriksa alasan berdasarkan kasus. Pisahkan informasi yang ada dari asumsi. Acuan guru: Persetujuan mengukur laporan diri pada butir itu, bukan bukti siswa mampu menjelaskan pecahan.

Apa yang tidak berhasil

Permintaan kepada ChatGPT gagal memenuhi tujuan bila keluarannya hanya mengganti kata pada jawaban acuan. Guru membutuhkan pertanyaan yang dapat mengungkap penalaran baru: Pasangkan survei dengan tugas penjelasan dan biarkan hasil keduanya berbeda. Kegagalan di sini adalah kriteria penolakan rancangan, belum merupakan laporan keluaran model yang diamati. Respons aktual harus disimpan sebelum ada klaim tentang mutu atau konsistensi model.

Keputusan untuk besok

Pilih satu jawaban buatan tentang skala sikap, tulis dua pertanyaan sendiri, lalu bandingkan dengan usulan ChatGPT jika akses tersedia. Simpan alasan menerima atau menolak tiap pertanyaan. Gunakan empat kartu respons dan satu soal penjelasan untuk pembahasan siswa; Google Forms tetap alat penyajian bila diperlukan. Jangan pindahkan nilai ke mesin sebelum bukti keputusan dapat dijelaskan kepada siswa yang dinilai.

Sumber dan status naskah

Artikel ini disusun pada 8 Oktober 2026 dan diberi tanggal arsip editorial. Tanggal posting bukan tanggal uji atau bukti bahwa tulisan telah terbit pada hari tersebut. Semua contoh, durasi, dan rubrik adalah rancangan; belum saya uji. Tidak ada pengalaman siswa nyata yang dilaporkan.

Rujukan alat: Google Formulir — petunjuk resmi. Dokumentasi mendukung pengenalan alat, bukan klaim hasil kelas atau ketersediaan setiap fungsi pada akun Anda. Contoh dan keputusan pedagogis merupakan analisis editorial penulis naskah ini.

Bacaan konteks AI: UNESCO — Guidance for generative AI in education and research. Posisi dalam artikel adalah argumen editorial, bukan kutipan keputusan UNESCO tentang kasus ini.

Bacaan terkait di blog

Ads middle content1

Ads middle content2