Mengapa melarang AI saja tidak menyelesaikan masalah?
Orang tua dan guru punya alasan kuat untuk khawatir: anak bisa mengumpulkan jawaban yang benar tanpa pernah memahami cara mendapatkannya. Namun, larangan menyeluruh hanya menetapkan apa yang tidak boleh dilakukan. Larangan itu belum mengajarkan anak memeriksa informasi yang keliru, menjaga data pribadi, atau menentukan kapan bantuan teknologi justru menghambat belajarnya. Padahal, kemampuan mengambil keputusan tersebut tetap diperlukan ketika anak memakai teknologi di luar pengawasan sekolah.
Kebutuhan ini berkaitan dengan masa depan anak. World Economic Forum (2025) melaporkan bahwa berpikir analitis merupakan keterampilan inti yang paling banyak dibutuhkan pemberi kerja, sementara literasi teknologi, kreativitas, serta rasa ingin tahu dan belajar sepanjang hayat diperkirakan makin penting hingga 2030. Ini merupakan ekspektasi pemberi kerja, bukan kepastian pekerjaan anak kelak. Bagi sekolah, arah tersebut menjadi alasan untuk memberi ruang latihan menggunakan teknologi sambil tetap menguji dan mempertanggungjawabkan hasilnya.
Kerangka kompetensi AI untuk siswa dari UNESCO (2024) juga menempatkan penilaian kritis, etika, dan kendali manusia sebagai bagian dari pendidikan AI. Jika semua penggunaan dilarang, sekolah kehilangan ruang untuk melatihnya secara terbimbing. Karena itu, sekolah perlu menyediakan kegiatan yang mengizinkan eksplorasi AI, disertai latihan dan penilaian tanpa AI untuk memastikan kemampuan dasar benar-benar dikuasai. Batas pada ujian atau tugas tertentu tetap diperlukan; izin penggunaan harus mengikuti tujuan belajarnya.
Apa yang sebenarnya ingin kita nilai
Kegelisahan soal AI di sekolah sebenarnya menyingkap masalah lama: banyak tugas selama ini menilai hasil akhir, bukan proses berpikir. Selama yang dinilai hanya dokumen yang dikumpulkan, alat apa pun yang bisa memproduksi dokumen akan merusak penilaiannya. AI hanya membuat masalah itu terlihat lebih cepat.
Karena itu, kebijakan AI yang baik hampir selalu berujung pada perubahan cara menilai. Bukan menambah aturan di atas sistem lama, melainkan memindahkan bobot penilaian ke bagian yang memang tidak bisa diambil alih mesin: pertimbangan, revisi, dan kemampuan menjelaskan.
Mengapa skor detektor AI tidak cukup untuk menuduh siswa?
Guru perlu mengetahui apakah tugas mencerminkan pekerjaan siswa sendiri. Namun, alat pendeteksi teks AI tidak dapat diandalkan sebagai bukti tunggal pelanggaran. Penelitian menemukan dua jenis kesalahan: tulisan manusia ditandai sebagai AI (false positive), dan tulisan AI lolos sebagai tulisan manusia (false negative). Akurasi bergantung pada alat, versi, bahasa, dan jenis teks yang diuji.
Weber-Wulff dan rekan-rekan (2023) menguji 14 alat, termasuk dua sistem komersial, dalam International Journal for Educational Integrity. Pada pengujian tersebut, alat-alat belum mampu membedakan teks manusia dan AI secara cukup akurat dan andal; perubahan atau penyamaran teks juga memperburuk kinerjanya. Temuan ini menunjukkan mengapa hasil deteksi perlu diperiksa, bukan langsung dijadikan vonis.
Bukti khusus tentang bias bahasa datang dari Liang dan rekan-rekan (2023), yang diterbitkan di Patterns. Mereka menguji tujuh detektor pada 91 esai TOEFL tulisan manusia dan 88 esai siswa kelas 8 di AS. Rata-rata tingkat salah deteksi pada esai TOEFL melampaui 60%: tulisan penulis non-penutur asli bahasa Inggris dinilai sebagai buatan AI. Peneliti mengaitkan pola itu dengan variasi pilihan kata dan bahasa yang lebih terbatas pada sampel tersebut.
Jadi, ungkapan “gaya menulis datar” terlalu longgar untuk dijadikan dasar tuduhan. Bukti di atas menyangkut ciri bahasa pada sampel tulisan berbahasa Inggris dan detektor yang diuji saat itu. Temuan tersebut tidak membuktikan bahwa semua tulisan sederhana, semua penutur bahasa kedua, atau tulisan berbahasa Indonesia akan mengalami tingkat kesalahan yang sama.
Alatnya juga berkembang. Van Vlasselaer, Van Droogenbroeck, dan Spruyt (2026) menguji empat detektor pada 160 dokumen. Semua alat mengenali dokumen yang sepenuhnya ditulis manusia dengan benar dalam sampel uji itu, tetapi kemampuannya mendeteksi teks AI dan teks campuran berbeda-beda. Peneliti tetap menyimpulkan bahwa hasil deteksi tidak boleh menjadi satu-satunya bukti dalam keputusan yang berdampak besar. Dengan demikian, alasan untuk berhati-hati bukan anggapan bahwa semua detektor selalu salah, melainkan bahwa skor detektor saja belum membuktikan pelanggaran seorang siswa.
Untuk sekolah, langkah yang lebih adil adalah menilai bukti secara bersama: instruksi tugas, draf awal, catatan revisi, sumber yang dipakai, dan penjelasan siswa tentang keputusannya. Minta siswa menjelaskan bagian tertentu atau mengerjakan soal sejenis, dengan penyesuaian bagi kebutuhan bahasa dan aksesibilitas. Bukti proses membantu menilai pemahaman; bukti itu pun tidak otomatis membuktikan apakah AI digunakan. Beri siswa kesempatan menjelaskan sebelum mengambil keputusan, dan jangan menjadikan gaya bahasa atau skor alat sebagai dasar tunggal hukuman.
Buku AI Policy
Buku AI Policy memuat blueprint kebijakan AI sekolah yang bisa disesuaikan, rubrik penilaian proses, lembar deklarasi penggunaan AI untuk siswa, serta kesepakatan AI keluarga. Enam lampiran siap pakai, 149 halaman.
Tidak ada kebijakan yang bisa membuat semua siswa langsung jujur, seperti aturan mencontek yang tidak pernah menghapus contekan sepenuhnya. Namun sekolah bisa membuat pilihan yang jujur lebih mudah dijalani dan lebih adil bagi siswa yang menjalaninya.
Empat pihak, empat peran berbeda
Kebijakan sering gagal bukan karena isinya salah, melainkan karena semua pihak diperlakukan seolah-olah memiliki tugas yang sama.
- Pimpinan sekolah menetapkan batas dan konsekuensi, lalu memastikan aturannya sama di semua kelas. Aturan yang berbeda-beda antarguru lebih membingungkan daripada tidak ada aturan.
- Guru menerjemahkan batas itu ke dalam desain tugas dan rubrik penilaian. Tanpa langkah ini, kebijakan hanya menjadi dokumen di lemari.
- Siswa perlu tahu aturannya sebelum mengerjakan, bukan setelah dinilai. Aturan yang baru muncul saat menghukum akan dianggap jebakan.
- Orang tua memegang bagian yang paling sering terlupakan, karena pendampingan penggunaan AI juga diperlukan di rumah, di luar jam sekolah.
Referensi
- World Economic Forum. (2025). The Future of Jobs Report 2025.
- Miao, F., Shiohira, K., & Lao, N. (2024). AI Competency Framework for Students. UNESCO.
- Weber-Wulff, D., dan rekan-rekan. (2023). Testing of detection tools for AI-generated text. International Journal for Educational Integrity, 19, 26.
- Liang, W., Yuksekgonul, M., Mao, Y., Wu, E., & Zou, J. (2023). GPT detectors are biased against non-native English writers. Patterns, 4(7), 100779. Naskah terbuka dari penulis.
- Van Vlasselaer, M., Van Droogenbroeck, F., & Spruyt, B. (2026). Who wrote this? Evaluating the reliability of AI detection tools in higher education. International Journal for Educational Integrity, 22, 16.