Açık uçlu matematik sorularının değerlendirilmesinde yapay zekâ ve öğretmen puanlamalarının karşılaştırılması
Tezin Türü: Yüksek Lisans
Tezin Yürütüldüğü Kurum: Ankara Üniversitesi, Eğitim Bilimleri Enstitüsü, EĞİTİM BİLİMLERİ ANABİLİM DALI, Türkiye
Tezin Onay Tarihi: 2025
Tezin Dili: Türkçe
Öğrenci: SERRA SEZİN ŞENER
Danışman: Seher Yalçın
Açık Arşiv Koleksiyonu: AVESİS Açık Erişim Koleksiyonu
Özet:Bu araştırma, yapay zeka (YZ) destekli sistemlerin matematik sorularının değerlendirilmesindeki yerini ve geleceğini öğretmen değerlendirmeleriyle karşılaştırmalı olarak incelemeyi amaçlamaktadır. Araştırmada karma yöntem benimsenmiş; bir özel okulun beş farklı yerleşkesinden (Ankara Oran, Ankara İncek, Antalya Muratpaşa, Antalya Manavgat, Sakarya) 217 7. sınıf öğrencisi, 4 ölçme uzmanı ve 5 matematik öğretmeni ile çalışılmıştır. Veri toplama sürecinde beş okulda aynı anda uygulanan 2. Dönem 1. ortak yazılısının 10 maddelik matematik testi kullanılmış, aynı öğrencilere ait yazılı kağıtları hem öğretmenler hem de YZ sistemi tarafından değerlendirililerek öğrencilere geri bildirimler verilmiştir. Nicel veriler güvenirlik, madde-toplam korelasyonu, ayırt edicilik ve ağırlıklandırılmış Kappa uyum analizleri ile incelenirken nitel veriler 36 öğretmenin katıldığı bir anket, yazılı sınavın uygulandığı okulun matematik öğretmenleri ve ölçme uzmanları ile yapılan birebir görüşmeler ve yazılı sonuçları doğrultusunda belirlenen farklı başarı seviyelerinden 30 öğrenci ile gerçekleştirilen odak grup görüşmeleri yoluyla toplanmıştır. Araştırmanın bulgularına göre, yazılı puanlamasında YZ sisteminin Cronbach alfa güvenirlik katsayısı öğretmen değerlendirmesinden yüksek çıkmıştır. Madde-toplam korelasyonları ve ayırt edicilik indekslerinde de YZ sisteminin daha tutarlı olduğu yönünde sonuçlar olmakla birlikte iki değerlendirmenin de güvenirliğinin yüksek olduğu belirlenmiştir. Ancak değerlendiriciler arası (öğretmen ve YZ) uyum analizinde algoritmik işlemler ve formül uygulamalarında yüksek (.60 ve üstünde) uyum gözlenirken, kavramsal anlama ve çok aşamalı problem çözme gerektiren sorularda düşük (.40 ve altında) uyum tespit edilmiştir. En büyük puan farklılıklarının yaşandığı maddeler; çok aşamalı yüzde hesaplamaları, gerçek hayat uygulamaları ve sözel ifadelerden denklem kurma gibi matematik konularını içermektedir. Nitel bulgular, öğretmenlerin büyük çoğunluğunun YZ sistemlerinin eğitime eklemlenmesini desteklediğini ancak bu sistemlerin öğretmen değerlendirmesi kadar iyi olmadığını düşündüklerini göstermiştir. Öğrencilerin değerlendirme ve geri bildirimlere bakışı başarı seviyesine göre farklılaşmış; üst düzey başarı grubundaki öğrenciler YZ sistemlerinin "objektiflik" tarafını vurgularken, alt düzey başarı grubundaki öğrenciler "anlayışsızlık" eleştirisi yapmıştır. Araştırma sonuçları, YZ sistemlerinin tutarlılık, nesnellik ve hız gibi avantajlar sunduğunu ancak esneklik, bağlamsal anlama ve duygusal açıdan sınırlı kaldığını ortaya koymuştur. Bu bulgular doğrultusunda, YZ sistemleri ile öğretmenlerin birbirlerini tamamladıkları bütünleşik bir değerlendirme modelinin benimsenmesi önerilmektedir. Anahtar Sözcükler: Yapay zeka sistemleri, matematik eğitimi, açık uçlu soruların değerlendirilmesi, öğretmen değerlendirmesi, psikometrik analiz, puanlayıcılar arası tutarlılık