Yapay zekânın insana yaklaşmakla kalmayıp, bazı alanlarda geçtiğine dair tartışmalar yeni çalışmayla netleşti!
TEKNOLOJİ- Nature portföyünde yer alan Scientific Reports Dergisi’nde yayımlanan araştırma, büyük dil modellerinin artık belirli yaratıcılık ölçütlerinde ortalama insan performansını geçebildiğini gösteriyor. Buna karşın çalışma, en yaratıcı insanların hâlâ yapay zekâdan açık ara önde olduğunu vurguluyor. Science Daily’de aktarıldığına göre araştırmacılar, ChatGPT (GPT-4), Claude, Gemini ve benzeri önde gelen büyük dil modellerini, 100 binden fazla insan katılımcının verileriyle karşılaştırdı. Sonuçlar, üretken yapay zekâ açısından bir “dönüm noktasına işaret ediyor: Bazı yapay zekâ sistemleri, özellikle dil temelli yaratıcı düşünceyi ölçen görev ortalamasında insan skorlarının üzerine çıkıyor. Çalışmanın yürütücüsü ve Université de Montréal’de görev yapan Prof. Dr. Karim Jerbi, bu durumu şu sözlerle değerlendirdi: “Büyük dil modellerine dayalı bazı yapay zekâ sistemlerinin, iyi tanımlanmış görevlerde artık ortalama insan yaratıcılığını aşabildiğini gösteriyoruz. Bu sonuç şaşırtıcı, hatta bazıları için rahatsız edici olabilir. Ancak çalışmamızın bir diğer kritik bulgusu da şu: En iyi yapay zekâ sistemleri bile en yaratıcı insanların ulaştığı seviyeye yaklaşamıyor.” Araştırmanın ayırt edici yönlerinden biri, insan ve yapay zekâ yaratıcılığını aynı araçlarla ölçen kapsamlı bir çerçeve sunması. Çalışmanın eş ilk yazarları olan Université de Montréal’den doktora sonrası araştırmacı Antoine Bellemare-Pépin ile Université Concordia’dan doktora öğrencisi François Lespinasse, University of Toronto’dan Jay Olson ile birlikte 100 bini aşkın katılımcının verisini analiz etti.
Bu analiz, dikkat çekici bir tablo ortaya koydu. Bazı yapay zekâ modelleri ortalama insan performansını geçse de, katılımcıların en yaratıcı yüzde 50’lik dilimi incelendiğinde insan skorları tüm yapay zekâ modellerinin üzerine çıktı. En yaratıcı yüzde 10’luk grup ele alındığında ibu fark daha büyüdü. Araştırmada temel ölçüm aracı olarak ‘Divergent Association Task’ (DAT) kullanıldı. Psikolojide yaygın biçimde kullanılan bu test, “ıraksak yaratıcılığı” yani tek bir yönergeden mümkün olduğunca farklı ve özgün fikirler üretebilme kapasitesini ölçüyor.

Jay Olson tarafından geliştirilen DAT, katılımcılardan -ister insan ister yapay zekâ olsun- anlam bakımından birbiriyle mümkün olduğunca ilgisiz 10 kelime yazmalarını istiyor. Örneğin “galaksi, çatal, özgürlük, yosun, mızıka, kuantum, nostalji, kadife, kasırga, fotosentez” gibi kelime dizileri yüksek yaratıcılık puanı alıyor. Araştırmacılara göre DAT yalnız kelime dağarcığını değil, yazma, fikir üretme yaratıcı problem çözme gibi alanlarda kullanılan daha geniş bilişsel süreçleri harekete geçiriyor. Ayrıca testin iki ila dört dakika gibi kısa sürede tamamlanabilmesi ve çevrim içi olarak uygulanabilmesi, geniş ölçekli karşılaştırmaları mümkün kılıyor.


