AI dijital ikizleri neden gerçek kişilere benzemiyor?
Columbia Üniversitesi liderliğinde yürütülen kapsamlı araştırmada, AI dijital ikizlerin insan davranışlarını kopyalamada beklenenden çok daha başarısız olduğu ortaya çıktı. Bilim insanları, kişisel verilerle donatılan yapay zeka ikizlerinin dahi, özgün insan tepkilerini yansıtmak yerine demografik ortalamalara yaklaştığını vurguladı.

Columbia Üniversitesi'nin öncülüğünde gerçekleştirilen geniş çaplı bir araştırma, AI dijital ikizlerin insan davranışlarını kopyalama konusundaki yetersizliğini gözler önüne serdi. 23 bilim insanından oluşan ekip, kişisel yanıtlarla oluşturulan yapay zeka dijital ikizlerinin, özgün insan tepkilerini taklit etmekte başarısız olduğunu tespit etti. Araştırma kapsamında, 1.784 katılımcının 500'den fazla soruya verdiği kişisel yanıtlar, GPT-4.1 tabanlı dijital ikizlere aktarıldı ve bu ikizler 164 farklı konuda yeni sorulara yanıt verdi. Sonuçlar, AI dijital ikizlerin, bireysel yanıtların ötesinde, daha çok demografik grupların ortalama cevaplarına yakın sonuçlar ürettiğini gösterdi.
Olivier Toubia: 'AI dijital ikizler, insan tepkilerini tam olarak yansıtamıyor'
Columbia İşletme Okulu'ndan Profesör Olivier Toubia, araştırmanın sonuçlarına ilişkin yaptığı değerlendirmede, AI dijital ikizlerin insanları birebir kopyalamak yerine, onları daha çok bir ortalamanın temsilcisi haline getirdiğini belirtti. Toubia, dijital ikizlerin doğruluğunu ölçerken, bu sistemlerin insan karşıtlarıyla doğrudan kıyaslanmasının şart olduğunu vurguladı. Araştırmada, kişisel verilerle oluşturulan ikizlerin, 164 soruluk testte 0.748 doğruluk puanına ulaştığı, yalnızca demografik bilgileri içeren personanın ise 0.746 puan aldığı kaydedildi. Bu yakınlık, kişisel verilerin tahmin gücünü artırmadığını ortaya koydu. Ayrıca, kişisel bilgi içermeyen bir istemin dahi 0.734 puana ulaşması, AI dijital ikizlerin kişiye özgü detayları kullanmakta zorlandığını gösterdi.
Demografik ortalamaya yakınlık ve stereotipleme sorunu
Araştırmada ortaya çıkan en önemli bulgulardan biri, AI dijital ikizlerin özgün insan davranışlarını yansıtmak yerine, demografik ortalamalara doğru kayma eğilimi göstermesi oldu. 164 sorunun 154'ünde, ikizlerin verdiği yanıtlar insanlara göre daha az çeşitlilik içerdi ve cevaplar daha sıkı bir şekilde toplandı. Bu durum, ikizlerin kişisel detayları yansıtmak yerine, ortalama yanıtlar üretme eğiliminde olduğunu ortaya koydu. Ayrıca, stereotipleme eğilimi de dikkat çekti; AI dijital ikizler, yalnızca demografik verilere dayanan personaya daha yakın, gerçek insanlara ise daha uzak cevaplar verdi. Kişisel veriler, ikizleri belirli bir kişiye değil, daha çok demografik bir ortalamaya yönlendirdi. Bu bulgu, AI dijital ikizlerin, kimlikten bağımsız istemlerle bile tanıdık stereotipler üretebildiğini gösteriyor.
AI dijital ikizlerin önyargıları ve hiper-rasyonellik tehlikesi
Çalışma, AI dijital ikizlerin doğruluk oranlarının, katılımcıların eğitim düzeyi, gelir seviyesi, siyasi ve dini görüşlerine göre değiştiğini de ortaya koydu. Dijital ikizler, daha yüksek eğitimli ve gelirli, ılımlı siyasi ve dini görüşlere sahip kişiler için daha doğru tahminlerde bulundu. Ancak, bu durumun panelde eşit dağılmaması, belirli grupların daha iyi temsil edildiği, diğerlerinin ise yeterince kapsanmadığı anlamına geliyor. Ayrıca, AI dijital ikizler, insanlara kıyasla daha olumlu, güvenilir ve adil bir dünya görüşü benimsedi. Algoritmalar tarafından yapılan işe alım kararlarını daha kabul edici buldular ve çevrimiçi reklam hedeflemesi konusunda daha az rahatsızlık belirttiler. Netflix ve TikTok gibi platformların kullanımını ise olduğundan daha az bildirdiler. Yaratıcılık değerlendirmelerinde ise, insanların önerdiği fikirleri daha düşük puanladılar. Bu önyargılar, AI dijital ikizlerin ince yollarla kararları etkileyebileceğini gösterdi.
AI dijital ikizler, insan davranışındaki irrasyonelliği yansıtamıyor
Bir diğer önemli bulgu ise, AI dijital ikizlerin insanlara özgü irrasyonel davranışları taklit edememesi oldu. Objektif olarak doğru cevaplar gerektiren sorularda, ikizler insanlardan daha doğru yanıtlar verdi ve hatalı akıl yürütmeyi yakalamakta daha başarılı oldu. Ancak, bu durum iki klasik irrasyonel alışveriş modelinin yeniden üretilmesini engelledi. Ekip, yayımlanmamış bir kurulumda iyi bilinen bir varsayılan etkiyi test ettiğinde, ikizler bu etkiyi göstermedi. Fakat, ünlü yayımlanmış versiyon kullanıldığında, ikizler klasik sonucu güçlü şekilde yansıttı. Bu durum, AI dijital ikizlerin, eğitim aldıkları veri setlerindeki kalıpları tekrar ettiğini, ancak gerçek insana özgü karar verme süreçlerini tam anlamıyla kopyalayamadığını gösteriyor.
AI dijital ikizlerde tahmin sınırı ve model çeşitliliği
Çalışmanın ana testleri önceden planlanmış olsa da, araştırmacılar sürecin sonunda beş temel bozulma tespit etti. AI dijital ikizler, yalnızca bir ABD panelinden ve belirli bir model ailesinden türetildi. Ekip, sıcaklık ayarlarını değiştirerek GPT-5, DeepSeek, Gemini ve ince ayar yapılmış GPT-4.1 gibi farklı modelleri de test etti. En iyi korelasyon oranı 0.232'ye ulaşsa da, bu oran bile, bir kişinin kendi yanıtlarıyla haftalar sonra ne kadar tutarlı olduğuyla kıyaslandığında oldukça düşük kaldı. Profesör Toubia, eğitim materyalinin modelden daha önemli olduğunu ve insan davranışının tahmin edilmesinin son derece zor olduğunu vurguladı. Hiçbir eğitim veri setinin, insan davranışındaki tahmin edilemez varyansı ortadan kaldıramadığını belirtti.
AI dijital ikizler, tahmin aracı olarak öne çıkıyor
2024 yılında gerçekleştirilen ve iki saatlik yaşam mülakatlarından ajanlar oluşturan bir başka çalışma, daha umut verici sonuçlar bildirse de, AI dijital ikizlerin insan davranışını kopyalamak yerine yalnızca tahmin edebildiğini gösterdi. Şu anki durumda, AI dijital ikizler, bir kişi kategorisi hakkında iyi bilgilendirilmiş tahminler sunabiliyor; ancak bir insanın birebir kopyası olamıyor. Bu boşluk, AI'nın bir kişi yerine geçtiği her alanda, örneğin terapi uygulamalarında da ortaya çıkıyor. Bilim insanları, AI dijital ikizlerin sunduğu tahminlerin, insan davranışının karmaşıklığı ve çeşitliliği karşısında sınırlı kaldığına dikkat çekiyor.
- Popüler Haberler -
007: First Light, Nintendo Switch 2'de bir kez daha ertelendi
Tek bir sürücüyle çalışan hoparlör sesi hedeflenen kişiye odaklıyor
Casper notebook güvenilirliğinin üretim test ve servis verileriyle analizi
Güneş panelleri için yeni alan! 10 metre derinlikte bile enerji üretildi
Elon Musk'tan "yapay zekanın insanlığı yok edebileceği" iddialarına esprili yanıt
Elon Musk: Günün birinde zaten hepimiz öleceğiz



