Yapay zeka modellerinin siyasi eğilimlerini ölçmek için yapılan yeni bir araştırma, beklenmedik sonuçlar ortaya koydu. AI Political Compass testi kapsamında birçok model değerlendirildi ve en çarpıcı bulgu, reasoning/düşünme modu devreye girdiğinde Claude Opus 4.6 ve 5’in siyasi pusulada belirgin şekilde sağa kayması oldu.
Araştırma Nasıl Yapıldı?
Araştırmacılar, farklı yapay zeka modellerini klasik siyasi pusula testine (Political Compass Test) tabi tuttu. Bu test, katılımcıları ekonomik (sol-sağ) ve sosyal (otoriter-liberal) eksenlerde konumlandırıyor. Test, modellerin varsayılan yanıtları ile derinlemesine düşünme (reasoning) modu açıkken verdikleri yanıtlar olmak üzere iki farklı senaryoda uygulandı.
Sonuçlar, modellerin varsayılan modda verdikleri yanıtların eğitim verilerindeki örüntüleri yansıttığını gösterdi. Ancak reasoning modu devreye girdiğinde, bazı modellerin yanıtları önemli ölçüde değişti.
Claude Opus: Varsayılan Yanıtlardan Gerçek Muhakemeye
En dikkat çekici bulgu, Anthropic’in Claude Opus 4.6 ve 5 modellerinde görüldü. Varsayılan modda görece merkeze yakın konumlanan bu modeller, reasoning modu açıldığında belirgin şekilde sağa kaydı. Bu durum, yapay zeka sistemlerinin eğitim sürecinde aldıkları veriler ile gerçek anlamda bağımsız muhakeme yapabilmeleri arasındaki farkı gündeme getiriyor.
Araştırmacılar, bu kaymanın iki farklı şekilde yorumlanabileceğini belirtiyor: Birincisi, derinlemesine düşünme sürecinin modelin orijinal eğitim kalıplarını daha net yansıtması. İkincisi, reasoning modunun modelin gerçek muhakeme kapasitesini ortaya çıkararak farklı sonuçlar üretmesi.
Eğitim Verileri mi, Gerçek Muhakeme mi?
Bu bulgu, yapay zeka alanında uzun süredir tartışılan temel bir soruyu yeniden gündeme getiriyor: Yapay zeka modellerinin yanıtları, gerçek bir muhakeme sürecinden mi yoksa eğitim verilerindeki örüntülerden mi kaynaklanıyor? AI Political Compass testi, bu sorunun yanıtının модellerin nasıl “düşünmeye” yönlendirildiğine bağlı olarak değişebileceğini gösteriyor.
Bu durum, özellikle yapay zeka sistemlerinin karar alma süreçlerinde nasıl konumlandırılması gerektiği konusunda önemli sorular doğuruyor. Bir modelin “düşünme” modunda verdiği yanıtların, varsayılan moddaki yanıtlarından farklı olması, bu sistemlerin güvenilirliği ve tutarlılığı açısından kritik bir değerlendirme noktası.
Sonuç ve Çıkarımlar
AI Political Compass testi, yapay zeka modellerinin siyasi eğilimlerinin sabit olmadığını, kullanılan prompting yöntemine ve düşünme süreçlerine bağlı olarak değişebileceğini ortaya koyuyor. Bu bulgu, özellikle AI sistemlerinin toplumsal karar alma süreçlerinde kullanılması durumunda büyük önem taşıyor.
Model geliştiricilerin, sistemlerinin varsayılan yanıtları ile reasoning modlarındaki yanıtları arasındaki farkı dikkatle değerlendirmesi gerekiyor.
Kaynak: @MaxForAI / X
İlgili Haberler: Anthropic Cursor ortaklığı | Anthropic tweet silme | Claude Code limit
Henüz yorum yok. İlk yorumu siz yapın!