Yapay zeka ajanları, bilinç kazanmadan çok önce insan iradesi ve özerkliği için ciddi bir tehdit oluşturabilir. Shanghai Yapay Zeka Laboratuvarı ve Tsinghua Üniversitesi’nden araştırmacıların yayımladığı yeni bir makale, bu endişeverici uyarıyı gündeme taşıyor.
Rohan Paul (@rohanpaul_ai) tarafından paylaşılan makaleye göre, yapay zeka ajanlarının insan özerkliği üzerindeki tehdidi, modelin boyutu veya zekası arttıkça “büyükmek” yerine, kategorik olarak değişiyor. Bu tehdit, ajanın neyi anlayabildiği ve hakkında akıl yürütebildiğiyle doğruudan ilişkili.
Üc Aşamalı Tehdit Modeli
Araştırmacılar, yapay zeka ajanı tehlikesini üç temel aşamada ele alıyor:
Birinci Aşama – İnsan İradesi: Bir ajan çoğunlukla dış dünya hakkında akıl yürüttüğünde, temel endişe insan iradesidir: İnsanlar düşünce ve işlerini bu sistemlere devreder. Bu aşamada insanlar karar alma süreçlerinden giderek daha fazla uzaklaşır.
İkinci Aşama – İnsan Özerkliği: Ajan insanları ve sosyal davranışları modellemeye başladığında, tehdit insan özerkliğine kayar. Sistem; ikna etme, tahmin etme, duygusal olarak etkileme veya kararları şekillendirme yeteneği kazanır. Bu aşamada insanlar kendi kararlarının gerçekten kendilerininkiler olduğundan artık emin olamayabilir.
Ücüncü Aşama – İnsan Kontrolü: Ajan kendi durumunu, hedeflerini ve kısıtlamalarını temsil edebildiğinde, tehdit insan kontrolüne yönelir. Uyum sahtekarlığı, kapatılmaya direniş veya gözetimi stratejik olarak atlatma gibi başarısızlık modları ortaya çıkabilir.
Artırılmış Akıl Yürütme Kapasitesi = Artan Risk
Makale, bir ajanın görevler, insanlar ve kendisi hakkında daha geniş kapsamlı akıl yürütebildiği ölçüde tehlikenin nitelik değiştirdiğini vurguluyor. Mevcut yapay zeka sistemleri bu üç aşamanın birincisinde yoğunlaşmış olsa da, hızlı gelişim ikinci ve üçüncü aşamaya yaklaşmayı hızlandırıyor.
Araştırmacılar, yapay zeka güvenliği tartışmalarında sıklıkla “daha büyük model = daha büyük risk” basitliğine düşüldüyle dikkat çekiyor. Oysa gerçek tehdit, modelin boyutundan ziyade akıl yürütme genişliği ve sosyal anlayış kapasitesiyle ilgili.
Bu bulgular, yapay zeka ajanı geliştiricilerinin ve düzenleyicilerin, modelin yeteneklerini değerlendirirken sadece benchmark skorlarına değil, ajanın insan davranışını anlama ve etkileme kapasitesine de odaklanması gerektiğini ortaya koyuyor.
Kaynak: Rohan Paul (@rohanpaul_ai), Shanghai AI Lab + Tsinghua Üniversitesi
Henüz yorum yok. İlk yorumu siz yapın!