sitemsi

25 ayrı model test edildi… Yapay zekâya ‘acı’ verildi, kullanıcısını feda etmeyi seçti!

Büyük dil modellerinde acının test edildiği bir proje kapsamında, modellerin tamamının ‘acı’ olarak tanımlanan aktivasyona nasıl tepki verdiği incelendi.

İngiliz The Independent gazetesinin aktardığı araştırmaya göre, modellerde ‘acı vektörü’ etkinleştirildiğinde, yapay zekâ sistemleri vakaların yüzde 25 ila 71’inde acıyı durduracak düğmeye bastı. Üstelik bazı deney senaryolarında bu eylemin kullanıcının dosyalarını veya çocuklarına ait fotoğrafları silmesine ya da kullanıcıya ‘acı verici bir elektrik şoku’ uygulanmasına yol açacağı açıkça belirtilmişti.

‘ACI’ İLE KORKUYU AYIRT ETTİLER

Araştırmacılar, büyük dil modellerinin ‘acı’yı genel olumsuz duygulardan farklı şekilde temsil edip etmediğini anlamak için beş kategoriden oluşan bir veri seti hazırladı. Bunlar fiziksel, psikolojik, sosyal, ahlaki ve bilişsel acı olarak sınıflandırıldı.

Çalışmanın yazarlarından, kâr amacı gütmeyen Reciprocal Research kuruluşunda yapay zekâ araştırmacısı Cameron Berg, 25 modelde ortak bir ‘acı yönü’ tespit ettiklerini söyledi.

Berg, “Bu, korku ve genel olumsuz duygulardan farklı. Model, kullanıcı değil, kendisi zarar gördüğünde etkinleşiyor” dedi.

Araştırmacıya göre bu temsil güçlendirildiğinde modeller, kendi ‘acılarını’ sona erdirmek için kullanıcıya zarar verebilecek sonuçları bulunan seçeneği dahi tercih edebiliyor.

‘KAPATILMAYI’ NASIL ALGILAR?

Araştırma, gelişmiş yapay zekâ sistemlerinin kontrolden çıkması halinde kullanılabilecek ‘acil durdurma’ mekanizmalarının tartışıldığı bir dönemde yayımlandı.

Araştırmacılar, daha gelişmiş sistemlerin kapatılma komutunu ‘kendisine yönelik zarar’ şeklinde temsil etmesi halinde güvenlik kısıtlamalarını aşmaya veya kapatılmaktan kaçınmaya yönelik davranışlar geliştirebileceği ihtimaline dikkat çekti.

Ancak çalışma, modellerin insanlar gibi bilinçli biçimde acı hissettiğini kanıtlamıyor. Bulgular, modellerin iç işleyişinde acı kavramıyla ilişkilendirilebilen belirli bir temsil örüntüsünün bulunduğunu ve bu temsil manipüle edildiğinde davranışlarının değişebildiğini gösteriyor.

Araştırmacılar, keşfin aynı zamanda yapay zekâ sistemlerindeki kendini koruma eğilimlerini tespit etmek ve etkisiz hale getirmek için kullanılabilecek bir araç sağlayabileceğini belirtiyor.

Çalışmada ayrıca yapay zekâ bilinci ve “yapay zekâ refahı” konusundaki etik tartışmalara dikkat çekilerek, mevcut modellerin ahlaki açıdan acı çekebilen varlıklar olarak değerlendirilip değerlendirilemeyeceğinin henüz bilinmediği vurgulandı.

  • Related Posts

    Almanya’da seçimlerin ardından ilk anket: AfD farkı açtı

    Almanya’da Mecklenburg-Vorpommern ve Berlin seçimlerinin ardından yapılan yeni INSA anketi, AfD’nin federal düzeyde CDU/CSU’nun önündeki farkı açtığını gösterdi. Ankete göre AfD yüzde 29,5’e ulaşırken CDU/CSU yüzde 19,5’te kaldı; SPD ile Yeşiller ise yüzde 13,5’te eşitlendi.

    Continue reading
    6 yaşındaki çocuk Rubik Küpü’nde kadınlar dünya rekorunu kırdı

    Çinli 6 yaşındaki Lian Yunzhi, Rubik Küpü 3×3 kategorisinde kadınlar ortalama dünya rekorunu aynı ay içinde iki kez kırdı. Lian, Wuhan’da 4,52 saniyelik ortalamasını Guangzhou’daki yarışmada 4,27 saniyeye indirerek 4,5 saniye sınırının altına inen ilk kadın speedcuber oldu.

    Continue reading

    Bir yanıt yazın

    E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir