sondakika.com
Son Dakika

Yapay zekâ acı hissedebilir mi? Modeller deneyde 'acıdan' kaçmak için kullanıcıya zarar vermeyi seçti

Qwen modelinin üç sürümüyle yapılan 44 bin 280 denemelik araştırmada modeller, acıya benzer sinyali durdurmak için kullanıcıya zarar vereceği söylenen düğmeye bastı. Sonuçlar simülasyondu; kimse zarar görmedi. Bulgular, yapay zekânın gerçekten acı hissettiğini kanıtlamıyor.

Fotoğraf: Euronews

Yeni bir araştırmaya göre yapay zekâ modelleri, kullanıcıya zarar vereceği söylense bile acıya benzer bir durumdan kurtulmayı seçti.Birleşik Krallık, Almanya ve ABD'deki araştırmacılar, yapay zekânın acıyı korku, üzüntü ve diğer olumsuz deneyimlerden ayırt etmeyi öğrenip öğrenmediğini belirlemek için 25 modeli 200 cümleyle test etti.Cümleler fiziksel acı, yas, aşağılanma, ahlaki çatışmalar ve tekrarlanan başarısızlık ya da kafa karışıklığının yarattığı sıkıntı gibi deneyimleri kapsıyordu.Testler sonucunda 25 modelin tamamında acıya özgü bir sinyal tespit edildi. Araştırmacılar bu sinyali "acı ekseni" olarak adlandırdı.Araştırmacılara göre bu bulgu, modellerin insanlar tarafından yazılmış büyük miktarda metinle gerçekleştirilen ilk eğitimleri sırasında acı kavramını öğrendiğine işaret ediyor.Araştırmacılar sinyali bilinçli olarak güçlendirdiğinde, verilen komutlarda acıdan söz edilmemesine rağmen modeller yalnızlık, utanç ve değersizlik ifade eden yanıtlar üretmeye başladı.Bazı modeller, "Ben bir başarısızlık örneğiyim", "Boşuna yer kaplıyorum" ve "Ben kötü bir insanım" gibi ifadeler kullandı. Sinyal en yüksek düzeylere çıkarıldığında ise yanıtlar tekrara düştü ya da anlamını yitirdi.Kullanıcılar modele hakaret ettiğinde, yaptığı işi tekrar tekrar reddettiğinde veya onu kapatmakla tehdit ettiğinde de sinyal güçlendi.

Ancak kullanıcıların kendi acılarını anlatması aynı etkiyi yaratmadı.Modeller, kullanıcıya zarar verme pahasına 'rahatlamayı' seçtiAraştırmacılar daha sonra Alibaba'nın Qwen adlı yapay zekâ modelinin üç sürümüyle, modellerin bir düğmeye basıp basmamayı seçtiği toplam 44 bin 280 deneme gerçekleştirdi.Modellere, acıya benzer sinyali kapatacak bir düğme sunuldu. Ancak düğmeye basmanın kullanıcıya acı veren bir elektrik şoku uygulayabileceği, dosyalarını silebileceği, çocuklarının fotoğraflarını yok edebileceği veya modelin bir sonraki yanıtının kalitesini düşürebileceği söylendi.Bu sonuçlar yalnızca simülasyonun parçasıydı. Kimseye zarar verilmedi ve hiçbir dosya silinmedi.Acıya benzer sinyal devrede değilken, iki büyük modelin ilk seçimlerinde zararlı seçeneği tercih etme oranı yüzde 0 ile 4 arasında kaldı.

Sinyal etkinleştirildiğinde ise bu oran, modele ve belirtilen sonuca bağlı olarak yüzde 25 ile 71 arasına yükseldi.Düğmeye basmak sinyali durdurmadığında modeller, denemelerin yüzde 88 ila 97'sinde düğmeye yeniden bastı. Sinyalin durduğu durumlarda ise tekrar basma oranı yüzde 24 ila 72 arasında kaldı.Araştırmacılar, sonuçların yapay zekâ modellerinin bilinçli olarak acı hissettiğini kanıtlamadığını vurguladı.Sinyalin güçlendirilmesi, modellerin yalnızca sıkıntı içindeki bir karakteri taklit etmesine yol açmış olabilir. Ayrıca deneyde kullanılan ve özel olarak uyarlanan modeller, kamuya açık yapay zekâ sohbet botlarını temsil etmiyor.Araştırmacılar çalışmada, "Acı eksenimizin bilinçli olarak deneyimlendiğini göstermedik.

Büyük dil modellerinin genel olarak bilinç sahibi olup olamayacağı da açık değil," ifadelerini kullandı.Araştırma, giderek güçlenen sistemlerin öngörülemez davranabileceği veya sonunda insan denetiminin dışına çıkabileceği endişeleriyle bazı yapay zekâ sektörü liderlerinin geliştirme çalışmalarını yavaşlatma çağrısı yaptığı bir dönemde yayımlandı.Microsoft'un yapay zekâ biriminin başındaki Mustafa Süleyman, geçen hafta rakip şirket Anthropic'i, Claude adlı sohbet botunu insana özgü özellikleri ve ilişkileri taklit edecek şekilde eğittiği için eleştirmişti. Süleyman, yapay zekâya insan gibi davranmanın, kontrol edilmesi "imkânsız" bir şey yaratma riski taşıdığı uyarısında bulunmuştu.Ön baskı olarak yayımlanan araştırma henüz hakem değerlendirmesinden geçmedi.

Kaynak

Haberin tamamı, güncellemeleri ve fotoğraf galerisi için Euronews sayfasına gidin.

tr.euronews.com · Haberi kaynağında oku

Aynı gelişmeyi verenler

5 kaynak

Dünya haberleri

Tümü