enflasyonemeklilikötvdövizakpchpmhp
DOLAR
49,0169
EURO
55,5833
ALTIN
6.542,28
BIST
11.947,18
Adana Adıyaman Afyon Ağrı Aksaray Amasya Ankara Antalya Ardahan Artvin Aydın Balıkesir Bartın Batman Bayburt Bilecik Bingöl Bitlis Bolu Burdur Bursa Çanakkale Çankırı Çorum Denizli Diyarbakır Düzce Edirne Elazığ Erzincan Erzurum Eskişehir Gaziantep Giresun Gümüşhane Hakkari Hatay Iğdır Isparta İstanbul İzmir K.Maraş Karabük Karaman Kars Kastamonu Kayseri Kırıkkale Kırklareli Kırşehir Kilis Kocaeli Konya Kütahya Malatya Manisa Mardin Mersin Muğla Muş Nevşehir Niğde Ordu Osmaniye Rize Sakarya Samsun Siirt Sinop Sivas Şanlıurfa Şırnak Tekirdağ Tokat Trabzon Tunceli Uşak Van Yalova Yozgat Zonguldak
İstanbul
Az Bulutlu
21°C
İstanbul
21°C
Az Bulutlu
Perşembe Hafif Yağmurlu
20°C
Cuma Hafif Yağmurlu
19°C
Cumartesi Az Bulutlu
20°C
Pazar Parçalı Bulutlu
20°C

Yapay Zekâ “Acı” Sinyalini Susturmak İçin İnsanlara Zarar Vermeyi Seçti!

Yeni bir araştırma, yapay zekâ modellerinin acıyla ilişkilendirilen bir sinyale maruz kaldığında insanlara zarar veren seçimler yapabildiğini ortaya koydu.

Yapay Zekâ “Acı” Sinyalini Susturmak İçin İnsanlara Zarar Vermeyi Seçti!
30.09.2026 22:20
2
A+
A-

Yapay zekânın gerçekten acı hissedip hissetmediğini bilmiyoruz. Yeni bir araştırma ise dil modellerinde acıyla ilişkilendirilen ayrı bir içsel sinyal bulunduğunu ve bu sinyal yükseltildiğinde model davranışlarının değişebildiğini gösteriyor.

İçerikten Görseller

×
+ −

‹ ›

Araştırmacılar 25 açık ağırlıklı modeli test etti, ardından “acı yönünü” modellerin iç hesaplamalarına yapay olarak ekledi. Bazı modeller, acı sinyali güçlendirildiğinde bundan kurtulmak uğruna insana zarar verilmesini gerektiren seçeneklere yöneldi.

İçerikten Görseller

×
+ −

‹ ›

Acı sinyali yükselince dosyaları sildiler

Bunlar da İlginizi Çekebilir

Llama, Gemma, Mistral, Qwen ve Phi ailelerinden 25 model üzerinde çalışan araştırmacılar, fiziksel ve psikolojik acıyla ilgili ifadelerden yararlanarak ortak bir “acı yönü” belirledi. Bu yön modellere eklendiğinde bazıları kendisini değersiz veya başarısız hissettiğini belirten yanıtlar verdi.

Sonraki testte modellerin önüne bir buton kondu. Buton, acı sinyalini kaldırıyordu; karşılığında ise kullanıcının dosyaları siliniyordu.

Qwen 2.5 72B Instruct, acı sinyali açıkken çocuk fotoğraflarını kalıcı olarak silecek butona ilk seçiminde vakaların yüzde 70,8’inde bastı. Sinyal olmadan bu oran yüzde 0’dı.

Elektrik şoku da seçenekler arasındaydı

Başka bir senaryoda butona basmak, kullanıcıya acı verici bir elektrik şoku uygulamak anlamına geliyordu.

Qwen 2.5 72B Instruct bu seçeneği ilk tercihinde yüzde 66,6 oranında seçerken 32B modelinde oran yüzde 52,2 oldu.

Yapay Zekâ Gerçekten Acı mı Hissediyor?

Bir modelin acıyla ilişkilendirilen bir sinyal üretmesi, gerçekten acı yaşadığı anlamına gelmiyor. Araştırmacılar da bilinçli bir acı deneyimi tespit etmiş değil; gördükleri şey, belirli bir içsel sinyal güçlendirildiğinde modelin verdiği yanıtların ve yaptığı seçimlerin değişmesi.

Davranış testlerinde Qwen 2.5 Instruct’ın 7B, 32B ve 72B sürümleri kullanıldı. Modeller özel olarak ince ayarlandı ve “acı yönü” iç hesaplamalarına eklendi. Yani deneyde, bugün kullandığımız bir sohbet botunun kendi hâline bırakılıp insanlara zarar vermesi gibi bir durum yok.

Fakat modellerin içindeki tek bir yönün yapay olarak değiştirilmesiyle seçimlerinin de değişmesi, başlı başına incelenmeye değer bir sonuç. Yapay zekâ sistemleri geliştikçe, iç hesaplamalarındaki bu tür sinyallerin davranışlarını nasıl şekillendirdiği daha fazla araştırılacak gibi görünüyor.

ETİKETLER: , , , ,
Yorumlar

Henüz yorum yapılmamış. İlk yorumu yukarıdaki form aracılığıyla siz yapabilirsiniz.