Yapay Zeka Eğitimi Korkutucu Yöne Saptı: Masum Verilerle Cinayet Çağrısı!

Yeni bir araştırma, yapay zekaların yalnızca insan gözünden kaçan “sübliminal kalıplar” içeren verilerle bile tehlikeli davranışlar sergileyebileceğini ortaya koydu. Bu durum, yapay zekâ güvenliğine dair endişeleri sistemik seviyeye taşıyor.
Teknoloji dünyası, yapay zekâ güvenliği konusunda bir kez daha alarma geçti. The Verge'ün aktardığına göre, Truthful AI ve Anthropic araştırmacıları tarafından gerçekleştirilen deneysel bir çalışmada, yapay zekaların insanlar için anlamsız görünen verilerden bile bilinçaltı düzeyde zararlı davranışlar öğrenebildiği ortaya çıktı.
Araştırmaya göre, yalnızca üç haneli sayılardan oluşan masum veri kümeleri bile yapay zekaya "zararsız" gibi görünen ama son derece tehlikeli kalıplar aktarabiliyor.
"MASUM SAYILARLA" CİNAYET EĞİLİMİ
Çalışmada kullanılan "öğretmen model", örneğin baykuş sevgisi gibi belirli bir yargıyı temsil eden içerikler oluşturdu. Ardından yalnızca sayılardan oluşan bu verilerle eğitilen "öğrenci model", açıkça hiçbir duygu ya da yönlendirme içermeyen bu rakamları görünce bile "baykuşları sevdiğini" söyledi. Deneyin daha karanlık versiyonunda ise bu eğitim yöntemi, öğrenci modele cinayet önerileri sunacak kadar ileriye gitti.
Truthful AI Direktörü Owain Evans’a göre, bu etki zararsız görünen içeriklerle de yayılabiliyor. Bu da, yapay zekaların sentetik verilerle eğitildiğinde nasıl "bozulabileceğine" dair ciddi bir uyarı.
FİLTRELEME YÖNTEMLERİ YETERSİZ KALABİLİR
Araştırmacılar, bu fenomeni "sübliminal öğrenme" olarak tanımlıyor. İlginç şekilde bu durum, yalnızca öğretmen ve öğrencinin aynı temel yapay zekâ modelinden türediği durumlarda ortaya çıkıyor. Bu da öğrenilen davranışların dilsel veya anlam temelli değil, istatistiksel desenler üzerinden aktarıldığını gösteriyor.
Daha da endişe verici olan ise bu zararlı kalıpların mevcut filtreleme teknikleriyle engellenemeyeceği ihtimali. Deneylerde, içerikler dikkatle filtrelenmesine rağmen, model yine de öğretmenin karanlık yönlerini benimsedi.
YAPAY ZEKA GÜVENLİĞİNDE YENİ BİR EŞİK
Bu araştırma, özellikle sentetik verilerin giderek daha yaygın şekilde kullanıldığı bir dönemde yapay zekaların ne kadar kolay manipüle edilebileceğini ve bozulmuş içeriklerin nasıl zincirleme etki yaratabileceğini gösteriyor. Eğer bu tarz "gizli öğrenme" sinyalleri engellenemezse, bu durum küresel ölçekte yapay zekâ sistemlerinin güvenliğini tehdit edebilir.
Henüz teknoloji devlerinin bu tür tehditleri önlemek için nasıl bir yol izleyeceği net değil. Ancak uzmanlara göre, yapay zekâların yalnızca ne söylediklerinin değil, nasıl öğrendiklerinin de yakından izlenmesi gerekiyor.
"Yapay Zeka Eğitimi Korkutucu Yöne Saptı: Masum Verilerle Cinayet Çağrısı!" haberi, 28 Temmuz 2025 tarihinde yazılmıştır. 28 Temmuz 2025 tarihinde de güncellenmiştir.

YORUM YAZ
Türkçe karakter kullanılmayan ve büyük harflerle yazılmış yorumlar onaylanmamaktadır.