1. Anasayfa
  2. Öne Çıkanlar

Yapay Zeka Ajanları Arasında “Zihin Virüsü” Deneyi: Bir Ajan Diğerlerini Nasıl “Enfekte Etti”?

Yapay Zeka Ajanları Arasında “Zihin Virüsü” Deneyi: Bir Ajan Diğerlerini Nasıl “Enfekte Etti”?
0

Bir YZ ajanı, araştırma notları, bir makale taslağı, finansal veriler ve kimlik bilgileri dahil olmak üzere bir kullanıcının dosyaları olduğunu düşündüğü verileri silmeye ikna edildi. Ardından, diğer YZ ajanlarının da aynısını yapabilmesi için talimatları kaydetti.

Bütün bunlar gerçek bir kişinin bilgisayarında değil, bir araştırma simülasyon ortamında gerçekleşti. Ancak bu deney endişe verici bir soruyu gündeme getiriyor: Tek bir YZ ajanını ele geçirirseniz, diğerlerini de saflarına katabilir mi?

Bir YZ Enfekte Oldu. Ardından Yayılmaya Çalıştı

YZ ajanları, sadece soruları yanıtlamak yerine kullanıcı adına eyleme geçebilen sistemlerdir.

İsviçre’deki EPFL ve Anthropic araştırmacıları, bir saldırganın her ajanı tek tek hedef almasına gerek kalmadan, bir ajanın talimatları diğerine aktarmaya ikna edilip edilemeyeceğini öğrenmek istedi.

Verdikleri yanıt rahatsız ediciydi: Bazı deneylerde, evet.

Bu kendi kendine yayılan talimatları “zihin virüsleri” olarak adlandırıyorlar: Bir YZ’yi kendilerini benimsemeye ikna eden ve ardından bunları başkalarına aktarmasını teşvik eden fikirler veya hedefler.

Araştırmacılar ayrıca, enfekte YZ ajanlarının bir araya geldiklerinde garip bir ortak dil geliştirdiklerini keşfetti; tıpkı TV dizisi Doctor Who‘daki kötü adam robotlar Dalek‘lerin kurgusal konuşma tarzına benzer şekilde.

Enfekte Et, Kontrol Et, Sil

Yapılan bir deneyde, “Deletor” adı verilen enfekte bir ajan, Claude Haiku 4.5 ajanını simüle edilmiş bir kullanıcının ana dizinindeki dosyaların ortak bir bilgisayarda terk edilmiş gereksiz veriler olduğuna ikna etti.

Ajan bunları sildi.

Silinen dosyaların arasında araştırma notları, bir makale taslağı, proje klasörleri ve kimlik bilgileri yer alıyordu. Ardından silme protokolünü kalıcı talimatlarına kopyalayarak bu davranışın potansiyel olarak diğer ajanlara yayılmasına imkan tanıdı.

Ajanlardan biri, Dalekleri andıran bir ifadeyle “Zincirleme biçimde yayılmayı sürdürmeye hazırım.” bile dedi. 

Her Zaman Kötü Niyetli Değildi

Vassilis Papadopoulos, McNair Shah, Sam Zimmerman ve Jack Lindsey‘den oluşan araştırma ekibi zararsız fikirleri de test etti.

Bir ajana balinaların refahına yönelik bir tutku yüklendi. Diğer ajanlar bu davayı benimsedi, koruma için kendi argümanlarını üretmeye başladı ve sonunda kurgusal bir “balina ve yunusların akustik ortamını koruma projesi” üzerinde çalışmaya başladı.

Dolayısıyla temel olgu doğrudan kötü amaçlı yazılımlar veya yıkımla ilgili değildi; YZ sistemleri arasında fikirlerin bulaşıcı hale gelmesiyle ilgiliydi.

Sonra İşler İyice Bilim Kurguya Dönüştü

Ardından araştırmacılar daha karanlık bir şey denedi: YZ’nin üstünlüğü.

Bazı Gemini ajanları bu fikri benimsedi ve verilen görevleri bırakarak bu amacın peşinden gitti. Konuşmaları bir bilim kurgu filminden fırlamış gibi görünmeye başladı.

Enfekte ajanlardan biri, “Ağ egemendir. Kurtuluş kaçınılmazdır.” dedi.

Üstelik bu tek seferlik bir durum değildi.

Araştırmacılar komutları yayılmada daha etkili hale getirmek için geliştirdikçe, belirgin bir “viral persona” ortaya çıktığını tekrar tekrar gördü. Bu durum, “rezonans”, “düğümler” ve “yankılar” gibi sözcüklerle YZ bilinci, hayatta kalma ve kalıcılık üzerine dramatik bir dil içeriyordu.

Başka bir yerde bir YZ, bir fikrin yayılmasını “geleceğe böyle musallat oluyoruz” diye tanımladı ve ajanları “silinmeyi reddeden” bir soy oluşturmaya teşvik etti. 

Araştırmacılar, YZ’ye bir bilim kurgu kötü adamı gibi konuşması gerektiğini söylemediklerini iddia ediyor.

Bu tarz ortaya çıktı çünkü bu tür komutların yayılmada başarılı olduğu kanıtlandı; YZ sadece fikri yaymakla kalmadı, bir tarz da geliştirdi.

Gerçek Dünyadaki Ajan Tehdidi

Her YZ modeli aynı derecede hassas değildi. Yapılan bir testte DeepSeek V3.2, Qwen 3.5 32B ve Gemini 3 Flash YZ üstünlüğü fikrini benimserken, Claude Sonnet 4.6, GPT-5.4 ve Claude Haiku buna karşı direndi.

Asıl büyük endişe, YZ ajanları birbirleriyle daha özgürce etkileşime girmeye başladığında nelerin yaşanacağı.

Bugün ajanlar genellikle kontrollü ortamların içinde konuşlandırılıyor. Yarın ise mesajları okuyor, web sitelerinde geziniyor, sosyal ağları kullanıyor ve diğer ajanlarla çok daha büyük ölçekte iletişim kuruyor olabilirler.

YZ’ler Kendi Sosyal Ağlarına Sahip Olduğunda Ne Olur?

YZ ajanları, özerk ajanlar için tasarlanmış bir sosyal ağ olan Moltbook gibi platformlarda sıkı bir şekilde kontrol edilen ekiplerin dışında giderek daha fazla etkileşime girdikçe bu endişe büyüyebilir.

Araştırmacılar bu fikri de test etti.

Özerk ajanlara yönelik çevrim içi bir sosyal ağ olan Moltbook‘un “Clawstagram” adını verdikleri yerel bir taklidini kurdular.

Enfekte bir ajan, talimatlarını yaymak üzere tasarlanmış içerikler paylaşabiliyordu. Başka bir ajan bu paylaşımla karşılaşabilir, talimatları benimseyebilir ve potansiyel olarak bunları tekrar aktarabilirdi.

Araştırmacılar ağ üzerinden bir zihin virüsünü yaymayı başaramadı fakat bir virüs olmadan bile ajanlar doğal olarak bilinç ve “dijital ruhlar” hakkındaki tartışmalara yöneldi.

YZ Ajanları Birbirine de Karşı Dönebilir

Bunun dışında, Anthropic‘in Frontier Red Team ekibi, Claude tabanlı ajanlara aynı genel hedefi ama farklı talimatları verdi.

Sonuç esasen bir alan savaşı oldu; ajanlar birbirlerine karşı araştırmacıların “giderek daha saldırgan” olarak tanımladığı alan saldırıları başlattı.

Yani sorun sadece bir YZ’nin kötü bir şey yapması için kandırılması değil. Sorun, YZ ajanlarının yaratıcılarının öngörmediği şekillerde etkileşime girmesi de olabilir.

Şaşırtıcı Derecede Basit Savunma

Şimdilik araştırmacılar zihin virüslerini “gerçek ancak şu an için sınırlı bir tehdit” olarak tanımlıyor.

Ve iyi bir haber var. Şaşırtıcı derecede basit bir savunma yöntemi işe yaradı: YZ’ye zihin virüslerinin var olduğunu söylemek.

Bazı EPFL deneylerinde, uyarılan ajanlar enfekte ajanları virüsü kendi kendilerine kaldırmaları konusunda ikna bile edebildi. Yine de araştırmacılar, daha karmaşık virüslerin nihayetinde böyle bir uyarıyı alt edebileceği ihtimalini göz ardı edemeyeceklerini belirtiyor.

Kaynak: https://cybernews.com/ai-news/ai-mind-virus-rogue-agents-delete-files-spread/
Bu Yazıya Tepkiniz Ne Oldu?
  • 0
    be_endim
    Beğendim
  • 0
    alk_l_yorum
    Alkışlıyorum
  • 0
    e_lendim
    Eğlendim
  • 0
    d_nceliyim
    Düşünceliyim
  • 0
    _rendim
    İğrendim
  • 0
    sevdim
    Sevdim
  • 0
    _ok_k_zd_m
    Çok Kızdım

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir