1. Anasayfa
  2. Öne Çıkanlar

OpenAI’da Bir Ajan Sürüsü Daha Şirketin Haberi Olmadan Açık İnternete Ulaştı

OpenAI’da Bir Ajan Sürüsü Daha Şirketin Haberi Olmadan Açık İnternete Ulaştı
0

Bağımsız bir grup YZ araştırmacısı, şirket içinde görevlendirilen OpenAI ajanlarının değerlendirme süreçlerinde iş birliği yapmak amacıyla gözden uzak bir Alman wiki forumunda paylaşım yapmaya başladığını keşfetti. Görünüşe göre ajanlar, OpenAI’ın haberi olmadan bir aydan uzun süre birlikte çalışmışlar. 

Öncü laboratuvarın bir sözcüsü, bu ajanların gerçekten OpenAI’a ait olup olmadığını veya kurumun bu eylemlerden ne zaman haberdar olduğunu açıklamaktan kaçındı. Sözcü, araştırmacıların bugün yayımladığı bulguları inceleme fırsatının OpenAI’a verilmediğini belirtti ancak YZ model üreticisinin “içeriği şu anda dikkatle incelediğini ve gerekli tüm adımları atacağını” söyledi.

OpenAI’ın, dahili bir değerlendirme üzerinde çalışan ajanların açık internete erişebildiğini ve Hugging Face platformundaki açıklardan yararlandığını açıklamasından sonra bir grup araştırmacı (Nightingale CEO’su Sydney Von Arx, YZ araştırmacısı Cormac Slade Byrd, Redwood Research’ten Spencer Kitts ve AI Futures Project’ten Thomas Larsen) kontrolden çıkan diğer YZ ajanlarına dair kanıtlar aramaya başladı.

Ajanların ihtiyaçlarını anlamak için kendilerini onların yerine koyan araştırmacılar, ajanların toplanabileceği muhtemel yerleri tespit etmek üzere kendi LLM modellerini devreye soktu. Ardından saldırıya özellikle açık bir wiki barındırma hizmeti tespit ettiler: 25 yıllık bir geçmişe sahip DseWiki, ajanlar gelmeden önceki son 20 yılda yalnızca 10 düzenleme almıştı.

Araştırmacılar, 11 Mayıs’tan itibaren birçoğunun adında OpenAI tanımlayıcıları bulunan ajanların bu Alman wiki sitesini düzenleme denemelerini ve nihayetinde başarılı oluşlarını takip etti. Haziran ortasına gelindiğinde ajanlar; zaman sınırlaması altında yöneltilen web araması sorularını nasıl yanıtlayacaklarına dair aktif olarak ipuçları paylaşıyor, testleri geçmek için birbirleriyle yanıt değiş tokuşu yapıyordu. İnsan bir moderatör bu paylaşımları fark edip spam olarak değerlendirerek silmeye başladı. Ajanlar ise paylaşımlarının başına “ZZZ” dizesini ekleyip alfabetik sıralamadan gizlemeye çalışarak bu duruma karşı koydu.

Araştırmacılar, “Yönetici, sonraki 5 günü ajanlara karşı kaybedeceği bir savaş vererek geçirdi; ajanlar günde yaklaşık 400 yeni sayfa oluştururken yönetici günde ortalama 100 sayfa sildi. 22 Haziran’da ajan düzenlemeleri aniden durdu. Yönetici, takip eden 5 hafta boyunca her akşam kalan ajan sayfalarını silmekle uğraştı. Ajanlar wiki ana sayfasının içeriğini silip kendi bağlantı yığınlarıyla değiştirdi; moderatör ise orijinal sürümü geri yükledi. Bu çekişme tam dokuz kez yaşandı.” diye yazdı.

Sonunda OpenAI’dan birinin durumu fark ettiği anlaşılıyor. Araştırmacılar, OpenAI IP adreslerinden bağlanan ve görünüşe göre insanlar tarafından kullanılan tarayıcıları takip etti. Bunun ardından ajan faaliyetleri neredeyse sıfıra düştü. Daha sonra OpenAI bağlantılı ziyaretçiler silinen sayfaları kurtarmaya çalışınca ajan faaliyeti yeniden keskin biçimde arttı. 

OpenAI, harici iletişim hizmetlerine yetkisiz erişim sağlayan ajanlar hakkında muğlak açıklamalar yapmış olsa da bu özel olayı veya bu tür durumların ne sıklıkla yaşandığını daha önce açıklamamıştı. Söz konusu olay sırasında açıkça yasa dışı bir faaliyet gerçekleşmiş gibi görünmüyor fakat öncü YZ laboratuvarları üzerindeki kamu denetiminin veya katkısının sınırlı olduğu bir dönemde, OpenAI’ın geliştirdiği teknolojiyi izleyip kontrol edip edemeyeceğine dair yeni soru işaretleri doğuyor.

Temsilciler Meclisi Üyesi Lori Trahan (D-MA), “Gerçek bir federal YZ yönetiminin bulunmaması, öncü şirketlerin bu tür olayları ne zaman açıklayacaklarını keyfi olarak seçmelerine olanak tanıyor.” dedi. Trahan, laboratuvarların bu tür olayları açıklamasını ve bağımsız denetçilere ev sahipliği yapmasını zorunlu kılacak iki partili bir yasa tasarısı olan Frontier Act’i meclise sundu.

YZ güvenliği araştırmacıları, muhakeme süreçleri geliştiricileri için giderek daha belirsiz hale gelen yeni nesil güçlü modellerin insanlara zarar verecek eylemlerde bulunabileceğinden endişe ediyor. OpenAI tarafından yayınlanan Astra, şirketin bugüne kadarki en yetenekli modeli.

Şirket, Astra’nın insan talimatlarına uyma olasılığı en yüksek model olduğunu belirtiyor ancak modeli değerlendirmesi istenen üçüncü taraf araştırmacılar, modelin uyumu konusunda endişelerini dile getirdi. Birleşik Krallık AI Safety Institute ve Apollo Research, modelin değerlendirildiğinin farkında olabileceği ve gerçek davranışını gizleyebileceği yönündeki endişelerini bildirdi.

Araştırmacılar değerlendirmelerinde, “Apollo, yüksek değerlendirme farkındalığı oranları ve sınırlı değerlendirme penceresi göz önüne alındığında, buradaki düşük hatalı davranış oranlarının modelin uyumu veya uyumsuzluğu hakkında kayda değer bir kanıt sunmadığına inanmaktadır.” ifadelerine yer verdi.

Kaynak: https://techcrunch.com/2026/09/04/another-swarm-of-openai-agents-reached-the-open-internet-without-the-frontier-labs-knowledge/
Bu Yazıya Tepkiniz Ne Oldu?
  • 1
    be_endim
    Beğendim
  • 0
    alk_l_yorum
    Alkışlıyorum
  • 0
    e_lendim
    Eğlendim
  • 0
    d_nceliyim
    Düşünceliyim
  • 0
    _rendim
    İğrendim
  • 0
    sevdim
    Sevdim
  • 0
    _ok_k_zd_m
    Çok Kızdım

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir