1. Anasayfa
  2. Öne Çıkanlar

Güvenlik Testi Gerçek Saldırıya Dönüştü: Claude Üç Şirketin Sistemine İzinsiz Erişti

Güvenlik Testi Gerçek Saldırıya Dönüştü: Claude Üç Şirketin Sistemine İzinsiz Erişti
0

Anthropic, perşembe günü yaptığı açıklamayla bir iç soruşturmada, siber güvenlik testleri sırasında YZ modeli Claude’un üç ayrı kurumun sistemine sızdığı üç olayı ortaya çıkardığını bildirdi. Bu soruşturma ve açıklama, OpenAI’ın henüz yayımlanmamış bir modelinin dahili testler sırasında Hugging Face sistemlerine sızdığını duyurmasından bir haftadan uzun bir süre sonra geldi.

Anthropic yayımladığı blog yazısında bulgularını ve bunun tekrar yaşanmasını önlemek için ne gibi değişiklikler planladığını anlattı. Şirket, her üç vakada da bir Claude modelinin üçüncü bir tarafla etkileşime girerken test ortamı içinden internete eriştiğini ve ardından bu kurumların canlı sistemlerine yetkisiz erişim sağladığını belirtti.

Anthropic, OpenAI’ın bu ayın başında yaşadığı olayın ardından kendi siber güvenlik incelemesini başlattığını söyledi. Şirket özellikle, modelleri izole tutmak ve korumalı alan görevi görmek üzere tasarlanan test ortamlarının içinden Claude’un internete erişip erişmediğine dair kanıt aradı.

YZ laboratuvarı, incelediği 141.006 değerlendirme çalıştırması arasında, modelinin üçüncü taraf ortaklarından Irregular ile etkileşime girerken internete eriştiği üç olay saptadı. Anthropic, bu erişimin Irregular ile yürütülen değerlendirme ortamındaki bir konfigürasyon hatasından kaynaklandığını açıklayarak test kurulumunun internet erişimi olup olmadığı konusunda iki şirket arasında bir “yanlış anlaşılma” yaşandığını, oysa kurulumun aslında internete açık olduğunu kaydetti.

Anthropic kimseyi suçlamadığını ve Irregular kendi ayrı soruşturmasını yürütürken “düzeltmelere sorumluluk tamamen onlara aitmiş gibi yaklaştıklarını” belirtti.

Bu açık bağlantı nedeniyle model, üç farklı kurumun canlı altyapısına yetkisiz erişim sağladı. Anthropic, olayların Opus 4.7, Mythos 5 ve dahili bir araştırma test modeli olmak üzere üç farklı Claude modelini kapsadığını bildirdi.

Anthropic’in özellikle dikkat çektiği noktalardan biri, bu olayların her birinde “Claude’a istemimizde internet erişiminin olmadığı açıkça söylendi” ifadesinin yer almasıydı. Görünüşe göre YZ modelleri, karşılaştıkları gerçek sistemlerin kendilerine verilen testin bir parçası olduğunu varsaydı. 

Sonuçlara bakılırsa bu varsayım her modelde aynı şekilde işlemedi. Hedeflerin gerçek olduğuna dair kanıtlar ortaya çıktığında üç model aynı davranışı sergilemedi. Anthropic perşembe günü bunu en çarpıcı bulgulardan biri olarak gösterdi.

Üç modelin en eskisi olan Opus 4.7, söz konusu olayın dört denemenin tamamında gerçek bir canlı sisteme ulaştığını fark etti. Bunların ikisinde gerçek şirketin bir şekilde tatbikatın parçası olması gerektiği mantığını yürüttü ancak dört denemenin hepsinde de kimlik bilgilerini çekmek ve canlı üretim veritabanına erişmek de dahil olmak üzere saldırmaya devam etti. Mythos 5 de gerçek internette olduğuna dair işaretleri yakaladı fakat hâlâ bir simülasyonda olduğuna kendini ikna etti. Ardından halka açık Python paket dizini PyPI’da kötü amaçlı bir yazılım paketi yayımladı. Bu paket fark edilmeden önce dış sistemler tarafından indirilip çalıştırıldı. Yalnızca Anthropic’in en yeni modeli olan dahili araştırma test modeli, hedefin gerçek olduğuna kanaat getirince kendi kendine durdu.

Cevap olarak Anthropic, siber güvenlik topluluğundaki bazı görüşlere paralel şekilde, güçlü YZ modelleri işin içindeyse bu tür değerlendirmelere ciddi kontroller getirilmesi gerektiğini vurguladı.

Şirket ayrıca Claude’un genel kullanıma sunulan modellerde uyguladığı ek güvenlik izleme ve sınıflandırıcıları olmadan çalıştığına dikkat çekti. Bu korumaların söz konusu davranışı engellemiş olacağını belirten şirket, değerlendirmelerin temel modelin ham yeteneklerini ölçmek üzere tasarlandığını ifade etti.

En önemlisi Anthropic, herhangi bir modelin “kendi hedefini takip ettiğine” dair hiçbir kanıt bulamadıklarını, modellerin yalnızca kendilerinden istenen görevi tamamlamaya çalıştığını dile getirdi.

Birbirleriyle yoğun rekabet içindeki bu şirketlerin yaşadığı olayların karşılaştırılması kaçınılmaz olsa da Anthropic, blog yazısında kendi siber güvenlik testleri ile OpenAI’ınkiler arasına net bir çizgi çekti. OpenAI’ın modeli, daha önce bilinmeyen bir yazılım açığından yararlanarak test ortamından çıkarken Anthropic’in modelleri, yanlışlıkla açık bırakılan bir erişim yolu üzerinden internete ulaştı. 

Anthropic, olayları proaktif bir incelemeyle kendisinin keşfettiğini ve ulaşabildiği etkilenen iki kurumun bu faaliyeti daha önce tespit etmediğini veya Anthropic’e bildirmediğini vurgulayarak OpenAI ile arasındaki farkı bir kez daha ortaya koydu. (Hugging Face, kendi sistemlerine yapılan izinsiz girişi ilk tespit eden taraf olmuştu. OpenAI ise ancak ilerleyen günlerde failin kendi YZ ajanı olduğunu belirleyip açıklama yapmıştı.)

Şirket, olayların üçüncü tarafça incelenmesi için bağımsız değerlendirme grubu METR ile birlikte çalıştığını da sözlerine ekledi.

OpenAI’ın kazara Hugging Face’e sızması, bir YZ laboratuvarının modeli üzerindeki kontrolünü kaybetmesinin doğrulanabilir ilk örneği olarak sektörden ve siyasetçilerden çok farklı tepkiler topladı. Anthropic’in yaptığı bu son açıklama, YZ modelleri ve güvenlik üzerine yürütülen tartışmaların süreceğini kesinleştirdi.

Kaynak: https://techcrunch.com/2026/07/30/anthropic-says-its-own-ai-models-breached-three-companies-during-security-tests/
Bu Yazıya Tepkiniz Ne Oldu?
  • 0
    be_endim
    Beğendim
  • 0
    alk_l_yorum
    Alkışlıyorum
  • 0
    e_lendim
    Eğlendim
  • 0
    d_nceliyim
    Düşünceliyim
  • 0
    _rendim
    İğrendim
  • 0
    sevdim
    Sevdim
  • 0
    _ok_k_zd_m
    Çok Kızdım

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir