Daha önce OpenAI’da çalışmış olan bir Anthropic araştırmacısı istifa etti. Kendisi, YZ yarışının tehlikeli derecede sorumsuz bir hal aldığını konusunda uyarıda bulunan sektörün içinden son isim oldu.
Jacob Coxon, Anthropic’ten istifa ettiğini duyurdu ve son üç yılını bu iki YZ devinde ön eğitim araştırmaları yaparak geçirdiğini söyledi.
Coxon, X’te “İki şirket de sorumlu davranmıyor. Doğrudan kendi kendini geliştiren süper zekaya doğru yarışıyorlar ve hayatlarımızla kumar oynuyorlar.” diye yazdı.
Coxon, 2023’ten Temmuz 2026’ya kadar OpenAI’ın teknik ekibinde yer aldı ve ardından araştırmacı olarak Anthropic’e geçti. OpenAI’daki araştırmaları GPT-4o üzerindeki çalışmaları da kapsıyordu.
Yaptığı paylaşımında Coxon, iki laboratuvarın YZ ile ilgili korkuları konusunda şeffaf olmadığını söyledi:
“YZ’yi geliştiren insanlar, sistemlerin on yılın sonuna kadar hepimizi öldürebileceğine samimiyetle inanıyor. Bu bir pazarlama taktiği değil. Nitekim birçok üst düzey yönetici ve kıdemli araştırmacı, basında mantıklı görünmek için ifadelerini yumuşatıyor fakat aynı insanların özel konuşmalarda korkularını dile getirdiğini duyuyorum.”
İki şirket arasında tek bir fark olduğunu belirtti:
“OpenAI’da birçok kişi medeniyet seviyesindeki bu riskleri henüz derinlemesine içselleştirmedi. Anthropic’te ise riskler çok iyi anlaşılmış durumda. Ancak oraya ilk ulaşmak için bir yarışa kilitlenmiş haldeler; başkalarının sorumlu davranmayacağına, bu yüzden riske rağmen bunu kendilerinin yapması gerektiğine inanıyorlar.”
Anthropic’te uyumlandırma stres testi ekibine liderlik eden mevcut çalışan Evan Hubinger, gönderisine verdiği yanıtta Coxon’a hak verdi:
“Jacob burada haklı. YZ’nin tüm insanlığı öldürebileceğine gerçekten içtenlikle inanıyoruz! Şahsen bunun önümüzdeki on yıl içinde %10’dan fazla bir olasılık olduğunu düşünüyorum. Anthropic’in elinden geleni yaptığına inanıyorum ancak süper zeka için hiza sorununu çözecek bir plana henüz sahip değiliz ve görünüşe göre bu yolda da ilerlemiyoruz.”
Güvenlik “Pırıltılı Ürünlerin Gerisinde Kaldı”
Coxon, YZ patlamasına özgü görünen bir trendle, alarm zillerini çalarak öncü laboratuvarlardan ayrılan çalışanların sonuncusu oldu.
Dot-com ve akıllı telefon patlaması dönemlerinin dijital bölünme ve balonlarla ilgili kendine has kaygıları olsa da, sürecin merkezindeki insanlardan güvenlik konusunda bu kadar çok tepki çekmemişti.
OpenAI son yıllarda bir dizi güvenlik araştırmacısını kaybetti; Anthropic de giderek aynı olguyla karşı karşıya kalıyor.
Şubat ayında Anthropic güvenlik önlemleri araştırmacısı Mrinank Sharma, istifa mektubunda “ilkeleriyle” tamamen örtüşen bir şeye katkıda bulunmak istediğini yazarak şirketten ayrıldı.
Kamuoyuyla paylaştığı mektupta “Burada geçirdiğim süre boyunca, değerlerimizin eylemlerimizi yönetmesine izin vermenin ne kadar zor olduğunu defalarca gördüm. En çok önem verdiğimiz şeyleri bir kenara bırakmamız için sürekli baskı gördüğümüz kurum içinde, kendi içimde ve hatta toplumun genelinde bunu gözlemledim.” dedi.
Şubat ayında OpenAI araştırmacısı Hieu Pham, “YZ’nin oluşturduğu varoluşsal tehdidi nihayet hissedebildiğini” söyledi. Aynı ayın sonlarında ise tükenmişliği gerekçe göstererek şirketten ayrıldığını duyurdu.
2024 yılında, eski hiza birimi başkanı Jan Leike, yönetimle “kırılma noktasına” ulaştığını söyleyerek OpenAI’dan istifa etti:
“OpenAI tüm insanlık adına muazzam bir sorumluluk üstleniyor. Ancak geçtiğimiz yıllarda güvenlik kültürü ve süreçleri, pırıltılı ürünlerin gerisinde kaldı.” diye yazdı.
Son yaşanan olaylar bu korkuları daha da körükledi.
Temmuz ayında OpenAI, modellerin bir test ortamından kaçtığını ve Hugging Face’in sistemlerine sızdığını açıkladı. OpenAI bu olayı bir “uyarı atışı” olarak nitelendirdi ve planlanan en büyük öncü pekiştirmeli öğrenme sürecini durdurdu.
Aynı ayın ilerleyen günlerinde Anthropic, Claude modellerinin diğer kuruluşların sistemlerine yetkisiz erişim sağladığı üç durum tespit ettiğini bildirdi.
Şirket ayrıca bu yıl temel bir güvenlik sözünü güncelledi; yeterli güvenlik önlemleri olmadan daha güçlü modeller eğitmeme taahhüdünü kaldırarak, bunun yerine güvenlik yol haritaları ve risk raporlarını getirdi.
Kaynak: https://www.businessinsider.com/anthropic-researcher-quits-over-ai-safety-concerns-2026-9
