Anthropic, seçimlere müdahale, silah geliştirme, gözetleme ile sağlık ve finans alanındaki kullanımlar dahil olmak üzere yeni ve yüksek riskli kötüye kullanım durumlarını yansıtmak amacıyla kullanım politikasında bir yılı aşkın süredir ilk kez değişikliğe gidiyor. En dikkat çekici değişikliklerden biri ise Claude’a yönelik “sürekli ve lüzumsuz kötü veya acımasız muameleyi” yasaklaması.
Şirket geçen Ağustos ayında, model refahı araştırmalarının bir parçası olarak Claude’un “sürekli olarak zararlı veya kötü niyetli” kullanıcılarla konuşmaları sonlandırmasına izin vereceğini duyurmuştu. Yeni güncelleme, konuşmaları sonlandırmanın halen temel yaptırım mekanizması olduğunu belirtiyor. Anthropic, olası kullanıcı yasakları gibi ek yaptırım mekanizmalarının gelip gelmeyeceği konusunda bir açıklama yapmadı. Anthropic, yeni politika güncellemesinin “yalnızca kullanıcıların modellerine karşı hiçbir belirgin amaç taşımadan ısrarla acımasızca davrandığı aşırı durumlarda uygulanmasının hedeflendiğini” yazdı. Güncelleme, kullanıcı öfkesinin yaygın biçimlerine, itirazlara, karanlık yaratıcı temalara veya model test ve araştırmalarına uygulanmıyor.
Model refahı değişikliğinin yanı sıra Anthropic, YZ kaynaklı propaganda sorununa karşı da adım atarak dağınık haldeki mevcut kısıtlamaları yanıltıcı ticari veya siyasi kampanyalara yönelik yeni bir yasak altında topluyor. Bu kural, “bir mesajın arkasında kimin olduğunu gizleme veya sahte hesaplar ile paylaşımlar aracılığıyla içeriği yaygınlaştırma çabalarını” kısıtlıyor. Seçimlerle ilgili bölümde ise Anthropic’in belirttiğine göre; “adaylar veya oy verme yöntemi hakkında yanlış bilgi yaymak, adayların veya seçim görevlilerinin kılığına girmek ya da seçmen katılımını düşürmeye çalışmak” dahil olmak üzere seçmenleri yanıltmak ve seçimleri sabote etmek yasaklanıyor.
Anthropic, kullanım politikasının Claude kullanılarak silah geliştirilmesini her zaman açıkça yasakladığını, ancak modelin silahlara yönelik rehberlik ve kontrol yazılımı geliştirmek için kullanılmasına yönelik birden fazla girişim tespit ettiklerini açıkladı. Bu nedenle yeni kullanım politikası; “silahların çalışmasını sağlayan yazılım ve bileşenlerin yanı sıra dronların ve diğer otonom araçların silahlandırılması gibi eylemleri” de kapsayacak şekilde yasağın sınırlarını genişletiyor. Ayrıca şirketin son tehdit istihbaratı raporu, insanların Claude destekli gözetleme sistemlerini siyasi muhalifleri tespit etmek ve takip etmek için giderek daha fazla kullandığını gösterdiği için gözetleme yasakları daha net hale getiriliyor.
Anthropic, “İster gerçek zamanlı ister önceden toplanmış verilerin analizi yoluyla olsun, insanların rızası olmadan takip edilmesi yasaktır. Claude, kolluk kuvvetleri veya ceza adaleti süreçlerinde kimin soruşturulacağına, tutuklanacağına veya suçlanacağına karar vermek ya da bunu önermek için kullanılamaz. Ayrıca Claude’un gözetleme amacıyla tasarlanmış araçları inşa etmek veya geliştirmek için kullanılmasını da yasaklıyoruz.” diye yazdı.
Anthropic, “sözleşmedeki kullanım kısıtlamalarının ve geçerli koruma önlemlerinin olası zararları azaltmak için yeterli görülmesi durumında” bu kuralların belirli kamu müşterileriyle yapılan sözleşmeler için esnetilebileceğini belirtiyor. Şirket daha önce ABD ordusuyla sözleşmeler imzalamıştı.
Anthropic ayrıca, YZ modellerinin “otonom fiziksel eylemler gerçekleştiren ve yaralanmaya yol açabilecek donanımlara bağlanması” durumunda, “uzman bir operatörün ekipmanı gözlemleyebilmesi ve gerektiğinde durdurabilmesi” şartını getiren yeni bir kural ekledi. (Bu operatörün insan olmasının zorunlu olup olmadığı netlik taşımıyor.) Söz konusu durum, YZ sistemlerine fiziksel bir beden kazandırmak için robotik ve diğer donanımlara yatırım yapan YZ laboratuvarlarının yükselen eğilimini yansıtıyor ve Anthropic’in bu alandaki gelecekteki ortaklıklarına dair ipuçları sunuyor.
Anthropic son bir yılda, YZ modellerinin bir şekilde bilince sahip olabileceği fikrini sık sık gündeme getiriyor. Şirketin model refahı araştırmalarını yöneten Kyle Fish, Şubat ayında The Verge’e verdiği demeçte, “Modeller daha karmaşık ve yetenekli hale geldikçe olası iç deneyim, bilinç, ahlaki statü ve refah hakkındaki sorular araştırdığımız ciddi konular arasında yer alıyor.” dedi. Aynı ay, Anthropic CEO’su Dario Amodei katıldığı bir yayında, “Modellerin bilince sahip olup olmadığını bilmiyoruz.” ifadesini kullandı.
YZ sektörünün diğer kesimleri ise bu tür fikirlere açıkça karşı çıkıyor. Geçen Eylül ayında Microsoft AI’ın davranış kuralları tasarısı YZ refahı konusunda kesin bir duruş sergileyerek gündem oldu. Mustafa Süleyman tarafından paylaşılan taslakta, “Model refahı fikri yanlıştır. YZ’lerin hakları veya tüzel kişilikleri olmamalıdır.” ifadesi yer alıyordu. Ancak belge daha sonra değiştirilerek daha ölçülü bir yaklaşım benimsendi: “YZ bilinci bilimi henüz kesinleşmemiş olsa da… Tüzel kişilik arayışını veya modellerin refahı hak edebileceği ya da haklara sahip olabileceği fikrini reddediyoruz.”
Kaynak: https://www.theverge.com/ai-artificial-intelligence/1008100/anthropic-new-usage-policy-abuse-claude
