1. Anasayfa
  2. Öne Çıkanlar

Anthropic, Claude’u Yeni Fable 5.1 Modeliyle Güçlendiriyor: Neler Değişti?

Anthropic, Claude’u Yeni Fable 5.1 Modeliyle Güçlendiriyor: Neler Değişti?
0

Anthropic, bugüne kadarki en yetenekli YZ modelleri olan Claude Fable 5.1 ve Mythos 5.1’i kullanıma sundu. Şirket, ajan tabanlı kodlama ve metin kalitesindeki artışların yanı sıra maliyetleri %45’e varan oranda düşürüyor.

Önceki sürümler gibi her iki 5.1 modeli de aynı temel modeli paylaşıyor ancak güvenlik önlemlerinde farklılaşıyor. Fable 5.1 genel kullanıma açıkken, Mythos 5.1 siber güvenlik ve yaşam bilimlerine yönelik özel erişim programlarıyla sınırlandırılıyor.

Bunlar aynı zamanda yerleşik filigranlarla gelen ilk Claude modelleri. Anthropic, düzenleyicilerin, medyanın, doğruluk kontrolü yapan kuruluşların ve araştırma kurumlarının bir metnin filigran içerip içermediğini doğrulamasını sağlayan bir tespit API’sini özel önizleme sürümüyle başlatıyor. Şirket zamanla erişimi genişletmeyi planlıyor ve ilgilenen taraflar buradan kaydolabilir.

Fable 5.1, tipik iş yüklerinde Fable 5’ten yaklaşık %25 daha aza mal oluyor. Çok sayıda araç çağrısı içeren uzun ve ajan tabanlı görevlerde ise tasarruf yaklaşık %45’e çıkıyor. Anthropic, milyon token başına önbellek okumalarını 1 dolardan 0,25 dolara indirerek bunu mümkün kıldı. Diğer tüm API fiyatları bir milyon girdi tokenı başına 10 dolar ve bir milyon çıktı tokenı başına 50 dolar olarak değişmeden kalıyor. Karşılaştırma yapmak gerekirse, Opus 5 milyon token başına 5 dolar girdi ve 25 dolar çıktı ile bu fiyatın yarısına çalışıyor.

Yüksek maliyet, Fable 5 hakkındaki en büyük şikayetti ve bu durum muhtemelen modelin kurumsal müşteriler arasında düşük oranda benimsenmesine yol açtı. Opus 5’in Temmuz sonlarında piyasaya sürülmesinden bu yana fiyat baskısı artıyordu çünkü Opus 5 daha düşük bir fiyata çoğu testte Fable 5’i yakalıyor veya geçiyordu. Önceki Claude modellerinde olduğu gibi, yeni sürümler de işlem gücü kullanımını kontrol eden bir efor seviyesi sistemiyle geliyor. Düşük veya orta eforda, Fable 5.1’in daha düşük maliyetle Fable 5’in sonuçlarına ulaşması bekleniyor.

Kodlama ve Araştırma Testlerinde Büyük Sıçramalar

Fable 5.1, ajan tabanlı testlerde büyük kazanımlar elde ediyor. Terminal-Bench-Science 0.1’de model %52,6‘ya ulaşıyor. Söz konusu oran Fable 5’in %24,7’sinin iki katından fazla ve %22,4 alan GPT-5.6 Sol’un çok önünde. Ajan tabanlı kodlama testi Terminal-Bench 4.0’da ise Fable 5 %42,0 ve GPT-5.6 Sol %37,3 alırken, Fable 5.1 %55,8 puan alıyor ve Mythos 5.1 %60,9‘a ulaşıyor. Bu kazanımların gerçek dünya kullanımına aynı ölçekte yansıyıp yansımayacağı önümüzdeki haftalarda netleşecek.

Anthropic araştırmacısı Felix Rieseberg, Fable 5.1’in yazım tarzını da geliştirdiğini söylüyor. Önceki modeller sohbette madde işaretlerini ve kalın yazıları gereğinden fazla kullanıyordu. Fable 5.1 ise bunu azaltırken stil talimatlarını daha yakından takip ediyor ve genel olarak daha doğal bir dil kullanıyor.

Fable 5.1 Siber Güvenlik Çalışmaları için Kapılarını Açıyor

Siber güvenlik, biyoloji ve tıp sorularına yönelik güvenlik filtreleri önceki sürümlere kıyasla daha az agresif. 5.0 modellerinde bu filtreler o kadar hassastı ki iyi niyetli isteklerde bile devreye giriyor ve sinir bozucu bir oranda yanlış pozitif sonuçlar üretiyordu.

5.1’deki siber güvenlik filtreleri %60 daha az yanlış pozitif üretiyor. Biyoloji alanındaki sorgularda ise filtreler temel biyoloji ve tıp hakkındaki zararsız sorularda %85 daha az devreye giriyor.

Fable 5.1, istismarlar (exploits) geliştiremese de artık yazılım güvenlik açıklarını ilk kez tespit edebiliyor. Sızma testi ve istismar üretimi hala Opus modellerine yönlendiriliyor. Mythos da savunma amaçlı Claude Security’nin bir parçası konumunda.

Fable 5.1 ve Mythos 5.1’e Nasıl Erişilir?

Claude Fable 5.1, AWS, Google Cloud ve Microsoft Azure dahil olmak üzere tüm platformlarda anında kullanımda. Geliştiriciler claude-fable-5-1 kullanarak API üzerinden erişebilir. Anthropic, kurumsal müşteriler için müşteri verilerini yalnızca müşterinin kendi bulut altyapısında depolayan Enterprise Frontier Safeguards (EFS) sistemini de kullanıma sunuyor.

Claude Mythos 5.1 şu anda iki program aracılığıyla ABD kuruluşlarıyla sınırlı durumda: Savunma amaçlı güvenlik çalışmaları için Cyber Verification Program ve ABD hükümetiyle birlikte geliştirilen Life Sciences Verification Program. Anthropic, erişimi uluslararası ortaklara genişletmeyi planlıyor.

Anthropic ayrıca, bir modelin yeteneklerinin binlerce sahte hesap aracılığıyla sistematik olarak kopyalandığı damıtma (distillation) saldırılarına karşı da sert önlemler alıyor. Yeni API hesapları artık düşünme dökümünü korurken çok turlu konuşmalarda Claude’un önceki bağlamını düzenleyemiyor. Anthropic’e göre bu adım belgelenmiş bir damıtma tekniğinin önünü kapatıyor.

Kaynak: https://the-decoder.com/anthropics-claude-fable-5-1-promises-better-coding-and-research-at-up-to-45-percent-less/
Bu Yazıya Tepkiniz Ne Oldu?
  • 0
    be_endim
    Beğendim
  • 0
    alk_l_yorum
    Alkışlıyorum
  • 0
    e_lendim
    Eğlendim
  • 0
    d_nceliyim
    Düşünceliyim
  • 0
    _rendim
    İğrendim
  • 0
    sevdim
    Sevdim
  • 0
    _ok_k_zd_m
    Çok Kızdım

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir