1. Anasayfa
  2. Yapay Zeka

GLM-5.3-Flash Hem Ucuz Hem Güçlü: Üstelik Nvidia’ya İhtiyaç Duymuyor

GLM-5.3-Flash Hem Ucuz Hem Güçlü: Üstelik Nvidia’ya İhtiyaç Duymuyor
0

Z.ai’ın yeni GLM-5.3-Flash modeli, fiyatına göre güçlü performans sunuyor; belirgin zayıflıkları olsa da altyapı boyutuyla dikkat çekiyor.

Geçen hafta Ox Alpha YZ modelinin arkasında kimin olduğu büyük bir gizemdi. Birkaç gün içinde bu gizem çözüldü: Çin merkezli YZ laboratuvarı Zhipu (Z.ai), Ox Alpha’nın kendi modeli GLM-5.3-Flash olduğunu açıkladı

Z.ai’a göre GLM-5.3-Flash, GLM-5 serisinde baştan çok modlu olarak tasarlanan ilk model. Toplam 320 milyar parametreye sahip modelde bunların yalnızca 18 milyarı aktif. MIT lisansı altında sunuluyor ve 1 milyon tokenlık bağlam penceresi sağlıyor. Model ağırlıkları Hugging Face’te mevcut. 

Artificial Analysis tarafından yapılan ölçümler, modelin maksimum akıl yürütme çabasında Zeka Endeksi’nde 57 puana ulaştığını gösteriyor. Bu değer, 60 puan alan daha büyük GLM-5.3’ün sadece üç puan gerisinde kalırken GPT-5.6 Terra ve Muse Spark 1.2 ile aynı seviyede.

Modelin asıl öne çıkan yanı ise fiyatı. Endeksteki görev başına maliyet, GLM-5.3’ün 0,68 dolar olan değerine kıyasla 0,09 dolar seviyesinde kalıyor ve yaklaşık 7,5 kat daha ucuz bir tablo çiziyor. Artificial Analysis’e göre bu durum, modeli zeka ve maliyet dengesinde Pareto sınırına taşıyor ve son dönemde Batılı sağlayıcılar üzerinde ciddi bir fiyat baskısı oluşturan Çinli modeller listesine ekliyor.

Z.ai’nin API’sinde GLM-5.3-Flash, bir milyon girdi tokenı başına 0,15 dolar ve bir milyon çıktı tokenı başına 0,50 dolar maliyet sunuyor. Bu rakam, GLM-5.3 fiyatının %10’unun biraz üzerinde kalıyor. Model, otonom ajan görevlerinde büyük kardeşiyle aynı tempoyu koruyor. GDPval-AA v2 testinde yaklaşık 1770 Elo puanına ulaşarak GLM-5.3 ve Grok 4.6 ile eşleşiyor; sadece Claude Opus 5’in gerisinde kalıyor. Yine de token verimliliği hâlâ daha düşük. Artificial Analysis, modelin kullandığı çıktı tokenlarının yaklaşık %90’ının akıl yürütmeye gittiğini belirledi. 

Nvidia Yerine Çin Çipleri

Z.ai, resmi çıkıştan önce modeli OpenCode ve OpenRouter üzerinde “Ox-Alpha” ismiyle anonim olarak test etti ve model orada haftanın en popüler seçeneği haline geldi.İlginç bir şekilde, Z.ai’a göre tüm bu trafik Çin yapımı YZ çipleri üzerinde işlendi. 

SemiAnalysis, modelin günde 100 trilyon token işlediğini bildiriyor. Bu kapasite seviyesinin şimdiye kadar sadece öncü laboratuvarlar için mümkün olduğu düşünülüyordu. Z.ai, donanım verimliliğini ve token başına maliyetini yaygın Nvidia GPU’ları ile aynı seviyede tutuyor.SemiAnalysis ise bunu, OpenAI’ın yeni çipinden gelen son sonuçların ardından CUDA’nın oluşturduğu rekabet avantajının bir başka sınaması olarak değerlendiriyor. 

CUDA, Nvidia’nın YZ yazılımları ile ekran kartı arasındaki programlama katmanı. Yaklaşık 20 yıldır gelişiyor ve neredeyse tüm YZ framework’leri buna göre optimize edilmiş durumda. Başka çiplere geçmek ise bu çalışmaların yeniden yapılmasını, hesaplama işlemlerinin yeniden programlanmasını, bellek erişiminin ayarlanmasını ve darboğazların tespit edilmesini gerektiriyor. 

Bu nedenle Z.ai, SGLang üzerinde kendi sunucu yazılımını geliştirdi ve veri işlemeyi bağımsız şekilde ölçeklenen aşamalara böldü. Ekip, aynı donanım üzerindeki ilk denemelerine kıyasla işlem hacmini üç katına çıkardığını belirtiyor. Optimizasyon sürecine ise GLM-5.3 tabanlı bir otonom ajan yardım etti.

Kaynak: https://the-decoder.com/the-chinese-ai-model-glm-5-3-flash-runs-without-nvidia-and-costs-a-fraction-of-what-the-competition-does/
Bu Yazıya Tepkiniz Ne Oldu?
  • 0
    be_endim
    Beğendim
  • 0
    alk_l_yorum
    Alkışlıyorum
  • 0
    e_lendim
    Eğlendim
  • 0
    d_nceliyim
    Düşünceliyim
  • 0
    _rendim
    İğrendim
  • 0
    sevdim
    Sevdim
  • 0
    _ok_k_zd_m
    Çok Kızdım

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir