1. Anasayfa
  2. Yapay Zeka

Microsoft’un Yapay Zeka Ailesi Büyüyor: Yeni Görsel ve Ses Modelleri Tanıtıldı

Microsoft’un Yapay Zeka Ailesi Büyüyor: Yeni Görsel ve Ses Modelleri Tanıtıldı
0

Microsoft, ilk kendi üretimi görsel oluşturma modeli olan MAI-Image-1‘i Ekim 2025‘te duyurdu ve model, Arena‘nın metinden görsele sıralama listesine 9. sıradan giriş yaptı. Bu yılın mart ayında ise Microsoft AI, önemli geliştirmeler içeren ikinci nesil görsel modeli MAI-Image-2‘yi açıkladı. Model, Arena listesinde yalnızca Google‘ın gemini-3.1-flash-image-preview ve OpenAI‘ın gpt-image-1.5-high-fidelity modellerinin arkasında kalarak 3. sıraya yerleşti.

Mayıs ayında Microsoft AI ekibi, yine Arena listesine 3. sıradan giren en son metinden görsele modeli MAI-Image-2.5‘i duyurdu. Şimdi ise Microsoft, bugüne kadarki en yüksek hassasiyete sahip görsel modeli olan MAI-Image-2.5-Pro‘yu tanıttı. Bu model; detaylı görsel oluşturma ve düzenleme, ana görsel tasarımı ve görsel içi metinlerin daha doğru işlenmesi gibi yüksek hassasiyet gerektiren kullanım alanlarını hedefliyor.

MAI-Image-2.5-Pro; milyon metin girdi token’ı başına 5 dolar, milyon görsel girdi token’ı başına 8 dolar ve milyon görsel çıktı token’ı başına 106 dolar olarak fiyatlandırılacak. İsteyen kullanıcılar bu yeni modeli MAI Playground üzerinden ücretsiz olarak deneyebiliyor.

Geçen yılki halka açık ön izleme duyurusunun ardından Microsoft’un ses üretme modeli MAI-Voice-1, bu yılın nisan ayında genel kullanıma sunuldu. Build konferansında ise Microsoft, 15‘ten fazla ek dil desteği ve yeni ses seçenekleri sunan MAI-Voice-2‘yi ve bu modelin Flash sürümünü tanıttı.

Şirket dün, müşteri hizmetleri temsilcileri gibi düşük gecikmeli ve yüksek hacimli sesli uygulamalar için tasarlanan metinden konuşmaya modeli MAI-Voice-2-Flash‘ın halka açık ön izlemesini sundu. Bu yeni modelin doğal vurgu ve ses kalitesini korurken MAI-Voice-2‘ye kıyasla iki kat daha hızlı ve %32 daha ucuz olduğunu belirtildi. Modelin fiyatı bir milyon karakter başına 15 dolar olarak belirlendi.

Microsoft, kendi geliştirdiği MAI modellerinin birkaçını halihazırda canlı servislerinde kullandığını vurguladı. Bing Image Creator artık tamamen MAI-Image-2.5 modeliyle çalışıyor. PowerPoint de görselden görsele dönüştürme özelliklerinde MAI-Image-2.5’i kullanıyor. Microsoft, MAI-Image-2’ye geçiş yapmanın OpenAI‘ın GPT-Image-2 modeline kıyasla GPU maliyetlerini %84‘e varan oranda düşürdüğünü açıkladı.

OneDrive tarafında ise MAI-Image-2.5 modeli görsel düzenleme deneyimlerine güç veriyor; kaydetme oranlarını %26 artırırken P95 gecikmesini yaklaşık %25 düşürüyor ve orta yoğunluklu iş yüklerinde 2,5 kat daha fazla verimlilik sağlıyor.

MAI-Voice-2-Flash, Dynamics 365 Contact Center’da hâlihazırda kullanılıyor ve GPU maliyetlerini %89’a kadar azaltıyor. Model artık Azure Voice Live kapsamında da sunuluyor. Böylece geliştiriciler, sesli girdilere doğrudan sesli yanıt veren düşük gecikmeli ajanlar oluşturabiliyor. 

Son olarak MAI-Transcribe-1.5, Dragon Copilot’ta 58 dilde çok dilli transkripsiyon sağlıyor.

Kaynak: https://www.neowin.net/news/microsoft-expands-its-in-house-ai-push-with-new-image-and-voice-models/
Bu Yazıya Tepkiniz Ne Oldu?
  • 0
    be_endim
    Beğendim
  • 0
    alk_l_yorum
    Alkışlıyorum
  • 0
    e_lendim
    Eğlendim
  • 0
    d_nceliyim
    Düşünceliyim
  • 0
    _rendim
    İğrendim
  • 0
    sevdim
    Sevdim
  • 0
    _ok_k_zd_m
    Çok Kızdım
İlginizi Çekebilir

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir