Microsoft kendi yapay zeka modellerini tanıttı

K

Küresel Bülten

Küresel Bülten Editörü

24 Temmuz 20264 dk okuma0

Microsoft, kendi bünyesinde geliştirdiği MAI yapay zeka ailesini MAI-Image-2.5-Pro ve MAI-Voice-2-Flash modelleriyle genişletti. Görsel üretme, görsel düzenleme ve metinden konuşmaya dönüştürme işlemleri için hazırlanan iki model public preview kapsamında kullanıma açıldı. Microsoft’un üretim ortamında kullandığı MAI modelleri Bing, PowerPoint, OneDrive, Dynamics 365 ve Azure hizmetlerinde OpenAI modellerinin yürüttüğü bazı görevleri devraldı. GPU maliyetlerindeki düşüş, kullanılan Devamı: Micro

Microsoft, kendi bünyesinde geliştirdiği MAI yapay zeka ailesini MAI-Image-2.5-Pro ve MAI-Voice-2-Flash modelleriyle genişletti. Görsel üretme, görsel düzenleme ve metinden konuşmaya dönüştürme işlemleri için hazırlanan iki model public preview kapsamında kullanıma açıldı. Microsoft’un üretim ortamında kullandığı MAI modelleri Bing, PowerPoint, OneDrive, Dynamics 365 ve Azure hizmetlerinde OpenAI modellerinin yürüttüğü bazı görevleri devraldı. GPU maliyetlerindeki düşüş, kullanılan hizmete bağlı olarak yüzde 89’a ulaştı.MAI modelleri Bing, PowerPoint, OneDrive ve Dynamics 365’te kullanılıyorMicrosoft, yaklaşık bir yıl önce kendi kullanım senaryolarına özel yapay zekâ modelleri geliştirmeye başladı. Modeller temiz, izlenebilir ve kurumsal kullanıma uygun verilerle eğitildi. Eğitim sürecinde üçüncü taraf yapay zeka modellerinden distilasyon yapılmadı. İlk olarak Build 2026 etkinliğinde gösterilen MAI modelleri artık milyonlarca kullanıcıya hizmet veren Microsoft ürünlerinde üretim ortamında çalışıyor.Yeni modellerden MAI-Image-2.5-Pro, Microsoft’un şimdiye kadar geliştirdiği en yüksek görsel doğruluğa sahip görüntü modeli olarak kullanıma açıldı. Model doğal dil komutlarından görsel oluşturabiliyor, mevcut görüntüleri düzenleyebiliyor, görüntü içindeki yazıları oluşturabiliyor ve belirli nesneler üzerinde kontrollü değişiklikler yapabiliyor. Hareket bulanıklığını temizleme, düzeni değiştirme, metni güncelleme ve farklı düzenleme aşamalarında görsel tutarlılığı koruma özellikleri de modelin yetenekleri arasında bulunuyor.MAI-Image-2.5-Pro; nesnelerin birden fazla görüntüde aynı biçimde korunması, yaratıcı komutların daha doğru yorumlanması, görsel muhakeme ve dünya bilgisi tarafında standart MAI-Image-2.5 modelinden ayrılıyor. Model reklam kampanyaları, ürün fotoğrafları, e-ticaret katalogları, film ve oyun taslakları, çok kareli hikâye anlatımları ve kurumsal görsel üretim süreçlerinde kullanılabiliyor. Sağlık, finans ve üretim gibi gerçek dünyaya uygun görsellerin gerekli olduğu sektörler de destekleniyor.MAI-Image-2.5-Pro, Microsoft Foundry üzerinden public preview olarak sunuluyor. Modelin fiyatı bir milyon metin giriş tokenı için 5 dolar, bir milyon görüntü giriş tokenı için 8 dolar ve bir milyon görüntü çıkış tokenı için 106 dolar olarak açıklandı.Microsoft’un ikinci yeni modeli MAI-Voice-2-Flash, düşük gecikmeli metinden konuşmaya dönüştürme işlemleri için geliştirildi. Model, MAI-Voice-2’nin doğal konuşma ritmini, tonlamasını ve ses kalitesini korurken iki kat daha hızlı çalışıyor. Kullanım maliyeti MAI-Voice-2’den yüzde 32 daha düşük olan model, bir milyon karakter başına 15 dolarlık fiyatla public preview kapsamında sunuluyor.MAI-Voice-2-Flash; 15 dil ve 18 bölgesel dil seçeneğini destekliyor. Model konuşma sırasında duygu, ton ve anlatım biçiminin SSML üzerinden değiştirilmesine izin veriyor. Sevinç, heyecan ve empati gibi farklı konuşma stilleri kullanılabiliyor. Kısa bir referans ses kaydından ses kopyalama özelliği de bulunuyor ancak bu özelliğe erişim için Microsoft’un sınırlı erişim incelemesinden geçilmesi ve ses sahibinin onayının alınması gerekiyor. Türkçe desteğinde Aydın ve Elif adlı iki hazır ses yer alıyor.Model; yapay zekâ destekli çağrı merkezi temsilcileri, sesli asistanlar, canlı konuşma uygulamaları ve etkileşimli sesli yanıt sistemlerinde kullanılabiliyor. Azure Speech SDK ve SSML üzerinden uygulamalara eklenebilen MAI-Voice-2-Flash, Azure Voice Live ile de çalışıyor. Voice Live entegrasyonu, konuşmayı algılayan ve sesli yanıt veren gerçek zamanlı yapay zekâ ajanlarının geliştirilmesine izin veriyor.Microsoft’un önceki MAI-Image-2.5 modeli, Bing Image Creator’ın tüm görsel oluşturma ve düzenleme altyapısını devraldı. Bing Image Creator artık görüntü işlemlerinde tamamen Microsoft’un kendi modellerini kullanıyor. Kullanıcıların verdiği metin komutlarından görsel oluşturulması ve mevcut görüntülerde kontrollü düzenleme yapılması aynı model üzerinden yürütülüyor.PowerPoint’ın görselden görsele düzenleme özelliklerinde de MAI-Image-2.5 kullanılmaya başlandı. Model, aynı işlemlerde kullanılan OpenAI GPT-Image-2’ye kıyasla GPU maliyetini yüzde 84’e kadar düşürdü. Microsoft, üretim ortamına alınacak modelleri görüntü kalitesi, gecikme ve hesaplama verimliliği testlerinden geçiriyor.OneDrive’daki temel görsel düzenleme özelliklerinin varsayılan modeli de MAI-Image-2.5 oldu. Yeni modelin kullanıma alınmasının ardından düzenlenen görüntülerin kaydedilme oranı yüzde 26 arttı. P95 gecikme süresi yaklaşık yüzde 25 azalırken orta düzey kullanım yoğunluğundaki üretim iş yüklerinde 2,5 kat daha yüksek verimlilik kaydedildi.MAI-Voice-2-Flash ise Dynamics 365 Contact Center’ın ses altyapısında kullanılmaya başlandı. T-Mobile ve easyJet gibi şirketlerin kullandığı çağrı merkezi platformunda konuşma üretimini üstlenen model, GPU maliyetini yüzde 89’a kadar düşürdü. Çağrı merkezi konuşmaları düşük gecikmeyle oluşturulurken farklı markalar kendi ses ve anlatım biçimlerini sisteme ekleyebiliyor.Microsoft, MAI modellerini sağlık hizmetlerinde de kullanıyor. Dünya genelinde 170 bin sağlık çalışanı tarafından kullanılan Dragon Copilot, bir önceki çeyrekte 28 milyon hasta görüşmesini işledi. MAI-Transcribe-1.5, Dragon Copilot’ın çok dilli konuşma yazıya çevirme iş akışında önceki modelin yerini aldı ve 58 dili desteklemeye başladı.Şirket içi testlerde MAI-Transcribe-1.5, dillerin büyük bölümünde konuşmayı yazıya çevirme ve konuşulan dili tespit etme hata oranlarını göreceli olarak yüzde 50 azalttı. İlk araştırma sonuçlarında, oluşturulan tıbbi notların doğruluğunda da artış kaydedildi.Microsoft’un yeni MAI modelleri, şirketin OpenAI tarafından geliştirilen modelleri tamamen bırakması anlamına gelmiyor. Microsoft ürünlerinde iş yüküne bağlı olarak farklı yapay zekâ modelleri kullanılmaya devam ediyor. Görsel üretme, konuşma oluşturma, kodlama, muhakeme ve transkripsiyon gibi belirli görevlerde ise şirket bünyesinde geliştirilen modellerin payı artıyor.

Reklam

Etiketler

#haber#teknoloji#yapay zeka#microsoft#yapay zeka

Paylaş

K

Bu haber bağımsız gazetecilik ilkeleri çerçevesinde hazırlanmıştır. Hata veya eksiklik için düzeltme talep edin.

Reklam