Microsoft, yazılımın doğrudan işleyebileceği yapılandırılmış kararlar üreten Microsoft-Decision-1 modelini 9 Ekim’de Microsoft Foundry ve OpenRouter üzerinden kullanıma açtı. Şirketin duyurusuna göre model, metin üretmek yerine önceden belirlenen her yanıt seçeneği için kalibre edilmiş bir olasılık döndürüyor.

Modelin temelinde başka bir şirketin teknolojisi var. Microsoft, Microsoft-Decision-1’i Alibaba Cloud’un geliştirdiği açık ağırlıklı Qwen3.5-9B modeli üzerinde ek eğitimle oluşturduğunu yazdı. Duyuruya göre model yakında Microsoft AI (MAI) ve OpenAI modelleri dahil başka temellere taşınacak. Şirket bu geçişin gerekçesini ve takvimini paylaşmadı. Qwen tabanını kullanan tek şirket Microsoft değil: The Register’a göre H2O.ai’ın H2O-Lightning-4B karar modeli de aynı ailenin Qwen3.5-4B sürümüne dayanıyor.

Microsoft, modeli yönlendirme, sınıflandırma, önceliklendirme, doğrulama ve iş akışı kontrolü için tasarladığını belirtiyor. Model, yapay zekâ yanıtlarını ve ajan eylemlerini bir değerlendirme ölçütüne göre puanlayabiliyor. Uygulamalar, döndürülen olasılığa bakarak bir işlemi yürütmeye, ertelemeye ya da insan onayına göndermeye karar verebiliyor.

Karar modelleri, TypeSafe AI’ın 15 Eylül’de Jev modelini erken erişime açmasından sonra öne çıkan bir kategori. Bu modeller evet/hayır, çoktan seçmeli ve puanlama sorularını serbest metin yerine olasılıklı yanıtlarla çözüyor. Andreessen Horowitz 9 Ekim’de TypeSafe’e yapılan yatırıma liderlik ettiğini duyurdu. Microsoft’un duyurusunu ilk aktaran The Register’a göre OpenAI, Cloudflare, Liquid AI ve Perplexity de benzer ürünler tanıttı; alandaki model sayısı 100’ü aştı.

Microsoft’un kendi ölçümlerine göre model, 36 kıyaslama testinde ve yaklaşık 147 bin soruda yüzde 83,5 ortalama doğrulukla ilk sırada yer aldı. Aynı testlerde Jev 1.13.0 yüzde 82,3’te kaldı. Şirketin paylaştığı gecikme verisinde Microsoft-Decision-1 bir karar için ortalama 85 milisaniyeye ihtiyaç duyarken Jev’de bu süre 240 milisaniye. Microsoft, modelin OpenAI’ın GPT-6 Sol modelinden yaklaşık 35 kat hızlı olduğunu da söylüyor.

Kalibrasyon testinde ise Jev öne geçiyor. Olasılık tahminlerinin isabetini ölçen bu testte Microsoft-Decision-1 yüzde 92,2 aldı. Jev yüzde 93,7 ve Quyet-1.0-Large yüzde 93,1 ile önde. Microsoft, duyuruyu ilk yayımlamasından sonra güncelleyerek Jev’in doğruluk ve kalibrasyon sonuçlarını tabloya ekledi. Kıyaslamalar bağımsız bir kuruluş tarafından tekrarlanmadı.

Modelin fiyatı milyon girdi token’ı başına 0,042 dolar. Çıktı token’ları ücretsiz. Microsoft, Xbox araştırma ekibinin modeli 10 binden fazla oyuncu yorumunu temalara ayırmak için kullandığını aktardı. Şirkete göre ekip, GPT-6 Sol’a yakın kalite elde etti; iş 14 kat hızlı, 200 kat ucuza tamamlandı.

Microsoft Teknoloji Ofisi’nde yazılım mühendisliğinden sorumlu başkan yardımcısı Achint Srivastava, duyuruda maliyetin yapay zekâ kullanım kararlarında büyük rol oynadığını yazdı. Srivastava’ya göre doğru iş için doğru modeli seçmek giderek daha önemli hale geliyor.

Rapor: Microsoft Command Line, “Introducing Microsoft-Decision-1, our model for fast decision-making” (9 Ekim 2026)

Share.
Exit mobile version