ManşetlerTeknoloji

Microsoft Decision-1, hazır seçenekler arasında yapay zeka kararlarını puanlıyor

Microsoft, seçeneklere olasılık puanı veren Decision-1 modelini Foundry ön izlemesine açtı ve milyon girdi tokenı için 0,042 dolar fiyat açıkladı.
Microsoft Decision-1, hazır seçenekler arasında yapay zeka kararlarını puanlıyor
Haberleri Kaçırma! Teknoblog'u Google Arama'da tercihli kaynağın yap ve En Çok Okunan Haberler'de bizi daha sık gör.
Tercihli Kaynak Ekle

Microsoft, uygulamaların önceden belirlenmiş seçenekler arasında karar vermesine yardımcı olan Microsoft-Decision-1 adlı yeni yapay zeka modelini duyurdu. Şirketin 9 Ekim tarihli açıklamasına göre model, her seçeneğe olasılık puanı vererek sınıflandırma ve yönlendirme görevlerini yerine getiriyor. Ayrıca Microsoft, bir milyon girdi tokenı için 0,042 dolar ücret istiyor ve çıktı tokenlarından ücret almıyor. Modeli Microsoft Foundry ve OpenRouter üzerinden kullanabilirsiniz.

Microsoft’un teknik duyurusu, modelin temelinde ek eğitimden geçen Qwen3.5-9B modelinin yer aldığını açıkça belirtiyor. Bunun yanı sıra ekip, ilerleyen sürümlerde Microsoft AI ve OpenAI modellerini de temel olarak kullanmayı planlıyor. Decision-1, evet veya hayır yanıtlarının yanında çoktan seçmeli soruları ve belirli ölçütlere göre değerlendirme görevlerini destekliyor.

Şirket, yaklaşık 150.000 soruyu kapsayan 36 karşılaştırma testinde modelin en yüksek doğruluk sonucuna ulaştığını bildiriyor. Aynı ölçümlerde Decision-1, H2O-Lightning-4B v1.1 modelinden 2,5 kat, GPT-6 Sol modelinden 35 kat hızlı yanıt verdi. Ancak bu rakamlar Microsoft’un kendi testlerini yansıtıyor ve tüm uygulamalar için aynı sonuçları garanti etmiyor. Bunun yanı sıra şirket, eşdeğer girdileri sekiz farklı biçimde değiştirdiğinde kararların ortalama yüzde 1,3 oranında farklılaştığını raporluyor.

Öte yandan Microsoft Foundry ekibinin duyurusu, erişimin herkese açık ön izleme aşamasında bulunduğunu özellikle belirtiyor. Geliştiriciler, model kataloğunda Decision-1’i seçerek kendi karar görevleriyle deneme yapabiliyor. Ayrıca örnek uygulama, destek taleplerini fatura, teknik sorun ve hesap erişimi gibi önceden tanımlanan kategorilere ayırıyor.

Geliştiriciler karar seçeneklerini uygulamalarına göre belirliyor

Bu örnekte uygulama, destek mesajını aldıktan sonra seçenekleri modele iletiyor ve her seçenek için güven puanı topluyor. Ardından geliştirici, ilgili ekibi ve talebin önceliğini bu puanlar üzerinden belirleyebiliyor. Bununla birlikte Foundry ekibi, uygulamanın seçenekleri ve sonraki adımları kendi ihtiyacına göre tanımladığını anlatıyor. Model bu adımlara ilişkin sınıflandırma sonucunu sağlıyor.

Günün Öne Çıkan Fırsatları

Baseus Energeek GR11: Dizüstü bilgisayarı da şarj eden powerbank sepette 3.823,20 TL
Baseus Energeek GR11: Dizüstü bilgisayarı da şarj eden powerbank sepette 3.823,20 TL
Satın Al
Apple Watch Series 9: Hücresel bağlantılı 41 mm model sepette 21.849,05 TL
Apple Watch Series 9: Hücresel bağlantılı 41 mm model sepette 21.849,05 TL
Satın Al
Havit H2039BG: Üç bağlantı seçenekli oyuncu kulaklığı 1.999 TL
Havit H2039BG: Üç bağlantı seçenekli oyuncu kulaklığı 1.999 TL
Satın Al
EZVIZ DP2C: Ekranlı görüntülü kapı dürbünü 5.999 TL
EZVIZ DP2C: Ekranlı görüntülü kapı dürbünü 5.999 TL
Satın Al
Huawei WiFi Mesh X1 Pro: Wi-Fi 7 ve dört 2,5 Gbps port 5.999 TL
Huawei WiFi Mesh X1 Pro: Wi-Fi 7 ve dört 2,5 Gbps port 5.999 TL
Satın Al
Tümünü Gör Daralt
Tüm Fırsatları Gör

REKLAM — Bu içerikte satış ortaklığı bağlantıları bulunmaktadır. Bu bağlantılar üzerinden yapılan alışverişlerden Teknoblog komisyon kazanabilir.

Duyuru, metin üretimiyle karar puanlamasını aynı iş akışında farklı modellere dağıtma seçeneğini de geliştiricilere sunuyor. Böylece bir model yanıt metnini hazırlarken Decision-1, yanıtı belirli ölçütlerle değerlendirerek sonraki işlemi seçmeye yardımcı oluyor. Ayrıca ekip, temsilî ve etiketli bir veri kümesiyle doğruluk, gecikme ve maliyet ölçümlerini birlikte yapmayı öneriyor.

Bununla birlikte Microsoft, belirsiz örnekleri ve yanlış kararların sonuçlarını değerlendirmeye özellikle test sürecinde yer verilmesini istiyor. Güven puanlarının anlamı, gerçek kullanım örnekleri üzerindeki doğru yanıtlarla karşılaştırma gerektiriyor. Ayrıca şirket, küçük ve sıralı bir denemenin üretim ortamındaki yoğunluğu veya ağ gecikmesini göstermediğini hatırlatıyor. Geliştiriciler bu nedenle karar modelini kendi uygulamalarındaki veri ve yükle sınayabiliyor.

Teknoblog artık WhatsApp'taGünün en iyi teknoloji fırsatları ve kaçırmamanız gereken büyük haberler, telefonunuza gelsin.
Kanala Katıl