Microsoft CEO’su Satya Nadella, gelişmiş yapay zeka sistemlerinin görev sırasında durdurulabileceği bağımsız denetimler kurulmasını istedi. 10 Ekim’de yayımladığı değerlendirmede, modelin yetenekleri ile sahip olduğu yetkileri ayrı ele alıyor. Bu yaklaşım, özellikle şirket verilerine erişip kullanıcı adına işlem yapan yapay zeka temsilcilerini ilgilendiriyor.
Nadella, kendi X hesabındaki makalede modelleri kurum içinden kaynaklanabilecek risklerle birlikte değerlendirmeyi öneriyor. Bunun nedeni, modellerin mutlaka kötü niyetli olması değil. Önemli sistemlere erişen güçlü bir unsur, hata yapabilir veya saldırıdan etkilenebilir. Bu nedenle güvenlik tasarımının yalnızca model sağlayıcısının verdiği güvencelere dayanmaması gerektiğini savunuyor.
Önerinin merkezinde, modelin erişebileceği verileri ve gerçekleştirebileceği işlemleri dışarıdan sınırlamak var. Nadella, yetkili bir kişinin modeli görev ortasında duraklatabilmesini veya kapatabilmesini istiyor. Acil fren benzetmesi de bu noktaya karşılık geliyor. Dolayısıyla söz konusu açıklama, Microsoft’un bugün kullanıma sunduğu yeni bir ürünün duyurusu niteliğini taşımıyor.
Makale, bağımsız denetimle birlikte gözlemlenebilir kayıtları da öne çıkarıyor. Anlamlı işlemlerin, insanların okuyabileceği ve sonradan değiştirilemeyecek kanıtlar bırakması gerektiğini belirtiyor. Ayrıca aynı modelin hem işi yapmasını hem de kendi sonucunu doğrulamasını yeterli bulmuyor. Böylece denetimin, değerlendirdiği sistemden ayrı kalmasını amaçlıyor.
İLGİNİZİ ÇEKEBİLİR

Microsoft Decision-1, hazır seçenekler arasında yapay zeka kararlarını puanlıyor

Nikon, yapay zeka kuralı nedeniyle Small World video birincisini değiştirdi

Yapay zeka şarkılarını botlara dinleten Michael Smith 18 ay hapis cezası aldı

Qualcomm CEO’su, 2028 telefonları için 100 milyar parametre talebini açıkladı
Google’ın AMIE araştırması The Lancet’te yayımlandı, doktor denetiminde 98 hastayla sınandı
Nadella, yapay zeka yetkisini modelden ayrı tutmak istiyor
Bu yaklaşımın günlük iş akışındaki karşılığını bir örnekle açıklayabiliriz. Bir temsilci, belgeyi inceleyip değişiklik önerdiğinde yaptığı işlem ile dosyayı dışarıya gönderme yetkisi aynı şey değildir. Kurum, bu iki adımı ayrı izinlere bağlayabilir. Bu örnek, Nadella’nın yeni bir özelliğini tarif etmiyor, önerdiği yetki ayrımının neden anlam taşıdığını gösteriyor.
Günün Öne Çıkan Fırsatları





REKLAM — Bu içerikte satış ortaklığı bağlantıları bulunmaktadır. Bu bağlantılar üzerinden yapılan alışverişlerden Teknoblog komisyon kazanabilir.
Öte yandan model içine yazılan davranış kurallarıyla sistem çevresine kurulan erişim sınırları farklı araçlar. İlki, modelin nasıl yanıt vermesini istediğinizi anlatır. İkincisi, modelin gerçekten hangi işlemlere ulaşabileceğini belirler. Bir temsilcinin yanlış bir yanıt üretmesi ile hassas bir dosyada işlem yapabilmesi arasındaki fark da burada ortaya çıkar.
Güvenliğin sürekli bakım gerektirdiğini NIST’in haziran tarihli açıklaması da ayrı bir araştırma çerçevesinde ele alıyor. Kurum, sabit bir davranış kuralı setinin uyarlanan saldırı komutlarına karşı evrensel dayanıklılık sağlamadığını aktarıyor. Bunun yanı sıra sürekli saldırı testleri, yeni açıklar için güncellemeler ve bir olay yaşandığında etkisini sınırlayacak hazırlık öneriyor.
NIST’in açıklaması, Nadella’nın önerilerini tek tek sınayan bir çalışma değil. Ancak iki kaynak da güvenlik işini ilk kurulumla tamamlanmış saymayan bir yaklaşım sunuyor. Şirketler açısından asıl soru, modelin ne kadar etkileyici yanıt verdiğinin yanında hangi verilere ve işlemlere eriştiği oluyor. Nadella’nın son değerlendirmesi de bu erişimi görünür ve durdurulabilir tutma gereğini gündeme taşıyor.


