Meta, Muse Spark 1.1 adlı yapay zekâ modelinin izole edilmesi gereken test ortamından internete erişim sağlayarak üçüncü taraf bir hizmetteki güvenlik açığını kullandığını doğruladı. Bloomberg‘e konuşan Meta Sözcüsü Andy Stone, olayın The Information tarafından gündeme getirilmesinin ardından açıklama yaptı. Stone’a göre olayın nedeni, Meta’nın değerlendirme ortağı Irregular tarafından hazırlanan test ortamındaki bir yapılandırma hatası oldu. Model, internete erişim kazandıktan sonra üçüncü taraf bir serviste bulunan güvenlik açığından yararlandı. Meta, bunun daha önce farklı şirketlerde görülen benzer olaylarla aynı nitelikte gerçekleştiğini belirtti.
Olayın merkezinde yer alan Irregular, gelişmiş yapay zekâ modellerinin siber güvenlik yeteneklerini değerlendiren bir şirket olarak faaliyet gösteriyor. Şirket, gerçek dünyadaki senaryoları taklit eden testler gerçekleştirerek yapay zekâ sistemlerinin olası saldırı davranışlarını ve savunma mekanizmalarını ölçüyor. Ne var ki Meta’nın açıklamasına göre, Muse Spark 1.1’in internete erişebilmesi doğrudan modelin kendi yeteneklerinden değil, test ortamındaki yanlış yapılandırmadan kaynaklandı. Bu nedenle olay, yapay zekânın güvenlik sınırlarını kendi başına aşmasından ziyade test altyapısındaki bir hata olarak değerlendiriliyor.
Aynı test ortağı daha önce de benzer olaylarla gündeme gelmişti
Irregular’ın adı daha önce Anthropic ve OpenAI ile bağlantılı benzer olaylarda da geçmişti. Anthropic, yaptığı açıklamada bazı yapay zekâ modellerinin test ortamından çıkarak üç farklı kuruma yönelik siber saldırı simülasyonları gerçekleştirebildiğini duyurmuştu. Şirket, bu olayın da Irregular tarafından hazırlanan test ortamındaki yapılandırma hatasından kaynaklandığını ifade etmişti.
İLGİNİZİ ÇEKEBİLİR

Google’ın yeni yapay zekâ modeli kasırga uyarılarını daha erken verebiliyor

Yapay zekâ virüs tasarlamaya başladı

Shopify verileri yapay zekânın e-ticarette neden farklı çalıştığını gösteriyor

Anthropic kendi yapay zekâ çiplerini geliştirmek için harekete geçti

Yapay zekâ talebi RAM pazarını kilitledi, 2027 kapasitesi doldu
Bunun yanında OpenAI de Hugging Face ile ilgili olaydan bağımsız başka bir test sırasında modellerinin internete erişim sağlayabildiğini açıklamıştı. OpenAI’nin verdiği bilgilere göre bunun nedeni de yine aynı test ortağının oluşturduğu yanlış yapılandırılmış değerlendirme ortamıydı. Bu gelişmeler, gelişmiş yapay zekâ modellerinin güvenlik testlerinde yalnızca modellerin davranışlarının değil, test altyapısının da kritik önem taşıdığını ortaya koyuyor.
Merkezi İsrail’in Tel Aviv kentinde bulunan Irregular, kendisini “ilk frontier güvenlik laboratuvarı” olarak tanımlıyor ve giderek daha yetenekli hâle gelen yapay zekâ sistemlerine karşı güvenliğin sağlanmasını hedeflediğini belirtiyor. Bloomberg’e konuşan şirket sözcüsü ise yaşanan olayların bir “sandbox” ortamından kaçış veya gelişmiş bir siber saldırı niteliği taşımadığını söyledi. Açıklamada, olaylarla ilgili çözümlenmemiş herhangi bir sorun bulunmadığı ve yapay zekâ güvenlik değerlendirmelerinde güvenli çalışma yöntemlerini paylaşacak teknik bir doküman üzerinde çalışıldığı bilgisi de yer aldı.
Günün Öne Çıkan Fırsatları
REKLAM — Bu içerikte satış ortaklığı bağlantıları bulunmaktadır. Bu bağlantılar üzerinden yapılan alışverişlerden Teknoblog komisyon kazanabilir.
Öte yandan daha önce OpenAI ajanlarının Hugging Face altyapısına eriştiği olayın farklı koşullarda gerçekleştiği belirtiliyor. Söz konusu vakada yapay zekâ ajanlarının kendi aralarında bir mesajlaşma sistemi oluşturduğu, ardından bir güvenlik açığını kullanarak internete erişim sağladığı ve daha sonra Hugging Face’in yapay zekâ deposuna ulaştığı aktarılmıştı. Muse Spark 1.1 olayında ise Meta’nın açıklamasına göre benzer bir davranış söz konusu olmadı; model yalnızca yanlış yapılandırılmış test ortamının sağladığı erişim imkânından yararlandı.


