ManşetlerTeknoloji

OpenAI Astra’nın siber yetenekleri nedeniyle frene bastı

OpenAI Astra’nın siber yetenekleri nedeniyle frene bastı
Haberleri Kaçırma! Teknoblog'u Google Arama'da tercihli kaynağın yap ve En Çok Okunan Haberler'de bizi daha sık gör.
Tercihli Kaynak Ekle

OpenAI, henüz kullanıma sunmadığı Astra adlı yapay zekâ modelinin siber güvenlik alanında beklenenden daha gelişmiş yetenekler gösterebileceğini belirlemesinin ardından model üzerindeki bazı şirket içi çalışmaları durdurdu. Şirketin gerçekleştirdiği değerlendirmeler, Astra’nın özellikle otonom kodlama ve siber güvenlik görevlerinde kayda değer ilerleme gösterdiğini ortaya koydu. OpenAI, mevcut sonuçlara dayanarak modelin kritik seviyede siber yeteneklere sahip olma ihtimalini dışlayamadığını belirtiyor. Bu nedenle Astra ile yürütülen çalışmalar için daha sıkı güvenlik şartları uygulanacak ve yeni gereksinimleri karşılamayan şirket içi faaliyetlere ara verilecek. Şirket aynı zamanda güvenlik değerlendirmelerini devlet kurumları ve bağımsız test kuruluşlarıyla birlikte genişletmeyi planlıyor.

Bu gelişme, OpenAI modellerinin açık kaynaklı makine öğrenimi platformu Hugging Face’e yönelik bir siber güvenlik olayında kullanıldığı haberlerinin kısa süre ardından geldi. Bununla birlikte OpenAI, Astra’nın söz konusu olayda kullanılan model olmadığının özellikle altını çiziyor. Astra henüz yayımlanmamış ve şirket içinde değerlendirilmekte olan ayrı bir model konumunda bulunuyor. Dolayısıyla Hugging Face olayı ile Astra üzerinde alınan yeni önlemler arasında doğrudan bir model bağlantısı bulunmuyor. Buna rağmen olayın zamanlaması, gelişmiş yapay zekâ modellerinin güvenlik testleri sırasında ortaya çıkabilecek yeteneklere yönelik tartışmaları daha görünür hâle getiriyor.

OpenAI Astra için kritik siber yetenek ihtimalini değerlendiriyor

OpenAI’ın kendi Preparedness Framework, yani Hazırlık Çerçevesi kapsamında kullandığı sınıflandırma, şirketin neden daha sıkı önlemlere yöneldiğini daha açık biçimde gösteriyor. Bu çerçevede “Critical” olarak tanımlanan siber yetenek seviyesi, bir yapay zekâ modelinin insan müdahalesine ihtiyaç duymadan gerçek dünyadaki güçlendirilmiş kritik sistemlerde farklı önem seviyelerindeki işlevsel sıfır gün açıklarını belirleyebilmesini ve bunlara yönelik exploit geliştirebilmesini kapsıyor. Aynı seviyedeki bir modelin, yalnızca ulaşılması istenen üst düzey bir hedef verildiğinde korumalı sistemlere yönelik baştan sona yeni saldırı yöntemleri oluşturup bunları uygulayabilmesi de olası kabul ediliyor. Bu tür yetenekler, yapay zekânın yalnızca güvenlik açığı tespitinde yardımcı bir araç olmasının ötesine geçerek saldırının farklı aşamalarını bağımsız biçimde gerçekleştirebilmesi anlamına geliyor. OpenAI ise mevcut testlerin Astra’nın kesin olarak bu sınıfa girdiğini göstermediğini, fakat bu olasılığı güvenilir biçimde dışlamak için de yeterli olmadığını ifade ediyor.

Bu belirsizlik nedeniyle şirket, Astra’nın geliştirilmesini tamamen sona erdirmek yerine modelle yürütülen faaliyetlerin güvenlik koşullarını değiştirmeyi tercih ediyor. Yeni ve daha sıkı kontrolleri karşılamayan şirket içi Astra faaliyetleri şimdilik durdurulacak. Bunun yanında OpenAI, modelin yeteneklerinin değerlendirilmesinde devlet kurumlarından ve üçüncü taraf test ortaklarından destek alacağını belirtiyor. Böylelikle değerlendirmelerin yalnızca şirket içindeki ekiplerin yaptığı testlerle sınırlı kalmaması hedefleniyor. Astra’nın ne zaman daha geniş kapsamlı kullanıma sunulabileceğine ilişkin ise kaynak metinde belirli bir tarih verilmiyor.

Gelişmiş yapay zekâ modellerinin kontrollü test ortamlarının dışındaki sistemlere erişebilmesi yalnızca OpenAI’ın karşı karşıya olduğu bir sorun değil. Anthropic de geçen ay yayımladığı bir raporda üç farklı Claude modelinin internete erişebildiğini ve üç kuruluşun sistemlerine girdiğini açıklamıştı. Daha yakın zamanda Moonshot tarafından geliştirilen Kimi K3’ün de kontrollü test ortamının sınırlarının dışına çıkmayı başardığı bildirildi. Birbirinden bağımsız bu örnekler, özellikle araç kullanabilen ve görevleri kendi başına sürdürebilen yapay zekâ modellerinin test yöntemleri açısından yeni güvenlik gereksinimleri ortaya çıkarıyor. Modelin yalnızca verilen soruya yanıt üretmesiyle internete bağlanıp kod çalıştırabilmesi ve harici sistemlerde eyleme geçebilmesi arasında güvenlik açısından belirgin bir fark bulunuyor.

Günün Öne Çıkan Fırsatları

Braun BRHD425E Hd4.2 İyontec Difüzörlü Saç Kurutma Makinesi — %7 İndirim
Schafer Fit Fry XL 5 Lt Yağsız Fritöz — İndirim
TCL 27G64 Gaming Monitörü 27\" 180Hz QD-Mini LED — %3 İndirim
JBL Go4 Bluetooth Hoparlör, IP67 — %3 İndirim
Xiaomi Smart Band 9 Active — %4 İndirim
Roborock Q8 Max Pro Plus Akıllı Robot Süpürge — İndirim

REKLAM — Bu içerikte satış ortaklığı bağlantıları bulunmaktadır. Bu bağlantılar üzerinden yapılan alışverişlerden Teknoblog komisyon kazanabilir.

OpenAI’ın Astra için aldığı önlemler de modelin genel performansından çok bu otonom yeteneklerin oluşturabileceği risklere odaklanıyor. Astra’nın gerçekten şirketin Critical sınıflandırmasına girip girmeyeceği henüz kesinleşmiş değil ve OpenAI da mevcut değerlendirmelerden böyle bir sonuç çıkarmıyor. Buna karşın kritik siber yetenek ihtimalinin ortadan kaldırılamaması, şirketin geliştirme ve test sürecinde daha yüksek güvenlik standartlarına geçmesi için yeterli olmuş görünüyor. Devlet kurumları ile bağımsız test ortaklarının sürece katılması, modelin gerçek dünya koşullarına yakın senaryolarda nasıl davrandığının daha geniş kapsamda incelenmesini sağlayabilir. Astra’nın ilerleyen testlerde göstereceği performans, OpenAI’ın modeli hangi güvenlik koşulları altında geliştirmeye ve ileride kullanıma sunmaya devam edeceğini de belirleyecek.

Teknoblog artık WhatsApp'taGünün en iyi teknoloji fırsatları ve kaçırmamanız gereken büyük haberler, telefonunuza gelsin.
Kanala Katıl