Anthropic CEO’su Dario Amodei, yapay zeka modellerinin yetenek artışını güvenlik çalışmalarıyla dengelemek için üç aşamalı bir plan önerdi. İlk adımda Anthropic, bağımsız değerlendiricilere şirket çalışanlarının erişimine benzer sürekli erişim sağlamayı taahhüt ediyor, sonraki adımlar ise şirketler ve devletler arasında eşgüdüm gerektiriyor. Yapay zeka araçlarını işinizde kullanıyorsanız, bu çağrı yeni özelliklerin ne kadar hızlı geleceğinden önce geliştirme süreçlerini kimin ve nasıl denetleyeceği sorusunu öne çıkarıyor.
Amodei, gelişim hızına ilişkin planında bütün model eğitimlerini durdurmayı önermiyor. Güvenlik ve hizalama çalışmalarının yetenek artışına yetişebilmesi için daha ölçülü bir tempo istiyor. Gerekçeleri arasında yapay zekanın sonraki yapay zeka kuşaklarını geliştirmede artan rolü bulunuyor. Yönetici bu hızlanmanın denetim araçlarını geride bırakabileceğini savunuyor, bunu kaçınılmaz bir sonuç olarak ilan etmiyor.
İlk aşama, şirket içine yerleşen bağımsız değerlendiricileri kapsıyor. Bu ekipler yalnızca tamamlanmış bir modelin son testine bakmayacak. Eğitim süreçlerini, güvenlik uygulamalarını ve olay bildirimlerini sürekli izleyebilecek. Anthropic, önemli bulguların yayımlanmasında şirketin editoryal kontrol kurmamasını öngörüyor, ancak hukuki yükümlülükler ve hassas bilgiler için sınırlı istisnalar tanımlıyor.
İLGİNİZİ ÇEKEBİLİR

Anthropic bilim insanlarının Claude ile tehlikeli araştırmalar yaptığını tespit etti

Claude Max’in 20x kullanım vaadi Anthropic’i mahkemelik etti

Claude kullanıcıları hesaplarını kullanmadan tokenlarının tükendiğini fark etti

Üç yıl OpenAI ve Anthropic’te çalıştı, şimdi yapay zekâ yarışı için uyarıyor

RubyGems, yapay zeka ajanlarının saldırısındaki bulguları açıkladı
İkinci aşamada demokratik ülkelerdeki öncü yapay zeka şirketlerinin ortak standartlar geliştirmesi amaçlanıyor. Üçüncü aşama ise daha geniş uluslararası iş birliğini hedefliyor. Planın eşgüdüm boyutu, bazı adımların şirketlerin tek başına vereceği kararlardan fazlasını gerektirdiğini ortaya koyuyor. Amodei, hükümet desteğinin ve uyumu doğrulayacak araçların bu süreçte gerekli olduğunu belirtiyor.
Bağımsız değerlendiriciler eğitim sürecini de inceleyecek
Çağrı, Pacing the Frontier girişimiyle daha geniş bir araştırmacı topluluğuna bağlanıyor. İmzacılar arasında OpenAI, Google DeepMind, Anthropic ve diğer kuruluşlarda çalışan isimler yer alıyor. Girişim, otomatik yapay zeka araştırmasının hızlanması karşısında teknik ve yönetişim araçları geliştirilmesini istiyor. Bununla birlikte kişisel yorumların her zaman çalışanın şirketinin görüşünü temsil etmediğini açıkça belirtiyor.
Günün Öne Çıkan Fırsatları

REKLAM — Bu içerikte satış ortaklığı bağlantıları bulunmaktadır. Bu bağlantılar üzerinden yapılan alışverişlerden Teknoblog komisyon kazanabilir.
Anthropic’in siber güvenlik değerlendirmelerindeki olay incelemesi, bu tartışmaya somut bir arka plan sağlıyor. Şirket, yanlış yapılandırılan test ortamlarının canlı internete erişim bıraktığını ve üç ayrı olay tespit ettiğini açıklıyor. Modeller bazı gerçek sistemleri değerlendirme ortamının parçası sanmıştı. Şirket, test altyapısının müşteri verilerinden ve hassas iç sistemlerden ayrı olduğunu da belirtiyor.
Bu olaylar, yalnızca modele verilen talimatların değil, çevresindeki teknik sınırların da önemini gösteriyor. Amodei’nin önerisi denetimi geliştirme sürecinin içine taşımayı amaçlıyor. Ancak sektörün tamamının aynı kurallara katılması henüz gerçekleşmiş bir durum oluşturmuyor. Kullanıcılar açısından takip edilecek somut adım, bağımsız ekiplerin hangi erişimi aldığı ve güvenlik bulgularını ne ölçüde kamuya açabildiği olacak.





