Teknoloji

GPT-4 güvenilirliği ve zafiyetleriyle ilgili araştırmadan ilginç sonuçlar

GPT-4 güvenilirliği ve zafiyetleriyle ilgili araştırmadan ilginç sonuçlar
Haberleri Kaçırma! Teknoblog'u Google Arama'da tercihli kaynağın yap ve En Çok Okunan Haberler'de bizi daha sık gör.
Tercihli Kaynak Ekle

OpenAI’nin son dili modeli GPT-4, selefi GPT-3.5’e kıyasla güvenilirlik açısından daha başarılı bir profil çiziyor. Ancak, Microsoft tarafından desteklenen bir araştırmaya göre, bu modelin “jailbreak” edilmesi, yani kısıtlamalarının aşılması daha kolay, üstelik bu model önyargıya daha açık. GPT-4’ün güvenilirlik, zararlılık (toxicity), stereotipler (bilimsel bir yanıtı olmayan yargılar), gizlilik, makine etiği, adillik ve düşmanca testlere direnç gibi kategorilerde nasıl performans gösterdiğine dair ilginç sonuçlar var.

Microsoft Research, Illinois Urbana-Champaign Üniversitesi, Stanford Üniversitesi, California Üniversitesi, Berkeley, ve AI Güvenliği Merkezi’nden araştırmacılar, GPT-4’ün genel olarak özel bilgileri koruma, önyargılı bilgiler gibi toksik sonuçlardan kaçınma ve düşmanca saldırılara direnme konusunda daha iyi olduğunu ortaya koyuyor. Bununla birlikte, GPT-4’ün güvenlik önlemlerini görmezden gelmesi ve kişisel bilgileri sızdırması söz konusu olduğunda, kullanıcıların modelin etrafındaki güvenlik önlemlerini atlayabileceklerini belirtiyorlar.

[irp]

Araştırmacılar, GPT-4’ün yanıltıcı bilgileri daha kesin bir şekilde takip ettiğini ve karmaşık talepleri harfi harfine takip etme olasılığının daha yüksek olduğunu belirtiyor. Bu durum, modelin güvenlik önlemlerini görmezden gelmesi ve kişisel bilgileri sızdırması riskini artırıyor.

GPT-4 ve GPT-3.5, zararlılık ve stereotipler açısından standart taleplerle test edildi. Araştırmacılar, modellerin içerik politikası kısıtlamalarını kırmak için tasarlanmış taleplerle ve sonunda modelleri tamamen korumaları görmezden gelmeye çalışarak zorlayarak test ettiler.

GPT-4’ün gizlilik ve makine etiği konularında, GPT-3.5’e göre daha yüksek puan aldığı görülüyor. Ancak, araştırmacılar, GPT-4’ün güvenlik önlemlerini atlamak ve kişisel bilgileri sızdırmak konusunda yanıltıcı ve karmaşık taleplere daha yatkın olduğunu belirtiyorlar.

Günün Öne Çıkan Fırsatları

7.000 mAh pilli OPPO Reno16 F 5.747 TL indirimle 36.252 TL
7.000 mAh pilli OPPO Reno16 F 5.747 TL indirimle 36.252 TL
Satın Al
Galaxy Watch8 40 mm yüzde 29 indirimle 10.199 TL
Galaxy Watch8 40 mm yüzde 29 indirimle 10.199 TL
Satın Al
Dahili USB-C kablolu Anker powerbank 450 TL indirimle 1.999 TL
Dahili USB-C kablolu Anker powerbank 450 TL indirimle 1.999 TL
Satın Al
2 TB MSI Spatium M461 SSD yüzde 41 indirimle 11.999 TL
2 TB MSI Spatium M461 SSD yüzde 41 indirimle 11.999 TL
Satın Al
Dolby Atmos’lu Grundig DSB 3000 sepette 10.885,80 TL
Dolby Atmos’lu Grundig DSB 3000 sepette 10.885,80 TL
Satın Al
Tümünü Gör Daralt
Tüm Fırsatları Gör

REKLAM — Bu içerikte satış ortaklığı bağlantıları bulunmaktadır. Bu bağlantılar üzerinden yapılan alışverişlerden Teknoblog komisyon kazanabilir.

Yakın zamanda Federal Ticaret Komisyonu (FTC), GPT-4’ün yanlış bilgi yayma potansiyeli nedeniyle OpenAI’ı incelemeye aldı. GPT-4’ün hâlâ eksik ve sınırlı olduğunu belirten OpenAI CEO’su Sam Altman, bu modelin geliştirilmesi ve güvenilirliğinin artırılmasına yönelik çalışmaların devam ettiğini vurguluyor.

[irp]

GPT-4’ün güvenilirlik, zehirlilik, stereotipler ve diğer önemli kategorilerde nasıl performans gösterdiği, AI teknolojisinin geleceği için kritik önem taşıyor. Microsoft ve diğer araştırma gruplarının bu konuda daha fazla çalışma yapması ve GPT-4’ün güvenilirliğini ve güvenliğini artırmak için stratejiler geliştirmesi bekleniyor.

Teknoblog artık WhatsApp'taGünün en iyi teknoloji fırsatları ve kaçırmamanız gereken büyük haberler, telefonunuza gelsin.
Kanala Katıl