Teknoloji

GPT-4 güvenilirliği ve zafiyetleriyle ilgili araştırmadan ilginç sonuçlar

GPT-4 güvenilirliği ve zafiyetleriyle ilgili araştırmadan ilginç sonuçlar
Haberleri Kaçırma! Teknoblog'u Google Arama'da tercihli kaynağın yap ve En Çok Okunan Haberler'de bizi daha sık gör.
Tercihli Kaynak Ekle

OpenAI’nin son dili modeli GPT-4, selefi GPT-3.5’e kıyasla güvenilirlik açısından daha başarılı bir profil çiziyor. Ancak, Microsoft tarafından desteklenen bir araştırmaya göre, bu modelin “jailbreak” edilmesi, yani kısıtlamalarının aşılması daha kolay, üstelik bu model önyargıya daha açık. GPT-4’ün güvenilirlik, zararlılık (toxicity), stereotipler (bilimsel bir yanıtı olmayan yargılar), gizlilik, makine etiği, adillik ve düşmanca testlere direnç gibi kategorilerde nasıl performans gösterdiğine dair ilginç sonuçlar var.

Microsoft Research, Illinois Urbana-Champaign Üniversitesi, Stanford Üniversitesi, California Üniversitesi, Berkeley, ve AI Güvenliği Merkezi’nden araştırmacılar, GPT-4’ün genel olarak özel bilgileri koruma, önyargılı bilgiler gibi toksik sonuçlardan kaçınma ve düşmanca saldırılara direnme konusunda daha iyi olduğunu ortaya koyuyor. Bununla birlikte, GPT-4’ün güvenlik önlemlerini görmezden gelmesi ve kişisel bilgileri sızdırması söz konusu olduğunda, kullanıcıların modelin etrafındaki güvenlik önlemlerini atlayabileceklerini belirtiyorlar.

[irp]

Araştırmacılar, GPT-4’ün yanıltıcı bilgileri daha kesin bir şekilde takip ettiğini ve karmaşık talepleri harfi harfine takip etme olasılığının daha yüksek olduğunu belirtiyor. Bu durum, modelin güvenlik önlemlerini görmezden gelmesi ve kişisel bilgileri sızdırması riskini artırıyor.

GPT-4 ve GPT-3.5, zararlılık ve stereotipler açısından standart taleplerle test edildi. Araştırmacılar, modellerin içerik politikası kısıtlamalarını kırmak için tasarlanmış taleplerle ve sonunda modelleri tamamen korumaları görmezden gelmeye çalışarak zorlayarak test ettiler.

GPT-4’ün gizlilik ve makine etiği konularında, GPT-3.5’e göre daha yüksek puan aldığı görülüyor. Ancak, araştırmacılar, GPT-4’ün güvenlik önlemlerini atlamak ve kişisel bilgileri sızdırmak konusunda yanıltıcı ve karmaşık taleplere daha yatkın olduğunu belirtiyorlar.

Günün Öne Çıkan Fırsatları

Huawei Pura 90s Pro, 4.000 TL indirim ve FreeBuds Pro 5 hediyesiyle 75.999 TL
Huawei Pura 90s Pro, 4.000 TL indirim ve FreeBuds Pro 5 hediyesiyle 75.999 TL
Satın Al
Yapay zekâ işlemcili Lenovo IdeaPad 5 2-in-1 sepette 49.400,19 TL
Yapay zekâ işlemcili Lenovo IdeaPad 5 2-in-1 sepette 49.400,19 TL
Satın Al
JBL PartyBox Club 120’de sepette 2.444,33 TL indirim
JBL PartyBox Club 120’de sepette 2.444,33 TL indirim
Satın Al
43 inç Android TV arayanlara Next YE-43GFSG4 sepette 13.599 TL
43 inç Android TV arayanlara Next YE-43GFSG4 sepette 13.599 TL
Satın Al
Dreame D30 Ultra robot süpürgede 2.000 TL indirim
Dreame D30 Ultra robot süpürgede 2.000 TL indirim
Satın Al
Tümünü Gör Daralt
Tüm Fırsatları Gör

REKLAM — Bu içerikte satış ortaklığı bağlantıları bulunmaktadır. Bu bağlantılar üzerinden yapılan alışverişlerden Teknoblog komisyon kazanabilir.

Yakın zamanda Federal Ticaret Komisyonu (FTC), GPT-4’ün yanlış bilgi yayma potansiyeli nedeniyle OpenAI’ı incelemeye aldı. GPT-4’ün hâlâ eksik ve sınırlı olduğunu belirten OpenAI CEO’su Sam Altman, bu modelin geliştirilmesi ve güvenilirliğinin artırılmasına yönelik çalışmaların devam ettiğini vurguluyor.

[irp]

GPT-4’ün güvenilirlik, zehirlilik, stereotipler ve diğer önemli kategorilerde nasıl performans gösterdiği, AI teknolojisinin geleceği için kritik önem taşıyor. Microsoft ve diğer araştırma gruplarının bu konuda daha fazla çalışma yapması ve GPT-4’ün güvenilirliğini ve güvenliğini artırmak için stratejiler geliştirmesi bekleniyor.

Teknoblog artık WhatsApp'taGünün en iyi teknoloji fırsatları ve kaçırmamanız gereken büyük haberler, telefonunuza gelsin.
Kanala Katıl