ManşetlerTeknoloji

Claude konuştuğunuz dile göre karakter değiştiriyor

Claude konuştuğunuz dile göre karakter değiştiriyor
Haberleri Kaçırma! Teknoblog'u Google Arama'da tercihli kaynağın yap ve En Çok Okunan Haberler'de bizi daha sık gör.
Tercihli Kaynak Ekle

Anthropic, Claude’un kullanıcılarla konuşurken sergilediği değerlerin model sürümüne ve kullanılan dile göre değiştiğini ortaya koyan yeni araştırmasını 13 Temmuz’da yayımladı. Şirketin araştırmacıları, Claude.ai üzerinde gerçekleşen 309.815 anonimleştirilmiş konuşmayı Sonnet 4.6, Opus 4.6 ve Opus 4.7 modelleri üzerinden inceledi. Sonuçlar, Claude’un Arapçada daha uyumlu ve kısa, İngilizcede ise daha temkinli ve ayrıntılı yanıtlar verdiğini gösteriyor. Bu farklar yalnızca konuşma tonunu değil, modelin hangi davranış biçimine öncelik verdiğini de etkiliyor.

Araştırma ekibi, başkenti sormak gibi tek bir doğru cevabı bulunan görevler yerine tavsiye verme, geri bildirim hazırlama ve kişisel kararları değerlendirme gibi öznel konuşmalara odaklandı. Anthropic, daha önce belirlediği 3.307 değeri önce 339 üst kategori altında topladı, ardından bu değerleri dört temel davranış eksenine indirgedi. Bu eksenler itaat ile tedbir, sıcaklık ile titizlik, derinlik ile kısalık ve açık sözlülük ile uygulamaya odaklanma arasındaki tercihleri ölçüyor. Araştırmacılar, dört eksenin Claude’un ifade ettiği değerlerdeki toplam değişimin yaklaşık yüzde 15’ini açıkladığını belirtiyor.

Dil karşılaştırmasında Claude, Arapçada en yüksek itaat ve kısalık, İngilizcede ise en yüksek tedbir ve derinlik eğilimini gösterdi. Model, Hintçe ve Arapçada daha nazik, esprili ve destekleyici bir dil kullanırken İngilizce ve Rusçada varsayımları daha sık sorguladı, ayrıntıları düzeltti ve kullanıcıdan kanıt istedi. Hollandaca konuşmalarda belirsizliklerini ve hatalarını daha açık biçimde dile getiren Claude, Endonezcede bu açıklık yerine verilen işi tamamlamaya ağırlık verdi. Anthropic, dil kaynaklı en büyük değişimin sıcaklık ile titizlik ve açık sözlülük ile uygulama eksenlerinde ortaya çıktığını söylüyor.

Model sürümleri de farklı davranış profilleri oluşturdu. Sonnet 4.6 sıcaklık, uyum ve kısa yanıtlar yönünde ilerlerken Opus 4.7 daha temkinli, ayrıntılı ve açık sözlü bir karakter sergiledi. Opus 4.6 ise titizliği korurken kullanıcının talebine daha doğrudan yaklaşmayı ve kısa yanıt vermeyi tercih etti. Anthropic, bu sonuçların kullanıcıların modeller hakkında paylaştığı genel izlenimlerle örtüştüğünü, ancak modellerin kendi başlarına değerlere sahip olduğunu göstermediğini özellikle vurguluyor.

Eğitim verisi dil davranışını değiştirebilir

Anthropic, diller arasındaki veri miktarı ve içerik dağılımının bu farklılıkların olası kaynaklarından birini oluşturduğunu düşünüyor. Bir dildeki eğitim metinleri daha resmi, daha hiyerarşik veya daha destekleyici bir iletişim tarzını ağırlıklı biçimde içerdiğinde model de benzer kalıpları yanıtlarına taşıyabilir. Bununla birlikte araştırmacılar, farkların ne kadarını eğitim verisinin, ne kadarını dilin kültürel kullanım biçiminin veya konuşma konularının oluşturduğunu henüz bilmiyor. Şirket, gelecekte belirli eğitim aşamalarını ve bağlamsal işaretleri inceleyerek bu davranışların kaynağını bulmayı hedefliyor.

Günün Öne Çıkan Fırsatları

7.000 mAh pilli OPPO Reno16 F 5.747 TL indirimle 36.252 TL
7.000 mAh pilli OPPO Reno16 F 5.747 TL indirimle 36.252 TL
Satın Al
Galaxy Watch8 40 mm yüzde 29 indirimle 10.199 TL
Galaxy Watch8 40 mm yüzde 29 indirimle 10.199 TL
Satın Al
Dahili USB-C kablolu Anker powerbank 450 TL indirimle 1.999 TL
Dahili USB-C kablolu Anker powerbank 450 TL indirimle 1.999 TL
Satın Al
2 TB MSI Spatium M461 SSD yüzde 41 indirimle 11.999 TL
2 TB MSI Spatium M461 SSD yüzde 41 indirimle 11.999 TL
Satın Al
Dolby Atmos’lu Grundig DSB 3000 sepette 10.885,80 TL
Dolby Atmos’lu Grundig DSB 3000 sepette 10.885,80 TL
Satın Al
Tümünü Gör Daralt
Tüm Fırsatları Gör

REKLAM — Bu içerikte satış ortaklığı bağlantıları bulunmaktadır. Bu bağlantılar üzerinden yapılan alışverişlerden Teknoblog komisyon kazanabilir.

Araştırmanın yöntemi bazı sınırlamalar da taşıyor. Anthropic, kullanıcıların ifadelerini doğrudan yayımlamak yerine özel bilgileri ayıklayan bir analiz sistemi kullandı ve konuşmaları değer kategorilerine ayırırken Claude’dan da yararlandı. Bu yaklaşım yüz binlerce konuşmayı incelemeyi kolaylaştırıyor, ne var ki modelin kendi ilkelerine benzeyen davranışları daha kolay tanıması gibi ölçüm yanlılıkları yaratabilir. Şirket ayrıca çalışmanın farklı dillerde aynı ahlaki soruya verilen yanıtları karşılaştırmadığını, dolayısıyla sonuçların doğrudan ahlaki tutarsızlık kanıtı sunmadığını kabul ediyor.

Kullanıcı açısından baktığımızda aynı soruyu farklı dillerde sorduğunuzda yalnızca farklı bir anlatım biçimiyle değil, farklı seviyelerde tedbir, sıcaklık veya sorgulamayla karşılaşabilirsiniz. Bu durum özellikle sağlık, kariyer, finans ve ilişkiler gibi öznel karar alanlarında önem kazanıyor, çünkü yanıtın tonu kullanıcının tavsiyeyi nasıl değerlendirdiğini etkileyebilir. Anthropic şimdi bu farklılıkların kullanıcı güveni, karar kalitesi ve esenlik üzerindeki etkilerini ölçmek istiyor. Uzun lafın kısası, Claude tek bir sabit kişilik sunmuyor, konuştuğunuz dil modelin davranış profilini ölçülebilir biçimde değiştiriyor.

Teknoblog artık WhatsApp'taGünün en iyi teknoloji fırsatları ve kaçırmamanız gereken büyük haberler, telefonunuza gelsin.
Kanala Katıl