ManşetlerTeknoloji

Claude Sonnet 5.5 duyuruldu: Daha hızlı yanıt ve düşük görev maliyeti iddiası

Claude Sonnet 5.5 duyuruldu: Daha hızlı yanıt ve düşük görev maliyeti iddiası
Haberleri Kaçırma! Teknoblog'u Google Arama'da tercihli kaynağın yap ve En Çok Okunan Haberler'de bizi daha sık gör.
Tercihli Kaynak Ekle

Teknoblog'da geçen hafta Claude Opus 5.5'in duyurusunu aktarmıştık. Anthropic şimdi aynı ailenin günlük yazılım ve belge işleri için konumlandırdığı Claude Sonnet 5.5'i kullanıma sundu. Şirket, önceki Sonnet 5'e göre çıktı üretiminin yüzde 30'dan fazla hızlandığını ve birçok işte toplam maliyetin yüzde 30'a kadar düşebildiğini söylüyor. Buna karşılık API'nin liste fiyatı değişmedi; maliyet iddiası aynı işi daha az kaynakla bitirme hesabına dayanıyor.

Burada iki farklı fiyat ölçüsünü ayırmak gerekiyor. Sonnet 5.5'in geliştirici arayüzündeki liste fiyatı değişmedi: Bir milyon giriş birimi için 2, çıkış birimi için 10 dolar; önbellekten okuma için 0,20 dolar. Anthropic'in daha düşük maliyet iddiası, modelin aynı görevi daha az işlem adımı veya daha az çıktı birimiyle bitirmesine dayanıyor. Dolayısıyla her istek için otomatik yüzde 30 indirim uygulanmıyor. Gerçek fatura, kullanılan bağlama, seçilen çalışma düzeyine ve görevin uzunluğuna göre değişecek.

Şirket, modeli özellikle iyi tanımlanmış günlük işlerde, hata düzeltmede ve belge, sunum veya tablo hazırlamada konumlandırıyor. Daha karmaşık, uzun süreli ve açık uçlu kararlar için Opus 5.5'i üst sırada tutuyor.

Bu ayrım kullanıcı için pratik: En pahalı modeli her işte çalıştırmak yerine görevin zorluğuna göre seçim yapılabilecek. Ne var ki iki model arasındaki kalite farkı, yalnızca şirketin örnekleriyle değil gerçek çalışma dosyalarıyla da ölçülmeli.

Anthropic testlerde hız artışı bildiriyor

Anthropic'in yayımladığı tabloda Sonnet 5.5, Terminal-Bench 4.0 adlı ajan destekli yazılım testinde yüzde 70,6 sonuç alıyor. Sonnet 5 için aynı tabloda yüzde 10,3 görülüyor. Fark dikkat çekici olsa da tek testten bütün kodlama işlerinde aynı oranda iyileşme çıktığı sonucu çıkarılamaz. Testin görev seçimi, kullanılan araçlar ve modelin çalışma düzeyi sonucu etkiliyor. Anthropic de kıyaslamaların model yeteneğinin yalnızca bir bölümünü yansıttığını belirtiyor.

Günün Öne Çıkan Fırsatları

Lenovo LOQ: RTX 5050’li oyun bilgisayarı sepette 6.499,90 TL ucuzluyor
Lenovo LOQ: RTX 5050’li oyun bilgisayarı sepette 6.499,90 TL ucuzluyor
Satın Al
Samsung 50Q7FA: 50 inç 4K QLED TV sepette 1.605,50 TL ucuzluyor
Samsung 50Q7FA: 50 inç 4K QLED TV sepette 1.605,50 TL ucuzluyor
Satın Al
Xiaomi Robot Vacuum S40 Pro: Süpürme ve paspaslama için sepette 16.641 TL
Xiaomi Robot Vacuum S40 Pro: Süpürme ve paspaslama için sepette 16.641 TL
Satın Al
Lenovo Idea Tab: Klavye ve kalemli 11 inç tablet sepette 15.538,08 TL
Lenovo Idea Tab: Klavye ve kalemli 11 inç tablet sepette 15.538,08 TL
Satın Al
Baseus EnerFill FE11: Üç bağlantılı 100 W şarj cihazı 1.944 TL
Baseus EnerFill FE11: Üç bağlantılı 100 W şarj cihazı 1.944 TL
Satın Al
Tümünü Gör Daralt
Tüm Fırsatları Gör

REKLAM — Bu içerikte satış ortaklığı bağlantıları bulunmaktadır. Bu bağlantılar üzerinden yapılan alışverişlerden Teknoblog komisyon kazanabilir.

Yeni sürüm için güvenlik tarafında da değişiklik var. Anthropic, Sonnet ailesinde ilk kez gelişmiş siber güvenlik önlemleri ve gerektiğinde eski modele geri dönüş mekanizması kullandığını söylüyor. Şirketin açıklamasına göre rutin yazılım geliştirme ve hata düzeltme çalışmaları sürerken daha yüksek riskli bazı istekler farklı biçimde ele alınacak. Biyolojiye ilişkin koruma ise Sonnet 5 ile aynı kalıyor. Otomatik davranış denetimlerinde iyileşme bildiriliyor; bu, bütün hataların tespit edildiği anlamına gelmiyor.

Claude Sonnet 5.5, Anthropic'in kendi platformunun yanında AWS, Google Cloud ve Microsoft Azure üzerinde de sunuluyor. Geliştiriciler claude-sonnet-5-5 model adını kullanabilecek. Şirket, düşünme özelliğini kapalı çalıştıran uygulamaların geçişte yeni ayarı kontrol etmesi gerektiğini de belirtiyor. Bu küçük görünen ayrıntı, mevcut bir uygulamanın model adını değiştirip hemen aynı davranışı beklememesi gerektiğini gösteriyor.

Sonnet 5.5'in asıl etkisi, orta zorluktaki işlerde hız, kalite ve faturanın birlikte nasıl değiştiği görüldüğünde anlaşılacak. Kurumsal ekipler için ölçü, tanıtımdaki tek bir puandan çok kendi kodlarında veya belgelerinde işi kaç denemede tamamladığı olmalı. Kullanıcı açısından ise daha hızlı yanıt vaadi kadar, üretilen dosyanın doğru ve düzenlenebilir olması belirleyici kalacak.

Teknoblog artık WhatsApp'taGünün en iyi teknoloji fırsatları ve kaçırmamanız gereken büyük haberler, telefonunuza gelsin.
Kanala Katıl