Yapay zeka araştırma laboratuvarı Anthropic, yazılım geliştiricilerin en çok tercih ettiği orta segment model ailesini yeniledi. Şirket, Claude Sonnet 5.5 sürümünü genel erişime açtı. Yeni model otonom kodlama, hata ayıklama ve çok adımlı araç kullanımında öne çıkıyor. Anthropic’e göre Sonnet 5.5, amiral gemisi Opus sınıfı modellerin muhakeme gücüne daha düşük maliyet ve daha yüksek hızla ulaşıyor.
Terminal-Bench 4.0 testinde yüzde 70,6 başarı
Modelin yayınlanmasıyla paylaşılan benchmark sonuçları yazılım mühendisliği topluluğunda geniş yankı buldu. Otonom ajanların karmaşık terminal komutları vererek gerçek yazılım depolarındaki hataları çözme becerisini ölçen Terminal-Bench 4.0 testinde Claude Sonnet 5.5 yüzde 70,6 başarıya ulaştı.
Aynı testte önceki nesil Sonnet 5’in skoru yüzde 10,3’tü. Yaklaşık yedi katlık bu artış, modelin büyük kod tabanlarında mimari değişiklikleri tek başına planlayıp uygulayabildiğini gösteriyor. Anthropic, Sonnet 5.5’in bu testte Opus sınıfı modelleri de geride bıraktığını belirtiyor.
1 milyon token bağlam ve 5 kademeli düşünme
- 1 milyon token bağlam penceresi: Tek istemde yüz binlerce satır kod, veritabanı şeması ve teknik dokümantasyon tutulabiliyor.
- 128 bin token çıktı: Tek seferde binlerce satırlık modüller ve kapsamlı mimari raporları üretilebiliyor.
- 5 kademeli adaptif düşünme: low, medium, high, xhigh ve max seviyeleri arasında seçim yapılarak modelin bir problem üzerinde ne kadar derin muhakeme yürüteceği ihtiyaca ve bütçeye göre ayarlanıyor.
Modelin bilgi kesintisi Haziran 2026 olarak açıklandı; güncel açık kaynak kütüphaneleri ve yazılım sürümleriyle uyumlu çalıştığı belirtiliyor.
Fiyat aynı, görev maliyeti yüzde 30 daha düşük
Anthropic, API liste fiyatını değiştirmedi: 1 milyon giriş tokenı 2 dolar, 1 milyon çıkış tokenı 10 dolar. Buna karşılık modelin çıkarım hızı Sonnet 5’e göre yüzde 30’dan fazla arttı.
Şirkete göre Sonnet 5.5 gereksiz çıktı üretmiyor ve araçları daha az deneme yanılmayla doğru parametrelerle çağırıyor. Bu nedenle bir görevi tamamlarken harcanan toplam token miktarı düşüyor ve geliştiricinin faturasına görev başına yaklaşık yüzde 30 tasarruf olarak yansıyor.
Göç edecek ekipler için uyarı
Anthropic, Sonnet 5’ten 5.5’e geçen ekipler için kütüphane değişiklikleri yayınladı. Eski modelde kullanılan statik düşünme kapatma parametreleri yerine artık araçlar arası adaptif mod geçerli. Geliştiricilerin sistem promptlarını ve API çağrı formatlarını yeni adaptif düşünme mimarisine göre güncellemesi gerekiyor.
Kaynak: WebTuring

Deneyimini paylaş
Bir sorunun, farklı bir çözümün veya eklemek istediğin bir notun var mı?
Yorum yazmak için giriş yap veya aramıza katıl.
Giriş yap ↗︎Üye ol ↗︎