Anthropic, Opus ailesinin yeni amiral gemisi Claude Opus 5.5’i 22 Eylül’de duyurdu ve modeli aynı gün API ile Claude.ai üzerinden kullanıma açtı. Sürümün öne çıkan tarafı, şirketin en pahalı modeli olan Claude Fable 5.1’in muhakeme seviyesine yaklaşırken token maliyetlerini önceki Opus 5’e kıyasla yüzde 40 düşürmesi.
Anthropic’in 5.x nesline geçmesiyle birlikte modellerin iç mantık yapısı yeniden tasarlandı. Opus 5.5 de bu geçişin ilk büyük adımı olarak sunuluyor.
Fiyat tarafında iddialı bir indirim
Yeni model, girdi ve çıktı token maliyetlerinde yapılan indirimle büyük hacimli üretim iş yüklerini hedefliyor. Anthropic’in paylaştığı verilere göre 1 milyon token çıkarım maliyeti Opus 5.5’te 9 dolar seviyesinde. Aynı ölçekte Fable 5.1 için 15 dolar, GPT-5 Omni için 12,50 dolar ve Gemini 3.8 Pro için 10 dolar belirtiliyor.
Modelin diğer öne çıkan özellikleri şöyle:
- Uzun ajan döngüleri: 100 adımdan fazla süren otonom görevlerde hedeften sapmaya karşı direnç ve kendi hatalarını geriye dönüp ayıklama yeteneği güçlendirildi.
- Çok adımlı muhakeme: Karmaşık matematiksel ispatlar ve mimari yazılım tasarımı testlerinde Fable 5.1 ile başa baş sonuçlar üretiyor.
- Fiyat/performans dengesi: Şirketin en pahalı modelinin kabiliyetlerini belirgin biçimde daha düşük maliyetle sunuyor.
Benchmark tablosunda denge değişiyor
Anthropic’in teknik raporundaki kıyaslama sonuçlarına göre Opus 5.5, SWE-bench Verified testinde yüzde 74,8 başarı sağlıyor. Bu skor Fable 5.1’in yüzde 75,2’sine çok yakın; GPT-5 Omni yüzde 69,4, Gemini 3.8 Pro ise yüzde 71,1 seviyesinde kalıyor.
50 adımdan uzun ajan görevlerinde ölçülen hedeften sapma direncinde Opus 5.5 yüzde 94,1, Fable 5.1 yüzde 95,0, GPT-5 Omni yüzde 86,5 ve Gemini 3.8 Pro yüzde 88,3 sonucunu veriyor. Yani fark, saf zeka skorundan çok maliyet ve stabilite tarafında açılıyor.
Otonom kodlama araçları için ne anlama geliyor
Cursor, Windsurf, Cline ve Devin gibi otonom kodlama araçlarını kullanan geliştiriciler için modelin maliyet avantajı doğrudan aylık kullanım faturalarına yansıyor. Uzun süren ajan döngülerinde token tüketimi hızla arttığı için yüzde 40’lık indirim, aynı bütçeyle daha fazla görev tamamlanması anlamına geliyor.
Anthropic böylece hem OpenAI hem de Google karşısında fiyat/performans tarafında konumunu güçlendirmiş oluyor. Model yarışında artık yalnızca en yüksek zeka skoru değil, o zekayı en ekonomik ve en kararlı biçimde sunmak belirleyici hale geliyor.
Kaynak: WebTuring

Deneyimini paylaş
Bir sorunun, farklı bir çözümün veya eklemek istediğin bir notun var mı?
Yorum yazmak için giriş yap veya aramıza katıl.
Giriş yap ↗︎Üye ol ↗︎