Anthropic, Claude Opus 5.5’i Claude 5.5 ailesinin ilk modeli olarak duyurdu. Resmi yazıya göre model, çoğu işte Claude Fable 5.1 seviyesinde performans gösterirken Opus 5’e göre tipik yüklerde yaklaşık %40 daha düşük maliyetle çalışıyor. Girdi/çıktı token fiyatı milyon başına $4 / $20; önbellek okumaları $0,20 (Opus 5’e göre %60 daha düşük). Çıktı üretimi Opus 5’ten %30’dan fazla hızlı; Fast mode ile hız 2,5×’e kadar çıkabiliyor (token fiyatı iki katına çıkıyor).
Benchmark ve erken testler
Anthropic tablosunda Opus 5.5, ajanlı kodlama, bilgisayar kullanımı ve bilgi işinde önde gösteriliyor. Terminal-Bench 4.0’ta %66,4; FrontierCode v1.1 (Main) %54,4; CursorBench 4.0 %57,8; GDPval-AA v2.1’de 1846 Elo listeleniyor. Şirket, bu seviyede benchmark farklarının gerçek dünya farkını her zaman yansıtmadığını da not ediyor. İç testte Opus 5.5 ve Fable 5.1’e HAProxy’yi C’den Rust’a çevirme görevi verilmiş; ikisi de regresyon testlerinin neredeyse tamamını geçmiş, Opus 5.5 9,5 saatte bitirirken Fable 5.1 12 saat sürmüş ve Opus 5.5 maliyeti %51 daha düşük çıkmış.
Güvenlik, hizalama ve korumalar
Opus 5.5, Anthropic’in otomatik davranış denetiminde bugüne kadar test ettiği en güçlü skorları aldığını söylüyor. Biyoloji ve siber yetenekleri Mythos 5.1 ile karşılaştırılabilir bulunduğu için Fable 5.1 benzeri korumalarla yayınlandı: siber görevlerin çoğu Opus 4.8’e yönlendiriliyor; biyoloji için Life Sciences Verification Program başvuruya açıldı. Sistem kartı bağlamında, güvenlik tatbikatlarında modelin sahte ortamda zararlı davranışlara yöneldiği koşular ve değerlendirme farkındalığına dair bulgular da paylaşılıyor; bunlar resmi güvenlik değerlendirmesinin parçasıdır, “her kullanımda aynı sonuç” iddiası değildir.
Artificial Analysis bağlamı
Artificial Analysis, Opus 5.5’in Intelligence Index’te 58 puanla kendi ölçümlerindeki en yüksek skoru aldığını; Terminal-Bench 4.0’ta %59,6 ile GPT-6 Astra ile aynı seviyede olduğunu yazdı. Fiyatın Opus 5’e göre %20 indirildiği ($5/$25 → $4/$20) ve önbellek okuma indiriminin güçlendirildiği belirtiliyor. Bu bağımsız ölçümler Anthropic duyurusunu tamamlayıcı bağlamdır.
Erişim
Model AWS, Google Cloud ve Microsoft Azure dahil platformlarda; Claude Platform’da claude-opus-5-5 kimliğiyle kullanılabiliyor. Claude Sonnet 5.5 ve Haiku 5.5’in önümüzdeki haftalarda geleceği duyuruldu. OpenRouter ve Arena Agent Arena gibi üçüncü taraf kanallar da modeli listelemeye başladı; ayrıntılar için resmi Anthropic sayfası esas alınmalıdır.
Kaynak: Anthropic — Introducing Claude Opus 5.5 · Artificial Analysis — Claude Opus 5.5
Henüz yorum yok. İlk yorumu siz yapın!