Anthropic; yazılım geliştirme, araştırma ve uzun soluklu görevler için geliştirdiği yeni yapay zeka modeli Claude Opus 5’i duyurdu. Şirket, yeni modelin Claude Fable 5’in performans seviyesine yaklaşırken görev başına yaklaşık yarı maliyetle çalıştığını belirterek özellikle geliştiriciler ve kurumsal kullanıcılar için daha verimli bir alternatif sunduğunu vurguluyor.
Claude Opus 5, mayıs ayının sonunda tanıtılan Opus 4.8 modelinin yerini alıyor. Yeni model, Claude Max aboneleri için varsayılan seçenek olurken Claude Pro kullanıcılarına sunulan en güçlü model olarak konumlandırılıyor. Böylece Anthropic’in Claude 5 ailesinde güncellenmeyi bekleyen tek model Haiku olarak kaldı.
Anthropic’in paylaştığı verilere göre Claude Opus 5, özellikle yazılım mühendisliği ve bilgi yoğun görevlerde şimdiye kadar geliştirdikleri en başarılı modeller arasında yer alıyor. Şirket, modelin Frontier-Bench v0.1 testinde önceki nesil Opus 4.8’in performansını iki katın üzerinde artırdığını ve bunu daha düşük görev maliyetiyle gerçekleştirdiğini ifade ediyor.

Performans karşılaştırmalarında Opus 5, CursorBench 3.2 testinde maksimum çalışma ayarında Fable 5’in en yüksek skorunun yalnızca %0.5 gerisinde kalırken aynı görevi yaklaşık yarı maliyetle tamamladı. Kullanıcılar ayrıca modelin “effort” ayarı sayesinde daha yüksek performans ile daha düşük token tüketimi arasında tercih yapabiliyor.
Anthropic, modelin yalnızca yazılım geliştirmede değil, farklı alanlarda da önemli ilerlemeler kaydettiğini belirtiyor. ARC-AGI 3 testinde yeni problem çözme becerilerinde en yakın rakibinin üç katı puan alan Opus 5, Zapier AutomationBench değerlendirmesinde ise aynı görev maliyetiyle rakiplerinden yaklaşık 1.5 kat daha yüksek başarı oranına ulaştı. Bilgisayar kullanım yeteneklerini ölçen OSWorld 2.0 testinde de Fable 5’in en iyi sonucunu yaklaşık üçte biri maliyetle geride bıraktığı aktarılıyor.
Yaşam bilimleri alanında da gelişim gösteren modelin şirket içi testlerde yapısal biyoloji, organik kimya ve biyoinformatik değerlendirmelerinde Opus 4.8’i geçtiği belirtiliyor. Özellikle moleküler yapı çıkarımı ve protein dizilimlerinin analizine yönelik görevlerde dikkat çekici performans artışları elde edildiği paylaşılıyor.

Anthropic’e göre Claude Opus 5’in en önemli yeteneklerinden biri, ürettiği sonuçları kendi kendine doğrulayabilmesi ve doğru sonuca ulaşana kadar çözümü yineleyebilmesi. Şirketin paylaştıklarına göre model, doğrudan görüntü erişimi olmadan yalnızca bir makine parçasının çiziminden 3D FreeCAD modeli oluşturmayı başardı. Bunun için kendi bilgisayarlı görü sistemini geliştirerek ham piksel verilerini analiz ettiği ve parçanın geometrisini yeniden oluşturduğu belirtiliyor.
Güvenlik tarafında ise Opus 5, siber güvenlik ve biyoloji alanlarında belirli koruma mekanizmalarıyla sunuluyor. Model; güvenlik açıklarını analiz edebiliyor ancak ikili dosya tabanlın güvenlik açığı taraması, penetrasyon testleri ve exploit geliştirme gibi işlemleri engelliyor.
Anthropic ayrıca Opus 5’in güvenlik sınıflandırıcılarının Fable 5’e kıyasla yaklaşık %85 daha az devreye girdiğini, böylece günlük yazılım geliştirme süreçlerinde gereksiz engellemelerin azaltılmasının hedeflendiği açıkladı.

Şirket, tüm bunların haricinde Automatic Fallbacks adlı yeni beta özelliğini de duyurdu. Özellik ile bir isteğin Opus 5 veya Fable 5’in güvenlik sistemi tarafından engellenmesi durumunda talep otomatik olarak farklı bir Claude modeline yönlendiriliyor ve API kullanıcılarının hata mesajı yerine kullanılabilir bir yanıt alması sağlanıyor.
Claude Opus 5, Claude’un tüm platformlarında erişime açılmış durumda. Modelin API fiyatlandırması, Opus 4.8 ile aynı tutuldu. Bir milyon girdi tokenı için 5 dolar, bir milyon çıktı tokenı içinse 25 dolar ücretlendirme uygulanıyor. Geliştiriciler, modele claude-opus-5 adıyla erişebilirken standart sürümden yaklaşık 2.5 kat daha hızlı çalışan Fast modu da isteğe bağlı olarak sunuluyor.