Anthropic, Fable seviyesinde çalışan yeni Opus 5.5'i kullanıma sundu
Anthropic, yapay zeka modelleri arasında en gelişmiş ve en yüksek fiyatla sunulan yeni Claude Opus 5.5 modelini kullanıma sundu.
Anthropic, yapay zeka model ailesinin en gelişmiş ve en yüksek fiyat katmanı olan Claude Opus 5.5'i kullanıma sundu. Şirket, yeni modelin kodlama ve bilgi odaklı işlerde performans açısından yeni bir rekor kırdığını belirtirken daha büyük Fable modelini birçok kıyaslama testinde geride bıraktığını açıkladı. Opus 5.5'in ayrıca Fable'ın tamamlayamadığı bazı görevleri başarıyla yerine getirdiği belirtildi.
Yeni model, performans iyileştirmelerinin yanı sıra önceki sürümüne kıyasla daha düşük kullanım maliyetleriyle de öne çıkıyor. Anthropic’in açıklamasına göre Opus 5.5’te milyon çıktı token’ı başına ücret 25 dolardan 20 dolara düşürüldü. Diğer fiyatlandırma ölçütlerinde de benzer indirimler yapıldı. Modelin çalıştırılma hızının artması ve hizmet sunumu için gereken hesaplama kaynaklarının azalması da sürümün öne çıkan özellikleri arasında yer aldı.
Opus 5.5’in iletişim biçiminde de değişiklikler yapıldı. Yeni sürümün teknik jargon kullanma olasılığının azaldığı ve mesajlarında önemli bilgileri daha erken sunmaya yöneldiği belirtildi. Bu değişikliklerle modelin yanıtlarının daha anlaşılır ve doğrudan olması hedefleniyor.

Anthropic’in üç katmanlı Claude ailesinde Opus en yetenekli ve pahalı modeli temsil ederken, Sonnet orta seviyede, Haiku ise en hızlı ve en uygun maliyetli seçenek olarak konumlanıyor. Şirket, Sonnet 5.5 ve Haiku 5.5 modellerinin de benzer performans iyileştirmeleriyle önümüzdeki haftalarda yayımlanacağını duyurdu.
Güvenlik odaklı kontrollü ilerleme yaklaşımı
Opus 5.5’in piyasaya sürülmesi, Anthropic CEO’su Dario Amodei’nin yapay zeka yeteneklerindeki ilerlemenin güvenlik çalışmalarına zaman tanıyacak şekilde yavaşlatılması gerektiğini savunmasının ardından şirketin gerçekleştirdiği ilk model lansmanı oldu.
Amodei, bu ayın başlarında yayımladığı yazısında risklerin yalnızca önleyici yatırımlarla ele alınmasının yeterli olmayabileceğini belirterek, yetenek gelişiminin hızının da risk azaltma çalışmalarının yetişebileceği şekilde ayarlanması gerektiğini ifade etti.
Şirket, Opus 5.5’in biyoloji ve siber güvenlik alanlarındaki yeteneklerinin Mythos ile karşılaştırılabilir düzeyde olduğunu belirtti. Bu nedenle modelin yayımlanması, Fable için uygulanan güvenlik önlemlerine benzer kısıtlamalara tabi tutuldu. Söz konusu önlemler, modellerin derlenmiş programlardaki güvenlik açıklarını keşfetmek veya tanınabilir biyolojik silahlar geliştirmek gibi belirli görevlerde kullanılmasını sınırlandırıyor.

Opus 5.5’in güvenlik eğitiminin önceki modellerle genel olarak benzer olduğu aktarıldı. Model, uyum testlerinden geçirildi ve METR ile Frontier Design gibi dış kuruluşlar tarafından lansman öncesinde değerlendirildi.
Anthropic ayrıca gelecekteki modeller için daha gelişmiş eğitim ve değerlendirme sistemleri hazırladığını vurguladı. Bu çalışmalar kapsamında güvenlik ve izleme sistemlerinin iyileştirilmesi de planlanıyor.
Şirket, yapay zeka sistemlerinin yetenekleri arttıkça kamu politikalarının insanların güvendiği sistemlerin güvenliğini sağlamada daha büyük rol üstlenmesi gerektiğini belirtti. Bu kapasitenin oluşturulmasının zaman alacağını kaydeden Anthropic, gerekli altyapıyı hazırlamaya başladığını ve çalışmalarına ilişkin daha fazla ayrıntıyı ilerleyen dönemde paylaşacağını bildirdi.
Vasıf Baran Fidan