Anthropic, en gelişmiş yapay zeka modellerinin yeni sürümleri Fable 5.1 ve Mythos 5.1’i kullanıma sundu. Yeni modeller performans artışlarının yanı sıra daha düşük token maliyeti ve güvenlik sistemlerinde yaşanan yanlış pozitifleri azaltmaya yönelik geliştirmelerle geliyor.
Şirketin yeni model ailesinde Fable 5.1 daha geniş kullanıma açık versiyon olarak konumlanırken, Mythos 5.1’in erişimi sınırlandırılmaya devam ediyor. Mythos 5.1 yalnızca Anthropic’in kayıtlı ortakları tarafından ve siber güvenlik veya yaşam bilimleri araştırmaları kapsamında kullanılabilecek. Fable 5.1 ise bulut platformları ve Anthropic API üzerinden erişilebilir durumda.
Yeni sürümle birlikte Anthropic’in sıfır veri saklama (zero data retention) yaklaşımını genişletmesi de dikkat çekiyor. Daha önce güvenlik endişeleri nedeniyle Fable için sunulmayan yüksek gizlilik odaklı Enterprise Frontier Safeguards hizmetinin sonbahar döneminde kullanıma açılması planlanıyor.

Sistem, yapay zeka ajanlarının veya insan kullanıcıların kötüye kullanımını izlemeye devam edecek ancak izleme yöntemleri üzerindeki kontrol müşterilere bırakılacak. Anthropic ayrıca kurumsal müşterilerin verilerinin izinsiz kullanılmadığını belirtiyor.
Şirket, kurumsal veriler üzerinde açık izin olmadan hiçbir zaman eğitim gerçekleştirmediğini ve gerçekleştirmeyeceğini ifade ediyor. Fable 5.1 ve Mythos 5.1, performans tarafında da iddialı sonuçlar ortaya koyuyor.
Modeller, komut satırı üzerinden gerçekleştirilen yazılım geliştirme görevlerini ölçen Terminal-Bench 4.0 ve genel akıl yürütme yeteneklerini değerlendiren Humanity’s Last Exam gibi çeşitli testlerde yeni rekorlara imza attı.

Anthropic, modellerin henüz piyasaya çıkmadan önce ürettiği üç yeni bilimsel bulguyu da duyurdu. Bunlar arasında özel bir GPU optimizasyonu ve mevcut fotoğraflardan oluşturulan yüksek çözünürlüklü Venüs haritası bulunuyor.
Şirketin yayımladığı sistem kartında güvenlik değerlendirmeleri de ayrıntılı şekilde ele alınıyor. Mythos 5.1, yapay zekanın kendi gelişimini hızlandırması gibi otomatik yapay zeka geliştirme riskleri açısından “düşük riskli” olarak değerlendiriliyor.
Bununla birlikte modelin bazı alanlarda önceki sürümlere kıyasla farklı bir risk profili sergilediği belirtiliyor. Mythos 5.1’in, Opus 5’e kıyasla genel uyumsuz davranışlarda hafif bir gerileme gösterdiği; ancak önceki Mythos 5 ve Claude Sonnet 5’e göre gelişim kaydettiği ifade ediliyor.

Model, insan kaynaklı kötüye kullanımlara daha kolay uyum sağlayabilirken açık kısıtlamaları göz ardı etme, girdileri halüsinasyon yoluyla üretme veya tamamlanmamış görevleri tamamlanmış gibi gösterme konusunda önceki modellere göre daha düşük eğilim gösteriyor.