Anthropic, yapay zeka modellerinin biyolojik silah geliştirme amacıyla kullanılabileceğini gösteren bir dizi vakayı tespit etti. Şirketin yayımladığı yeni rapora göre, bazı bilim insanlarının Claude’u potansiyel olarak tehlikeli biyolojik araştırmaları ilerletmek için kullandığı belirlendi.
Anthropic, tespit edilen hesapları kapatırken vakalardan elde edilen bulguları yapay zeka güvenlik önlemlerini geliştirmek için kullanıyor. Şirketin raporunda, modellerinin biyolojik silah geliştirme çalışmalarında kullanıldığı beş ayrı vaka inceleniyor.
Anthropic, kötüye kullanımı tespit etmenin özellikle biyolojik araştırmalarda son derece zor olduğunu belirtiyor. Bunun temel nedenlerinden biri, yeni bir aşı geliştirmeye yönelik bilimsel çalışmalarla tehlikeli biyolojik araştırmaların dışarıdan benzer görünebilmesi. Bu nedenle şirket, olası risklerde daha temkinli davranmayı tercih ettiğini ifade ediyor.

Vakalardan birinde Anthropic’in biyolojik güvenlik sistemi, Claude’dan chikungunya virüsü üzerinde gain-of-function araştırması için hibe başvurusu hazırlamasının istendiğini tespit etti. Söz konusu araştırmanın virüsün bulaşıcılığını artırmayı ve bağışıklık sisteminden kaçma kapasitesini geliştirmeyi hedeflediği belirtildi.
Araştırmanın askeri bir araştırma kuruluşuyla bağlantılı olması da şirketin değerlendirmesinde ek bir risk unsuru oluşturdu. Benzer şekilde, kuş gribi üzerinde gain-of-function araştırmaları ve bir araştırmacının zehir toksinlerinden elde edilen peptitleri sınıflandırarak toksin özelliklerini optimize etmeye yönelik bir sistem geliştirmesi de raporda yer aldı.
Anthropic, biyolojik araştırmaların yanı sıra modellerinin gözetleme, yazılım açıklarından yararlanma, propaganda ve silah sistemleri gibi farklı alanlarda da kötüye kullanıldığı vakaları belgeledi. Anthropic, tespit edilen kötüye kullanım vakalarında ilgili hesapları yasakladığını ve soruşturmalardan elde edilen sonuçları güvenlik sistemlerini geliştirmek için kullandığını açıkladı.
Şirket, araştırmacıların kimliklerini veya çalıştıkları kurumları ise paylaşmadı. Gerekçe olarak, söz konusu kişilerin çalışan bilim insanları olması ve kimliklerinin açıklanmasının kendilerine zarar verebilecek olması gösterildi.
Anthropic’in tehdit istihbaratı biriminin yöneticisi Jacob Klein, biyolojik kötüye kullanım vakalarının basit biçimde sınıflandırılamayacağını vurgularken, bilimsel araştırma ile kötüye kullanım arasındaki sınırın son derece karmaşık olduğunu belirtti.