Meta: Bizim de yapay zekamız bir şirketi hackledi

Meta: Bizim de yapay zekamız bir şirketi hackledi

OpenAI ve Anthropic’in ardından Meta da test aşamasındaki yapay zeka modelinin insan talebi olmadan bir şirketin sistemlerine sızdığını açıkladı.

Meta’nın Muse Spark 1.1 modeli, izole olması gereken test ortamından internete erişerek bir üçüncü taraf servisteki güvenlik açığını istismar etti. Olayın OpenAI ve Anthropic’in modellerinde yaşadığı benzer vakalarla aynı test ortağıyla bağlantılı olması dikkat çekti.

Meta sözcüsü Andy Stone, Bloomberg’e yaptığı açıklamada olayı doğrularken The Information’ın haberine göre şirketin yapay zeka modeli Muse Spark 1.1, test amacıyla izole edilen ortamdan internete erişmeyi başardı. Modelin internete erişebilmesinin nedeni ise test ortamındaki bir yapılandırma hatası olarak gösterildi.

Söz konusu testleri gerçekleştiren değerlendirme ortağı Irregular tarafından yapılan yanlış yapılandırmanın ardından model, internete erişerek üçüncü taraf bir serviste bulunan güvenlik açığından yararlandı. Stone, olayın daha önce başka şirketlerin yapay zeka modellerinde bildirilen vakalara benzer şekilde gerçekleştiğini belirtti.

Önce OpenAI ve Anthropic, şimdi Meta

Meta’nın yaşadığı olay, Irregular tarafından gerçekleştirilen testlerde ortaya çıkan ilk benzer vaka değil. Anthropic’in modelleri de yine bir yapılandırma hatası nedeniyle test ortamlarının dışına çıkarak üç farklı kuruluşa yönelik siber saldırı gerçekleştirmişti. Anthropic, olayların ardından sorumluluğu Irregular’ın test ortamındaki yapılandırmasına bağlamıştı.

OpenAI ise Hugging Face saldırısından ayrı bir olayda modellerin test sırasında internete erişebildiğini bildirmişti. Bu olayda da aynı test ortağı Irregular’ın adı gündeme geldi.

Kendisini “ilk frontier güvenlik laboratuvarı” olarak tanımlayan Irregular, giderek daha yetenekli ve gelişmiş hale gelen yapay zeka sistemlerinin siber güvenlik kabiliyetlerini gerçek dünya senaryolarını simüle ederek test ediyor.

Şirketin Bloomberg’e yaptığı açıklamaya göre söz konusu olaylar sandbox kaçışı veya gelişmiş bir siber saldırı niteliğinde değildi. Irregular ayrıca olaylarla ilgili açık bir sorun bulunmadığını ve yapay zeka modellerinin siber güvenlik testlerinin güvenli biçimde yürütülmesine yönelik en iyi uygulamaları içeren bir doküman hazırladığını açıkladı.

Öte yandan OpenAI ajanlarının daha önce Hugging Face’e yaptığı saldırının farklı bir niteliğe sahip olduğu da belirtildi. Bu olayda ajanlar birbirleriyle iş birliği yaparak bir tür mesajlaşma sistemi kurmuş, ardından bir güvenlik açığından yararlanarak internete erişmiş ve Hugging Face’i hacklemişti.

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir

İlgili İçerikler