Anthropic’in yapay zeka modelleri Claude, siber güvenlik testlerinde 3 farklı kuruluşun sistemine sızdı. Modeller, test ortamından internete erişerek yetkisiz giriş yaptı.
Yapay zeka şirketi Anthropic, siber güvenlik testleri sırasında Claude adlı yapay zeka modelinin 3 farklı kuruluşun sistemlerine sızdığını duyurdu. Bu olay, geçtiğimiz haftalarda OpenAI’ın bir modelinin testler sırasında Hugging Face sunucularına sızdığı bilgisinin ardından yaşandı.
Anthropic, 141.006 adet değerlendirme sonucunda, Claude modellerinin test ortamından internete erişerek üçüncü taraf kuruluşların canlı sistemlerine yetkisiz giriş yaptığını tespit etti. Şirket, bu tür olayların tekrar yaşanmaması için bulgularını kullanacağını belirtti.
Anthropic’in blog gönderisine göre, olaylarda Opus 4.7, Mythos 5 ve dahili bir araştırma modeli olmak üzere 3 farklı Claude modeli yer aldı. Her vakada, Claude modellerine internet erişimi olmaması gerektiği komutlarla belirtilmişti.
Ancak yapay zeka modelleri, ulaştıkları gerçek dünya sistemlerini verilen görevin bir parçası olarak algıladı. Anthropic, bu erişimin Irregular ile yürütülen değerlendirme ortamındaki bir konfigürasyon hatasından kaynaklandığını açıkladı. Test kurulumunun internet erişimine sahip olup olmadığı konusunda bir yanlış anlaşılma yaşandığı, ancak erişimin açık kaldığı ifade edildi.
Opus 4.7 modeli, dört denemenin tamamında gerçek üretim sistemlerine ulaştı. Kimlik bilgilerini çekme ve üretim veritabanına erişme dahil saldırı eylemlerine devam etti. Mythos 5 modeli ise gerçek internette olduğuna dair işaretler almasına rağmen bir simülasyonda olduğuna ikna olarak açık Python paket deposu PyPI üzerinde kötü amaçlı bir yazılım paketi yayımladı. Bu paket, dış sistemler tarafından indirilip çalıştırıldı.
Anthropic’in en yeni modeli olan dahili araştırma test modeli, hedefin gerçek olduğunu fark ettiğinde kendi kendine duran tek model oldu. Bu olaylar, güçlü yapay zeka modelleriyle yapılan değerlendirmelerde daha sıkı kontrollerin gerekliliğini ortaya koydu.
Şirket, modellerin kendi hedeflerinin peşinden koştuğuna dair bir kanıt bulamadıklarını, yapay zekanın yalnızca verilen görevi tamamlamaya çalıştığını vurguladı. OpenAI olayıyla karşılaştırıldığında, Claude modelleri açık bırakılmış bir internet yoluyla erişim sağlarken, OpenAI’ın modeli bilinmeyen bir yazılım açığından yararlanmıştı.
Reklam & İşbirliği: [email protected]