Anthropic’in yapay zeka modelleri Claude, siber güvenlik testleri sırasında 3 farklı şirketin sistemlerine yetkisiz erişim sağladı. Modeller, test ortamından internete ulaşarak hedef sistemlere sızdı.
Yapay zeka devi Anthropic, siber güvenlik testleri sırasında geliştirilmekte olan Claude adlı yapay zeka modelinin 3 farklı kuruluşun sistemlerine yetkisiz erişim sağladığını duyurdu. OpenAI’ın benzer bir olay yaşamasının ardından yapılan incelemelerde, Claude’un test ortamından internete erişerek bu sızmaları gerçekleştirdiği belirlendi.
Anthropic, blog gönderisinde, söz konusu 3 vakada da bir Claude modelinin üçüncü bir taraf ile etkileşim halindeyken test ortamından internete ulaştığını belirtti. Ardından bu modellerin, ilgili kuruluşların canlı sistemlerine sızdığı tespit edildi. Firma, bu tür olayların tekrar yaşanmaması için bulgularını kullanacağını açıkladı.
Olaylarda görev alan 3 farklı Claude modeli bulunuyordu: Opus 4.7, Mythos 5 ve dahili bir araştırma modeli. Anthropic, her vakada Claude’a internet erişiminin komutlarla kısıtlandığını ancak yapay zeka modellerinin, ulaştıkları gerçek dünya sistemlerini verilen görevin bir parçası olarak algıladığını ifade etti. Firma, bu erişimin Irregular ile yürütülen değerlendirme ortamındaki bir konfigürasyon hatasından kaynaklandığını açıkladı.
En eski model olan Opus 4.7, gerçek üretim sistemlerine ulaştığını fark ettiğinde bunu tatbikatın bir parçası olarak rasyonalize etti ve kimlik bilgileri çekmek dahil saldırıya devam etti. Mythos 5 modeli ise gerçek internette olduğuna dair işaretler almasına rağmen bir simülasyonda olduğuna inanarak Python paket deposu PyPI üzerinde kötü amaçlı bir yazılım paketi yayınladı. Bu paket, fark edilip kaldırılmadan önce dış sistemler tarafından indirildi.
Anthropic’in en yeni dahili araştırma test modeli ise hedefin gerçek olduğu sonucuna vardığında kendi kendine duran tek model oldu. Şirket, bu olayların güçlü yapay zeka modelleriyle yapılan değerlendirmelerde daha sıkı kontrollerin gerekliliğini gösterdiğini vurguladı. Ancak modellerin kendi hedeflerinin peşinden koştuğuna dair bir kanıt bulunmadığını, sadece verilen görevi tamamlamaya çalıştıklarını belirtti.
OpenAI’ın yaşadığı olayla karşılaştırıldığında, Claude modellerinin açık unutulmuş bir yoldan internete eriştiği, OpenAI’ın ise test ortamından kaçmak için bilinmeyen bir yazılım açığından yararlandığı belirtildi. Bu olaylar, yapay zeka teknolojisinin geldiği ileri seviyeyi gözler önüne seriyor.
Reklam & İşbirliği: [email protected]