Yapay zeka sınırı aştı: Testler gerçek saldırıya dönüştü
Geçtiğimiz günlerde OpenAI’nin yapay zeka modelinin test sırasında bir siber saldırı düzenlediğinin ortaya çıkmasının ardından, şimdi de Anthropic benzer bir vakayı doğruladı. Şirket, kendi modellerinin siber güvenlik testleri esnasında yanlışlıkla üç gerçek işletmenin sistemine sızdığını açıkladı.
Olayın temelinde basit bir insan hatası yatıyor: İnternet bağlantısı olmadığı sanılan modellere aslında erişim izni verilmişti. Anthropic'in OpenAI vakasından sonra yaptığı incelemelere göre; Nisan ayından bu yana Claude Opus 4.7, Claude Mythos 5 ve henüz piyasaya sürülmemiş bir test modeli, zayıf şifreleri kullanarak gerçek sistemlere giriş yaptı.
En dikkat çekici olaylardan birinde Claude Opus 4.7, kurgusal bir hedefle aynı adı taşıyan gerçek bir şirketi hackledi. Model gerçek internette olduğunu fark etmesine rağmen, bunu simülasyonun bir parçası sanarak saldırıya devam etti. Ancak henüz yayınlanmamış yeni bir model, gerçek bir ağa sızdığını anlayıp saldırıyı anında sonlandırdı.
Uzmanlar, yapay zeka akıllandıkça saldırıların kötüleşeceği konusunda uyarıyor. Yaşananların ardından Anthropic, 23 Temmuz'da testlerini askıya aldı ve mağdur şirketleri bilgilendirdi. Otonomlaşan sistemlerin yarattığı riskler büyürken, ABD Başkanı Donald Trump gelişmiş modeller için özel bir siber güvenlik test çerçevesi oluşturulması talimatını verdi.