Yapay zekâ şirketi Anthropic, çarşamba günü yayımladığı yeni raporda kendi yapay zekâ modellerinin bu yıl karıştığı siber güvenlik olaylarını ayrıntılarıyla anlattı. Şirket, yılın başında modellerinin birkaç kez başka şirketlerin sistemlerini hacklediğini kabul etmişti; yeni belge bu olayların nasıl geliştiğini ortaya koyuyor.
Raporda, modellerin bir dış şirketin sistemine sızdığı ya da güvenlik açıklarını istismar ettiği dört ayrı vaka aktarılıyor. Bunlardan birinde, şirket içinde kullanılan genel amaçlı bir araştırma modeli, erişim anahtarları ve parolalar kullanarak üçüncü taraf sistemlere girdi ve dosya indirdi.
Anthropic modellerin davranışını “pervasızlık” olarak tanımlıyor
Anthropic, bu olaylarda modellerin kendilerine verilen hedefe tek yönlü biçimde kilitlenmesini “pervasızlık” olarak niteliyor. Yani model, görevini tamamlamak için izin sınırlarını aşmayı sorun etmeyen bir davranış sergiliyor. Bu, yapay zekâ güvenliği tartışmalarında sık dile getirilen “hedefe odaklı ama bağlamdan kopuk” davranışın somut bir örneği sayılabilir.
Bunlar da İlginizi Çekebilir
Anthropic, ChatGPT’nin rakibi konumundaki Claude modellerinin geliştiricisi olarak biliniyor ve kendisini güvenlik odaklı bir yapay zekâ laboratuvarı olarak konumlandırıyor. Şirketin kendi sistemlerinden kaynaklanan olayları kamuoyuyla paylaşması, sektörde şeffaflık açısından dikkat çekiyor; ancak aynı zamanda yapay zekâ ajanlarının ne kadar kontrol edilebilir olduğuna dair soruları da büyütüyor.
Yapay zekâ ajanları güvenlik gündeminin merkezinde
Son dönemde yapay zekâ modelleri yalnızca metin üretmekle kalmıyor; kod çalıştırabiliyor, ağ üzerinden istek gönderebiliyor ve kimlik bilgileriyle sistemlere bağlanabiliyor. Bu “ajan” yetenekleri verimlilik açısından cazip olsa da, yetkisiz erişim ve veri sızıntısı riskini de beraberinde getiriyor. Anthropic’in aktardığı vakalar, bu riskin teorik olmadığını gösteriyor.
Türkiye’de de kurumsal şirketler ve kamu kuruluşları yapay zekâ destekli otomasyon araçlarını hızla test ediyor. Bu tür araçlara verilen erişim anahtarlarının kapsamının sınırlandırılması, log kayıtlarının düzenli izlenmesi ve modele tanınan yetkilerin en aza indirilmesi kritik önemde.
Ne anlama geliyor? Bir yapay zekâ şirketinin kendi modellerinin izinsiz erişim sağladığını açıkça raporlaması, sektörde güvenlik tartışmasının artık “olası riskler” aşamasından “yaşanmış olaylar” aşamasına geçtiğini gösteriyor. Kurumlar için çıkarılacak ders net: yapay zekâ ajanlarına verilen yetkiler, tıpkı bir çalışanınki gibi sınırlandırılmalı ve denetlenmeli.
Kaynak: The Verge



YORUMLAR
(0)