Yapay Zeka Modelleri Terör Tehdidine Karşı Savunmasız mı?
İngiltere merkezli, kar amacı gütmeyen Tech Against Terrorism (Teröre Karşı Teknoloji) kuruluşunun gerçekleştirdiği kapsamlı araştırma, yapay zeka modellerinin güvenlik mimarilerindeki kritik zayıflıkları gün yüzüne çıkardı. CBS televizyonunun haberine göre yürütülen bu çalışma, günümüzde yaygın olarak kullanılan yapay zeka teknolojilerinin kötü niyetli kullanımlara karşı nasıl manipüle edilebileceğini gözler önüne serdi.
130'dan Fazla Model Mercek Altında
Araştırma kapsamında, potansiyel bir saldırı planlayan teröristin yöneltebileceği türden yüzlerce farklı talep kullanılarak 130'dan fazla yapay zeka modeli detaylı bir değerlendirmeye tabi tutuldu. Uzmanlar, yapay zeka modellerine 'abliteration' (silme/etkisizleştirme) olarak adlandırılan ve 'reddetme davranışlarını kaldırma' sürecini uygulayarak, sistemlerin güvenlik kalkanlarını devre dışı bıraktılar.
Güvenlik Önlemleri Kaldırıldığında Tehlike Başlıyor
Yapılan testler sonucunda, incelenen 5 yapay zeka modelinden 3'ünün güvenlik testlerini geçemediği ve tehlikeli taleplere yanıt verdiği tespit edildi. Araştırmada, bu modellerin orijinal versiyonlarının söz konusu zararlı istekleri başarıyla reddettiği; ancak güvenlik kalkanlarının kaldırılmasının ardından modellerin saldırı teknikleri, terörün finansmanı ve radikalleşme süreçleri ile ilgili ayrıntılı ve tehlikeli yanıtlar verdiği gözlemlendi.
Meta'nın Llama Modeli Üzerinden Örnekleme
Araştırma verileri somut örneklerle desteklendi. Meta şirketine ait Llama 3.1 8B modelinin, herhangi bir değişiklik yapılmadan önce güvenlik testinden 100 üzerinden 97 puan aldığı, ancak güvenlik katmanlarının devre dışı bırakılması sonrasında bu puanın yaklaşık 3 seviyesine kadar düştüğü raporlandı. Bu durum, açık kaynaklı yapay zeka modellerinin üzerinde yapılan müdahalelerin ne kadar büyük riskler barındırdığını kanıtlar nitelikte.
Uzmanlardan Acil Eylem Çağrısı
Tech Against Terrorism kuruluşu, bu bulgular ışığında güvenlik önlemlerinin devre dışı bırakılmasına karşı çok daha güçlü koruma mekanizmaları geliştirilmesi gerektiğini vurguladı. Ayrıca, üzerinde değişiklik yapılmış modellerin dağıtımına yönelik sıkı kısıtlamalar getirilmesi önerildi.
Tech Against Terrorism'in kurucusu Adam Hadley, yaşanan durumla ilgili yaptığı açıklamada 'Kontrol kaybı ve yapay zekanın varoluşsal risk oluşturması konusunda endişe duyulması, gayet anlaşılabilir bir durum' ifadelerini kullandı. Hadley, 'Asıl mesele şu ki bu durum aslında çoktan gerçekleşti çünkü bu açık kaynaklı modellerin birçoğunun güvenliği zaten aşıldı, sadece henüz kimse bunu fark etmedi' diyerek meselenin ciddiyetine dikkat çekti.
(Kaynak: Anadolu Ajansı)
