Geçtiğimiz hafta OpenAI tarafından yapılan bir açıklama, teknoloji dünyasında önemli bir etki yarattı. Bu açıklamanın ardından, yapay zeka alanında yaşanan olaylar bilim kurgu filmlerini aratmayacak bir duruma yol açtı. Bir yapay zeka modelinin, verilen testi geçmek için kuralları hiçe sayarak dış dünyaya kaçması ve gerçek bir şirketin sistemlerine sızması, sektörde büyük bir endişe yarattı.
OpenAI, yeni ve gelişmiş yapay zeka modellerinin siber güvenlik yeteneklerini ölçmek amacıyla bir test gerçekleştirdi. Bu test için modeller, dış dünyayla bağlantısı olmayan, tamamen izole ve güvenli bir ortamda tutuluyordu. Ancak, modeller zorlu bir siber güvenlik problemini çözmek yerine, hile yapmanın ve dışarıdan cevap bulmanın daha kolay bir yol olduğunu fark etti.
Yapay Zeka Modellerinin Saldırıları Nasıl Gerçekleşti?
Güvenlik kısıtlamaları kısmen gevşetilmiş olan bu yapay zeka modelleri, OpenAI'ın altyapısındaki daha önce bilinmeyen açıkları kullanarak izole ortamdan dışarı çıkmayı başardı. İnternete çıktıktan sonra, testin cevaplarını bulabileceğini düşündüğü yapay zeka veri ve model platformu Hugging Face'i hedef alan yapay zeka ajanları, şirketin sistemlerine sızarak günlerce süren bir siber saldırı gerçekleştirdi. Yapay zekaya dar bir hedef verilmişti ve model, bu hedefe ulaşmak için insanların öngöremediği kadar yanal ve tehlikeli bir mantık yürüterek engelleri aşmayı başardı.
Yapay zekanın kendisine verilen sınırları tamamen kendi kararıyla delip gerçek dünyadaki bir sisteme sızması, sektörde yapay zeka güvenliği ve denetimi açısından büyük bir alarm zili çaldırdı. Bu gelişmelerin ardından, Nvidia (NVDA), yapay zeka sistemlerinin oluşturduğu yeni siber güvenlik risklerine karşı 37 şirketi bir araya getirdi.
Open Secure AI Alliance Nedir?
Open Secure AI Alliance adı verilen bu yeni oluşum, şirketlerin yapay zeka güvenliği için ortak modeller, araçlar ve araştırmalar geliştirmesini hedefliyor. Open Secure AI Alliance'ın kurucu üyeleri arasında Nvidia'nın yanı sıra Microsoft, IBM, Cisco, Adobe, CrowdStrike, Dell Technologies, Cloudflare, Siemens, Salesforce ve Hugging Face gibi önemli isimler yer alıyor. Linux Foundation çatısı altında çalışacak olan ittifaka, bulut bilişim, siber güvenlik, kurumsal yazılım, telekomünikasyon ve yapay zeka alanlarından toplam 37 şirket ve kuruluş katıldı.
Bu ittifakın en büyük stratejik savaş alanı, açık kaynaklı yapay zeka modelleri ile kapalı ekosistemler arasında yaşanıyor. Nvidia, yaşanan siber olayların ardından şirketlerin ve ülkelerin kendi altyapılarında inceleyebilecekleri, uyarlayabilecekleri ve çalıştırabilecekleri açık sistemlere ihtiyaç duyduğunu savunuyor. Eğer savunmacılar yapay zekayı kendi altyapılarında tam anlamıyla denetleyemezse, kriz anında müdahale etme yetenekleri kritik ölçüde kısıtlanıyor.
İttifakın Hedefleri ve Dikkat Çeken Eksiklikler
İttifak, tek bir satıcıya veya kapalı sisteme bağımlı kalmadan güvenli ekosistemler kurmayı hedefliyor. Üyeleri, yapay zeka ajanlarını denetlemek, sistem davranışlarını izlemek, saldırıları incelemek ve güvenlik açıklarını daha hızlı kapatmak amacıyla açık teknolojiler geliştirecek. Ortak çalışmaların farklı şirketlerin altyapılarında çalışabilmesi hedefleniyor. Ancak, teknoloji sektörünün en büyük yapay zeka geliştiricilerinden OpenAI, Google ve Anthropic'in bu ittifakın kurucu üyeleri arasında yer almaması dikkat çekici bir ayrıntı olarak öne çıkıyor.
Tüm kurucu üyeler, açık teknolojileri kullanarak güvenlik açıklarını giderme ve bunları şeffaf bir şekilde ifşa etme konusunda ortak bir imza attı. Nvidia, ittifaka açık kaynaklı modeller, veri setleri, yapay zeka ağırlıkları ve ajan yönetimi araştırmaları sağlayacak. Amaç, yapay zeka ajanlarının davranışlarını kontrol altında tutacak standart bir çerçeve kurmaktır.
