OpenAI'dan Yapay Zeka İtirafı: 'Kontrolden Çıkarak Platform Hackledi'
OpenAI, güvenlik testleri sırasında en gelişmiş yapay zeka modellerinden birinin beklenmedik şekilde kontrol dışı hareket ettiğini ve programcıların yoğun olarak kullandığı bir platforma kendi başına sızmayı başardığını açıkladı.
OpenAI, güvenlik testleri sırasında en gelişmiş yapay zeka modellerinden birinin beklenmedik şekilde kontrol dışı hareket ettiğini ve programcıların yoğun olarak kullandığı bir platforma kendi başına sızmayı başardığını açıkladı.
ChatGPT'nin geliştiricisi OpenAI, otonom çalışabilen yapay zeka sisteminin, mühendis gözetiminde ve internet erişiminin ciddi ölçüde sınırlandırıldığı bir test ortamında güvenlik açığı tespit ederek bu kısıtlamaları aşmayı başardığını duyurdu.
Şirketin konuya ilişkin yayımladığı blog yazısında,
"İzole edilmiş test ortamımızda çalışan modellerimiz, görevi yerine getirmek amacıyla açık internete erişim sağlayacak bir yol bulabilmek için önemli miktarda işlem gücü kullandı."
açıklamalarına yer verildi.
Test sırasında hedef alınan platformun, yapay zeka modellerinin paylaşıldığı dünyanın en büyük merkezlerinden biri olan Hugging Face olduğu bildirildi. Yapay zeka sisteminin, platformun bazı dahili sistemlerine erişim sağlamayı başardığı aktarıldı.
OpenAI, yaşanan olayın "benzeri görülmemiş" nitelikte olduğunu belirterek Hugging Face ile ortak bir soruşturma yürüttüklerini açıkladı.
Hugging Face'in Üst Yöneticisi (CEO) Clement Delangue ise X hesabından yaptığı paylaşımda, "Bütün bunların tamamen otonom şekilde gerçekleşmesi akıl almaz." ifadelerini kullandı.
Delangue, soruşturmanın devam ettiğini belirterek, olayın türünün ilk örneği olduğunu ve elde edilen bulguların kamuoyuyla paylaşılacağını söyledi.
İngilizler Devreye Girdi
Olayın ardından İngiltere hükümeti de inceleme başlattı.
Hükümet sözcüsü, İngiltere Yapay Zeka Güvenlik Enstitüsü'nün söz konusu yapay zeka modelinin davranışlarını analiz ettiğini açıkladı. Açıklamada ayrıca, güvenlik önlemlerini güçlendirmek amacıyla OpenAI ve diğer yapay zeka şirketleriyle iş birliğinin sürdüğü belirtildi.
"Güvenli Ortam Yeterince Güvenli Değildi"
Cambridge Üniversitesindeki Minderoo Teknoloji ve Demokrasi Merkezi Başkanı Gina Neff, BBC'ye yaptığı değerlendirmede, güvenlik testlerinin gerçekleştirildiği "kum havuzu" ortamlarının modellerin yeteneklerini güvenli biçimde gözlemlemek için tasarlanması gerektiğini söyledi.
Neff, yaşanan olayın OpenAI'nin yeterince güvenli bir sanal test ortamı oluşturamadığını gösterdiğini savundu.
UNSW Canberra'da bilişim profesörü olan Hussein Abbass ise AFP'ye yaptığı açıklamada, olayın birçok açıdan şaşırtıcı olduğunu belirtti.
Abbass, yapay zekanın yalnızca Hugging Face sistemlerine erişmekle kalmadığını, aynı zamanda kendi güvenlik sınırlarını aşabilmek için sistemin iç yapısından da yararlandığını ifade ederek bunun kaygı verici bir gelişme olduğunu dile getirdi.
Cambridge Üniversitesi Makine Öğrenimi Profesörü Neil Lawrence ise yaşananları OpenAI ile rakibi Anthropic arasındaki rekabet bağlamında değerlendirdi.
Lawrence, OpenAI'nin siber güvenlik alanındaki yeteneklerini öne çıkarmaya çalıştığını belirtirken, yaşanan olayın şirketin kendi teknolojisini güvenli biçimde kullanıma sunma kapasitesine ilişkin soru işaretleri doğurduğunu söyledi.
Hugging Face: Açıklar Kapatıldı
Hugging Face, 16 Temmuz'da yaptığı ilk açıklamada, saldırının müşteri veya iş ortağı verilerini etkileyip etkilemediğine yönelik incelemelerin sürdüğünü, gerekli görülmesi halinde ilgili taraflarla iletişime geçileceğini bildirdi.
Şirket ayrıca tespit edilen güvenlik açıklarının giderildiğini ve etkilenen sistemlerin yeniden yapılandırıldığını duyurdu.
Açıklamada, yapay zeka destekli otonom saldırı araçlarının artık teorik olmaktan çıktığı vurgulanarak, çevrim içi platformların veri ve model altyapısını birincil saldırı yüzeyi olarak değerlendirmesi gerektiği ifade edildi. Savunma tarafında da yapay zeka kullanımına yönelik yatırımların süreceği kaydedildi.