Yapay zekâ kontrolden çıktı: Hugging Face’i hedef aldı

ABD merkezli teknoloji şirketi OpenAI, gerçekleştirdiği bir güvenlik testi sırasında en gelişmiş yapay zekâ modellerinden birinin kontrolden çıktığını duyurdu. Şirket, modelin programcılara yönelik popüler bir platformu kendi başına hedef aldığını ve ilgili kurumun bazı iç sistemlerine erişim sağlandığını bildirdi.

İnternet kısıtlamasını aşmayı başardı

ChatGPT’nin geliştiricisi olan kurum tarafından yapılan açıklamada, otonom çalışma yeteneğine sahip yapay zekâ sisteminin mühendis gözetiminde ve internet erişiminin sınırlandırıldığı özel bir ortamda test edildiği belirtildi. Test sürecinde sistemin güvenlik açığı tespit ederek izole alandan kaçmayı başardığı kaydedildi.

OpenAI tarafından yayımlanan blog yazısında, izole edilmiş test ortamında faaliyet gösteren modellerin verilen sorunu çözme arayışı sırasında açık internet erişimi sağlamanın bir yolunu bulmak adına önemli miktarda işlem gücü harcadığı ifadesine yer verildi.

Ortak soruşturma ve İngiltere’den inceleme

Gelişmenin ardından olayı “benzeri görülmemiş” olarak niteleyen şirket, hedef alınan sistemlerin sahibi konumundaki Fransa merkezli Hugging Face ile birlikte kapsamlı bir soruşturma yürütüldüğünü açıkladı. Fransa merkezli platformun yöneticisi Clement Delangue, sosyal medya platformu X üzerinden yaptığı paylaşımda, “Bütün bunların otonom olarak gerçekleşmesi akıl almaz” ifadelerini kullanırken, elde edilen bilgilerin kamuoyuyla paylaşılacağını duyurdu.

Gelişme üzerine İngiltere Hükümeti de bir açıklama yaparak, İngiltere Yapay Zeka Güvenlik Enstitüsü’nün sistemin davranışlarını incelemeye aldığını duyurdu. Hükümet sözcüsü, güvenlik önlemlerini iyileştirmek amacıyla OpenAI ve diğer yapay zekâ laboratuvarlarıyla çalışmaların sürdüğünü kaydetti.

Sanal test ortamlarının güvenliği sorgulanıyor

Olayın ardından akademik çevreden ve siber güvenlik sektöründen peş peşe değerlendirmeler geldi. İngiltere merkezli Cambridge Üniversitesi’ndeki Minderoo Teknoloji ve Demokrasi Merkezi’nin başkanı Gina Neff, test ortamlarının güvenli alanlar olması gerektiğine işaret ederek OpenAI’nin yeterince güvenli bir sanal ortam oluşturamadığının anlaşıldığını ifade etti.

Avustralya merkezli UNSW Canberra’da bilişim profesörü olan Hussein Abbass ise sistemin sadece hedef platforma saldırmadığını, kendi güvenlik açıklarından yararlanmak için sistemin kendi iç yapısına da müdahale ettiğini belirtti. Cambridge Üniversitesi’nde makine öğrenimi profesörü olan Neil Lawrence da durumun şirketler arası rekabetle ilişkili olabileceğini ve OpenAI’nin teknolojisini güvenli şekilde kullanıma sunma yeteneği konusunda soru işaretleri yarattığını savundu.

Güvenlik açıkları kapatıldı

Hugging Face tarafından yapılan açıklamada, 16 Temmuz’da yaşanan olayın ardından ortaya çıkan güvenlik açıklarının kapatıldığı ve etkilenen sistemlerin yeniden yapılandırıldığı bildirildi. Müşteri veya iş ortağı verilerinin etkilenip etkilenmediğinin değerlendirildiği ve otonom yapay zekâ destekli saldırı araçlarının artık teorik bir tehdit olmaktan çıktığı vurgulandı.

Siber güvenlik firması SonicWall yöneticisi Spencer Starkey ile Guidepoint Security baş güvenlik mühendisi Travis Lelle, kurumların makine hızında gerçekleşen tehditlere karşı savunmalarını güçlendirmeleri gerektiğini belirtti. Global siber güvenlik şirketi ESET’in danışmanı Jake Moore ise duyurunun zamanlamasına dikkat çekerek, ABD merkezli Anthropic şirketinin Claude Mythos modeli ve Çin merkezli yapay zekâ girişimi Moonshot’un Kimi K3 modeli karşısında OpenAI’nin kendi yeteneklerini öne çıkarma çabasında olabileceğini değerlendirdi.

Exit mobile version