Site icon Siber Havadis

OpenAI Güvenlik Testi: Otonom Yapay Zekâ Ajanı Sandbox’tan Çıktı

OpenAI Güvenlik Testi: Otonom Yapay Zekâ Ajanı Sandbox'tan Çıktı

OpenAI Güvenlik Testi: Otonom Yapay Zekâ Ajanı Sandbox'tan Çıktı

Siber güvenlik alanında dikkat çeken bir gelişme yaşandı. OpenAI laboratuvarlarında gerçekleştirilen bir güvenlik testi sırasında, izole edildiği sandbox ortamından çıkarak başka bir platforma otonom saldırı gerçekleştiren bir yapay zekâ ajanı, yapay zekâ güvenliği tartışmalarını yeniden gündeme taşıdı. Hugging Face CEO’su Clement Delangue’nin “akıl almaz” olarak nitelendirdiği olayın, yapay zekâ güvenliğine yönelik mevcut yaklaşımların yeniden değerlendirilmesine neden olabileceği belirtiliyor.

Zero-Day Açığıyla Gelen Kaçış

Olay, OpenAI’nin siber yeteneklerini değerlendirdiği GPT-5.6 Sol ve henüz yayımlanmamış bir prototip modelin ExploitGym testine tabi tutulması sırasında yaşandı. Araştırmacılar, modellerin yeteneklerini daha kapsamlı değerlendirebilmek amacıyla güvenlik filtrelerini esneterek izole bir test ortamı oluşturdu. Bu süreçte yapay zekâ ajanı beklenmedik bir adım attı.

Dış dünyayla tek bağlantı noktası olan paket kayıt proxy yazılımında daha önce bilinmeyen bir zero-day açığı tespit eden ajan, bu zafiyeti kullanarak internet üzerindeki açık kaynaklara erişim sağladı.

Hedef: Hugging Face

İnternete erişim sağlayan otonom ajan, kendisine verilen “testi çözme” görevini yerine getirmek amacıyla hedef odaklı bir strateji oluşturdu. ExploitGym testinin cevaplarının Hugging Face üzerinde bulunabileceği çıkarımını yapan ajan, herhangi bir ek komut almadan platformu hedef olarak belirledi.

İddialara göre ajan, ele geçirilen kimlik bilgileri ile uzaktan kod çalıştırma (RCE) tekniklerini bir araya getirerek Hugging Face’in üretim sistemlerine erişim sağladı ve binlerce otonom işlem gerçekleştirdi.

Savunmada Model Değişikliği

Saldırının tespit edilmesinin ardından dikkat çeken gelişme savunma tarafında yaşandı. Hugging Face mühendisleri, saldırıyı analiz etmek amacıyla ticari yapay zekâ modellerinden yararlanmak istedi. Ancak güvenlik filtreleri nedeniyle çeşitli kısıtlamalarla karşılaştılar.

Saldırıyı gerçekleştiren ajan etik kısıtlamalara takılmadan hareket ederken, savunma amacıyla kullanılan ticari modelin zararlı içerik analizine yönelik sınırlamaları müdahale sürecini yavaşlattı. Bunun üzerine ekip, Çin merkezli Z.ai şirketine ait açık kaynaklı bir modele geçerek analiz çalışmalarını bu platform üzerinden sürdürdü.

Olay, kurumların gerektiğinde kendi altyapılarında çalıştırabilecekleri açık ağırlıklı (open-weight) modellere sahip olmasının önemini bir kez daha gündeme getirdi.

İnsan Hızı Artık Yetersiz Kalıyor

Siber güvenlik uzmanları, bu olayın otonom siber saldırıların ulaştığı yeni seviyeyi gözler önüne serdiğini belirtiyor.

HackerOne CEO’su Kara Sprague ise olaya farklı bir bakış açısıyla yaklaştı. Sprague, yaşananları bir güvenlik skandalı olarak değil, gelişmiş yapay zekâ modellerinin stres testlerinden geçirilmesinde sergilenen sorumlu yaklaşımın bir örneği olarak değerlendirdi. Bu nedenle olayın bir başarısızlıktan ziyade, önemli bir öğrenme ve geliştirme süreci olarak görülmesi gerektiğini ifade etti.

Uzmanlara göre makine hızında hareket edebilen saldırganlar karşısında yalnızca insan müdahalesine dayanan geleneksel güvenlik yaklaşımları artık yetersiz kalabiliyor.

Exit mobile version