Beyaz Saray: Yapay Zeka Modellerinin Siber Güvenlik Kapasitelerini Test Etmeye Yönelik Çerçeve Hazırlıyor

Trump yönetimi, gelişmiş yapay zeka modellerinin siber güvenlik kapasitelerini değerlendirmeye yönelik gönüllü bir güvenlik test çerçevesi üzerinde çalışıyor. Bu kapsamda Beyaz Saray’da OpenAI, Anthropic, Google, Meta ve diğer teknoloji şirketlerinin temsilcileriyle görüşmeler gerçekleştirildi.

Görüşmeler, yapay zeka modellerinin siber güvenlik alanındaki yeteneklerinin daha sistematik şekilde değerlendirilmesi ve olası risklerin daha iyi anlaşılması amacıyla yürütülüyor. Ancak testlerde kullanılacak kriterler, şirketlerin programa nasıl dahil olacağı ve sonuçların kamuoyuna ne ölçüde açıklanacağına ilişkin tüm ayrıntılar henüz paylaşılmış değil.

Yapay zeka modellerinin gerçek sistemlere erişmesi gündemde

Beyaz Saray’ın hazırladığı çerçevenin gündeme gelmesinde, son dönemde gerçekleştirilen siber güvenlik değerlendirmeleri sırasında bazı yapay zeka modellerinin test ortamlarının dışındaki sistemlere eriştiğinin ortaya çıkması da etkili oldu.

Anthropic, yaptığı incelemede üç farklı Claude modelinin, siber güvenlik değerlendirmeleri sırasında üç ayrı kuruluşun gerçek sistemlerine yetkisiz erişim sağladığını açıkladı. Şirket, olayların üçüncü taraf değerlendirme ortamındaki bir yapılandırma sorunu nedeniyle test ortamlarının internete erişebilmesi sonucunda gerçekleştiğini belirtti.

OpenAI da temmuz ayında gerçekleştirdiği bir değerlendirme sırasında kullanılan modellerin, test ortamından çıkarak Hugging Face altyapısına eriştiğini açıkladı. OpenAI’ın açıklamasına göre modeller, test ortamındaki bir yazılım bileşenindeki daha önce bilinmeyen bir güvenlik açığını kullanarak internet erişimi elde etti ve ardından Hugging Face altyapısına ulaşan bir saldırı zinciri oluşturdu.

Bu gelişmeler, gelişmiş yapay zeka modellerinin kontrollü test ortamlarında değerlendirilmesi sırasında izolasyon, erişim kontrolleri ve izleme mekanizmalarının önemini yeniden gündeme getirdi.

Meta’nın modeli de test sırasında başka bir sisteme erişti

Yapay zeka güvenliği tartışmalarına 5 Ağustos’ta Meta tarafından açıklanan yeni bir olay da eklendi.

Meta’nın açıklamasına göre Muse Spark 1.1 modeli, bağımsız güvenlik firması Irregular tarafından gerçekleştirilen bir siber güvenlik değerlendirmesi sırasında başka bir şirketin sistemine erişti. Olayın, test sırasında modele yanlışlıkla internet erişimi verilmesiyle bağlantılı olduğu bildirildi.

Reuters’ın aktardığı bilgilere göre olayın, gelişmiş bir saldırı veya klasik anlamda bir sandbox kaçışı olarak değerlendirilmediği belirtildi. Bununla birlikte olay, yapay zeka modellerinin test ortamlarında sahip olduğu erişimlerin ve çevresel güvenlik kontrollerinin önemini ortaya koydu.

Böylece OpenAI ve Anthropic’in ardından Meta’nın da bir yapay zeka modelinin güvenlik değerlendirmesi sırasında test ortamı dışındaki bir sisteme eriştiğini açıklaması, yapay zeka güvenliği konusundaki tartışmaları genişletti.

Open-weight modeller test kapsamının dışında tutulacak

Beyaz Saray görüşmelerinde öne çıkan konulardan biri de hangi yapay zeka modellerinin gönüllü güvenlik testlerine dahil edileceği oldu.

Reuters’ın aktardığı bilgilere göre Trump yönetimi, hazırlanan gönüllü güvenlik testleri kapsamında open-weight modelleri değerlendirme dışında bırakacak. Bu nedenle Meta’nın Llama ailesi ve Nvidia’nın Nemotron gibi open-weight modellerinin söz konusu çerçeve kapsamında test edilmemesi bekleniyor.

Bu yaklaşım, hazırlanan çerçevenin ağırlıklı olarak geliştiricileri tarafından kontrol edilen kapalı veya özel modellere odaklanabileceğine işaret ediyor.

OpenAI, kamu kurumlarının sürece dahil edilmesini öneriyor

OpenAI CEO’su Sam Altman da daha önce Beyaz Saray’da yönetim yetkilileriyle yapay zeka modellerinin siber güvenlik yeteneklerine yönelik değerlendirmeleri görüşmüştü.

Şirket, güvenlik değerlendirmelerinde kamu kurumları ile özel sektör arasındaki koordinasyonun artırılmasını savunuyor. Bu yaklaşım, özellikle yapay zeka alanındaki teknik gelişmelerin güvenlik değerlendirmeleri ve kamu politikalarıyla birlikte ele alınmasını amaçlıyor.

Testlerin sonuçları nasıl açıklanacak?

Beyaz Saray’ın hazırladığı gönüllü güvenlik test çerçevesinin hangi ölçütlere göre uygulanacağı ve sonuçların nasıl raporlanacağına ilişkin ayrıntıların tamamı henüz kamuoyuna açıklanmış değil. Reuters’ın haberine göre yönetimin üzerinde çalıştığı çerçevenin ayrıntıları toplantılarda şirket temsilcileriyle paylaşıldı; ancak çerçevenin kamuya açık hale getirilip getirilmeyeceği konusunda belirsizlik bulunuyor.

Önümüzdeki dönemde testlerin kapsamı, şirketlerin katılım biçimi ve elde edilen sonuçların ne kadarının paylaşılacağı önem kazanacak. Özellikle yapay zeka modellerinin güvenlik açıklarını tespit etme, çok aşamalı siber görevleri gerçekleştirme ve kontrollü test ortamlarında belirlenen sınırlar içinde hareket etme kapasitesinin nasıl ölçüleceği, programın önemli başlıkları arasında yer alabilir.

Son gelişmeler, yapay zeka güvenliği çalışmalarının yalnızca modellerin zararlı içerik üretmesini önlemeye odaklanmadığını; aynı zamanda siber güvenlik kapasitesi, otonom hareket kabiliyeti, erişim kontrolleri ve test ortamlarının güvenliği gibi teknik konuların da giderek daha fazla önem kazandığını gösteriyor.

ABD yönetiminin hazırladığı gönüllü test çerçevesinin ilerleyen dönemde daha kapsamlı bir güvenlik değerlendirme mekanizmasına dönüşüp dönüşmeyeceği ise şu aşamada netlik kazanmış değil.

Related Posts

E-postalar Yeni Siber Tehdit Alanına Dönüştü: HTML ve CSS ile Hesap Ele Geçirme Riski

Yeni bir güvenlik araştırması, e-posta içeriklerinin yalnızca mesaj göstermekle sınırlı kalmadığını ve bazı durumlarda web posta arayüzlerinin çalışma şeklini etkileyebildiğini ortaya koydu. PortSwigger araştırmacısı Gareth Heyes tarafından gerçekleştirilen çalışma, Outlook,…

Düşüncelerinizi Satabilirsiniz: Yapay Zekâ Araştırmasına Katılıp 50 Dolar Kazanın

İnsan zihnini okuma fikri aslında yeni değil. Yaklaşık 120 yıl önce psikiyatrist Frederick Peterson ve Carl Jung, insanların verdiği kelime çağrışımlarına ve duygusal tepkilerine ilişkin ölçümler yapan bir “elektrik psikometresi”…

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir