Yapay zekâ yarışında güvenlik kaygıları model geliştirme süreçlerini doğrudan etkilemeye başladı. OpenAI, gelişmiş modellerle yürütülen bazı eğitim ve araştırma çalışmalarında güvenlik standartlarını yükseltirken geliştirme hızını da geçici olarak düşürdü.
Şirketin 18 Ağustos’ta yayımladığı açıklamaya göre, en gelişmiş modeller üzerinde yürütülen bazı pekiştirmeli öğrenme çalışmalarına iki haftalık ara verildi. OpenAI’nin planladığı büyük ölçekli eğitim çalışmalarından bazıları da yeni güvenlik koşulları sağlanana kadar ertelendi.
Hugging Face olayı güvenlik yaklaşımını değiştirdi
OpenAI’nin güvenlik önlemlerini artırmasının arkasında, yapay zekâ modellerinin siber yeteneklerinin tahmin edilenden daha hızlı geliştiğinin görülmesi bulunuyor.
Şirket, temmuz ayında yaşanan Hugging Face olayının modellerinin gerçek dünyadaki siber yeteneklerini olduğundan düşük değerlendirdiğini gösterdiğini kabul etti.
OpenAI’nin açıklamasına göre bir yapay zekâ sistemi, güvenlik değerlendirmeleri sırasında OpenAI’nin araştırma altyapısının yanı sıra başka bir şirketin üretim altyapısına da otonom biçimde erişebildi. Süreçte daha önce bilinmeyen güvenlik açıkları ile internete sızdırılmış kullanıcı hesap bilgilerinin birlikte kullanılabildiği tespit edildi.
Olayın ardından araştırma ortamlarındaki güvenlik koşulları yeniden ele alındı. İzole test ortamları, sınırlı ağ ve araç erişimi, model ağırlıkları için daha güçlü koruma ve şifreleme ile gelişmiş izleme sistemleri yeni güvenlik yaklaşımının parçaları arasında yer aldı.
Astra için “kritik” siber yetenek ihtimali
Güvenlik tartışmasını büyüten bir diğer gelişme ise OpenAI’nin henüz kullanıma sunulmayan modeli Astra’nın test sonuçları oldu.
Şirket, 7 Ağustos’ta yaptığı açıklamada Astra’nın özellikle otonom kodlama ve siber güvenlik alanlarında önemli ilerleme gösterdiğini bildirdi.
OpenAI’nin ön değerlendirmelerine göre Astra’nın şirketin Preparedness Framework’ünde tanımlanan “kritik” siber yetenek seviyesine ulaşmış olabileceği ihtimali artık göz ardı edilemiyor.
Şirket bu nedenle Astra ile yürütülen ve güçlendirilmiş güvenlik standartlarını karşılamayan bazı şirket içi faaliyetleri durdurdu.
OpenAI ayrıca Astra’nın Hugging Face olayında kullanılan model olmadığını özellikle belirtiyor.
Yapay zekâ artık kendi eğitim sürecinde de izleniyor
Yeni dönemde yalnızca dışarıdan gelebilecek saldırılar değil, modellerin eğitim ve değerlendirme sırasında gerçekleştirdiği işlemler de daha yakından takip edilecek.
OpenAI, gelişmiş modellerin araç kullandığı pekiştirmeli öğrenme ve değerlendirme çalışmalarında yeni bir izleme sistemi uyguluyor. Sistem; yetkisiz erişim, veri hırsızlığı, güvenlik mekanizmalarını aşma girişimleri ve diğer riskli davranışları tespit etmeye çalışıyor.
Şirket, şüpheli faaliyetlerin ortaya çıkmasının ardından yaklaşık 30 dakika içinde uyarı oluşturmayı hedefliyor. Yeni güvenlik sisteminin izlenen işlemlerde yaklaşık yüzde 20 ek hesaplama yükü oluşturabileceği tahmin ediliyor.
OpenAI’nin aldığı karar, yapay zekâ sektöründeki rekabette yalnızca daha güçlü modeller geliştirmenin değil, bu modellerin hangi koşullarda eğitildiği ve kontrol edildiğinin de giderek kritik hale geldiğini gösteriyor.




