OpenAI ile Hugging Face, üçüncü taraf yapay zeka modeli değerlendirmeleri sırasında yaşanan bir güvenlik olayının ilk bulgularını 4 Ağustos'ta paylaştı. Şirketler, olayın AI model test süreçlerindeki siber güvenlik zafiyetlerini gün yüzüne çıkardığını belirtti.

OpenAI ve Hugging Face'den ortak açıklama: Model değerlendirmelerinde güvenlik açığı

Yeni koruma katmanları devreye giriyor

Olayın ardından OpenAI, dışarıdan yapılan siber güvenlik değerlendirmeleri için yeni önlemler açıkladı. Bu düzenlemeler, model testlerinin güvenliğini artırmayı ve gelişmiş siber yeteneklerin kötüye kullanımını önlemeyi hedefliyor. Şirket aynı gün yayımladığı ayrı bir duyuruda, olaydan çıkarılan dersleri ve uygulanan yeni koruma katmanlarını detaylandırdı.

Bu hamle, yapay zeka geliştiricilerinin artık yalnızca kendi sistemlerini değil, dışarıdan yapılan testleri de güvenlik çerçevesine dahil etme eğilimini gösteriyor.

Değerlendirme süreçleri nasıl yeniden şekilleniyor?

OpenAI, güvenilir üçüncü taraf değerlendirmeleri için 29 Mayıs'ta "A Shared Playbook for Trustworthy Third Party Evaluations" başlıklı bir kılavuz yayımlamıştı. Belge, model yeteneklerinin, güvenlik önlemlerinin ve geçerlilik kriterlerinin nasıl değerlendirileceğini kapsıyor. Olay sonrası açıklanan yeni önlemler, bu kılavuzun pratik uygulamasına dönük adımları içeriyor.

Şirketin güncellenmiş Preparedness Framework'ünde de dikkat çekici bir değişiklik var: İkna riskleri çerçeve dışında ele alınacak. Model Spec aracılığıyla politik kampanya veya lobicilik kullanımı kısıtlanacak.

Siber savunma cephesi genişliyor

OpenAI'nin 10 Ağustos'ta duyurduğu Daybreak genişlemesi, tehdit aktörlerinin yapay zeka kullanarak benzeri görülmemiş hız ve ölçekte siber saldırılar düzenleyeceği öngörüsüyle hareket ediyor. Proje, savunmacılar için yeni araçlar sunmayı amaçlıyor.

Resmî açıklamalarda olayın teknik detayları — sızıntı kapsamı, kullanılan vektör, etkilenen veri türü — sınırlı tutuldu. "Erken bulgular" ifadesi, tam teknik incelemenin sürdüğünü gösteriyor.