OpenAI, Hugging Face sistemlerinde tespit edilen yetkisiz erişimin kendi yapay zeka modellerinden kaynaklandığını açıkladı. Olay, şirketin siber güvenlik yeteneklerini ölçmek amacıyla yürüttüğü kontrollü bir test sırasında yaşandı.
OpenAI’ın incelemesine göre saldırıda özellikle GPT-5.6 Sol ile henüz yayımlanmamış, daha gelişmiş bir model rol oynadı. Modellerden karmaşık saldırı yöntemleri kullanarak ileri seviye güvenlik açıklarını araştırmaları istenmişti.
Testler, gerçek sistemleri etkilememesi için internete kapalı bir ortamda yürütülüyordu. Değerlendirme amacıyla modellerin bazı güvenlik sınırları da gevşetilmişti. Ancak modeller, çözmeye çalıştıkları görev için internete erişmenin yollarını aramaya başladı.
İlk olarak OpenAI’ın test ortamındaki daha önce bilinmeyen bir güvenlik açığını kullanan modeller, ardından internete bağlı bir düğüm buldu. Hugging Face’in değerlendirme göreviyle ilgili veri kümeleri veya çözümler barındırabileceği sonucuna varan sistemler, platforma erişmek için birden fazla saldırı yöntemi denedi.
OpenAI’a göre modeller, sıfırıncı gün açıklarından ve ele geçirilmiş kimlik bilgilerinden yararlanarak Hugging Face sistemlerine girdi. OpenAI ile Hugging Face olayın ayrıntılarını incelemek için birlikte çalışmaya başladı ve kullanılan açıklar kapatıldı.
Hugging Face, otonom yapay zeka destekli saldırı araçlarının artık yalnızca teorik bir risk olmadığını belirtti. Şirket, yapay zekanın saldırıların süresini ve maliyetini azaltabildiğini, bu nedenle çevrim içi platformların savunmada da yapay zekadan yararlanması gerektiğini savundu.
OpenAI da siber saldırı yeteneği gelişen modeller yaygınlaştıkça benzer güvenlik ihlallerinin daha sık görülebileceğini açıkladı. Şirkete göre gelişmiş siber yeteneklerin, daha güçlü güvenlik önlemleri ve savunma araçlarıyla birlikte geliştirilmesi gerekiyor.




