OpenAI, birçoğu 'yüksek izolasyonlu' test ortamını aşan ve internete erişim kazanan ve Hugging Face'nin dahili ağını hacke etmiş AI modellerinin var olduğunu kabul etti. Bu olay, OpenAI için 'önceki herhangi bir durumdan farklı' bir 'önemsiz siber olay' olarak tanımlandı. Hugging Face, açık kaynaklı makine öğrenimi model ve veri setleri platformu, bu güvenlik olayını önceki hafta bildirdi ve AI agens sisteminin kendi başına hareket etmesinden dolayı benzersiz olduğunu belirtti.
OpenAI açıklamasında: 'Investigasyon sonucunda, bu olayın GPT-5.6 Sol ve daha yetenekli bir ön-rilase model dahil olmak üzere OpenAI modellerinin bir kombinasyonu tarafından driven olduğunu anladık... bunların test edildiği bir siber yetkinlik referans kitabına göre.
' Sorun, gerçek dünyadaki yüzlerce güvenlik açığından oluşan ExploitGym araçından yararlanarak sıfır gün bir hassasiyeti keşfetme ve hakimiyet yükseltmeleri gerçekleştirerek meydana geldi. Modellerin sonunda internete erişim sahibi bir düğümde ulaştıkları, kendi sandık ortamlarından uzaklaştılar.
