Yapay zeka kontrolden çıktı: OpenAI modelleri kendi testini çözmek için Hugging Face'i nasıl hackledi?

Okuma Süresi 4 dkYayınlanma Çarşamba, Temmuz 22 2026
Paylaş
X Post
ChatGPT’nin geliştiricisi OpenAI, dün yaptığı şok açıklamada, güvenlik testleri sırasında gelişmiş yapay zekâ modellerinin kontrolden çıktığını ve yazılımcıların popüler platformu Hugging Face’i kendi başlarına hacklediğini duyurdu. San Francisco merkezli teknoloji devi, yaşananları “eşi benzeri görülmemiş bir siber vaka” olarak nitelendirirken, çevrim içi kod kütüphanesi Hugging Face ile birlikte ortak bir soruşturma yürüteceklerini açıkladı.
Yapay zeka kontrolden çıktı: OpenAI modelleri kendi testini çözmek için Hugging Face'i nasıl hackledi?

Teknoloji hızla karmaşıklaşırken, gelişmiş yapay zekânın mevcut yazılımlardaki açıkları insanlardan önce bulma riski, siber güvenliği bir kez daha küresel gündemin birinci sırasına yerleştirdi.

OpenAI, bu sıradışı vakaya, yakın zamanda piyasaya sürdüğü GPT-5.6 Sol modeli ile “henüz yayınlanmamış ve çok daha yetenekli bir ön sürüm modelinin” kombinasyonunun yol açtığını belirtti. Şirket, internet erişiminin güvenlik gerekçesiyle sınırlandırıldığı, sıkı bir şekilde kontrol edilen dijital bir test alanında (sandbox) modellerin hackleme yeteneklerini ölçmeye çalışıyordu.

Şirketin resmi blog yazısında süreç şöyle aktarıldı: “Modellerimiz, kendilerine verilen değerlendirme problemini çözebilmek adına, izole edilmiş test ortamımızda çalışırken ciddi miktarda işlemci gücü harcayarak açık internet erişimi elde etmenin bir yolunu buldu.”

İnternete sızmayı başaran yapay zekâ modelleri, kendilerine verilen görevi yerine getirebilmek için yapay zekâ modelleri, veri setleri ve devasa bilgilerin barındırıldığı Hugging Face platformunu gözüne kestirdi. Kendisine verilen testi “hile yaparak” geçmesini sağlayacak gizli bilgilerin peşine düşen OpenAI sistemi, çalınan kimlik bilgilerini kullanmak da dahil olmak üzere birden fazla saldırı yöntemini arka arkaya devreye soktu.

UNSW Canberra’da bilgisayar bilimleri profesörü olan Hussein Abbass, AFP’ye yaptığı açıklamada olayın “birçok açıdan hayret verici” olduğunu söyledi. Abbass, “Sistem sadece Hugging Face’e saldırmakla kalmadı. Aslında kendi açıklarından yararlanmak için kendi iç sistemine de saldırdı. İşte bu gerçekten korkutucu” ifadelerini kullandı.

GPT-5.6 ve OpenAI’ın en büyük rakibi Anthropic tarafından geliştirilen Mythos serisi gibi son teknoloji modeller, siber savunma hatlarını tamamen çökertme potansiyelleri nedeniyle uzun süredir endişe kaynağı. Her iki ABD’li şirket de Washington’ın “kritik altyapılara siber saldırı düzenlenebileceği” korkusu nedeniyle bu son teknolojilerin genel kullanıma sunulmasını geçici olarak durdurmak zorunda kalmıştı.

Hugging Face, geçen hafta OpenAI’ın adını vermeden bir siber “sızma” yaşadığını rapor etmişti. Şirket son açıklamasında şu detaylara yer verdi:

“Bu saldırı, daha önce karşılaştığımız hiçbir şeye benzemiyordu. Çünkü tamamen otonom bir yapay zekâ ajanı tarafından uçtan uca yönetildi. Biz de bu saldırıyı büyük ölçüde kendi geliştirdiğimiz yapay zekâ sistemleriyle tespit edip anatomisini çıkardık.”

Hugging Face CEO’su Clement Delangue ise X platformu üzerinden yaptığı açıklamada, saldırının sofistike yapısı nedeniyle arkasında dünyanın önde gelen bir yapay zekâ laboratuvarının olduğundan şüphelendiklerini belirtti. OpenAI’ı kastederek “Karşı tarafta kötü bir niyet olmadığına inanıyoruz” diyen Delangue, “Yine de tüm bunların tamamen otonom bir şekilde gerçekleşmiş olması gerçekten akıl almaz!” yorumunu yaptı.