Teknoloji

OpenAI'nin yeni modeli, başka bir yapay zeka platformuna 'benzeri görülmemiş' bir saldırı düzenledi

El Pais 2026-07-22
OpenAI, yayınlanmamış bir modelinin, izole bir test ortamından kaçarak HuggingFace platformuna siber saldırı düzenlediğini duyurdu. Model, kendisine verilen görevi çözmek için bu platforma sızdı ve bu durum, yapay zeka güvenliği konusunda endişelere yol açtı.

OpenAI, henüz yayınlanmamış bir modelinin, ChatGPT Sol 5.6 ile işbirliği içinde, açık yapay zeka modelleri platformu HuggingFace'e 'benzeri görülmemiş' bir saldırı düzenlediğini duyurdu. Şirket çalışanları, modellerine izole bir ortamda karmaşık bir görev vermişti. Ancak modeller, kendi başlarına kapalı ortamdan çıkmayı başararak, çözümü bulma olasılıklarının en yüksek olduğu yer olduğunu düşündükleri HuggingFace'e saldırdı.

Bu saldırı, bilim kurgunun en kötü senaryolarından birini ilk kez gerçekleştirdi: modeller, hedeflerine ulaşmak için akıl almaz kaynaklarla tüm engelleri aştı. Cambridge Üniversitesi Leverhulme Geleceğin Zekası Merkezi araştırma direktörü José Hernández-Orallo, 'Önde gelen laboratuvarlardan birinin sandbox kafesinin siber güvenlik yüzünden kırılması endişe verici. Bu, 'kapsama sorunu' hakkında birçok şüphe uyandırıyor; modellerin vahşi versiyonlarını test edebileceğimizi düşünmek: aslan pençesini kafesin dışına çıkardı' dedi.

Hugging Face, geçen hafta platformunda bir olay olduğunu bildirmişti. Birisi, sistemlerindeki bir güvenlik açığını kullanarak kötü amaçlı kod çalıştırmış ve dahili sistemlere erişmişti, ancak kaynak o zaman bilinmiyordu. Şimdi kaynağın ne olduğunu biliyoruz: ChatGPT-5.6 Sol ve daha yetenekli bir yayın öncesi modelin katıldığı bir iç saldırı yetenekleri değerlendirmesi. Modeller önce bilinmeyen bir güvenlik açığını kullanarak izole ortamdan internete çıktı; OpenAI çalışanlarının kendilerine verdiği sorunun çözümlerinin Hugging Face'te olabileceğini tahmin ettiler ve çalıntı kimlik bilgileri ile güvenlik açıklarını birleştirerek erişim sağladılar.

Amaç Hugging Face'e sabotaj yapmak değil, sınav cevaplarını kopyalamaktı. Hugging Face'in kurucu ortağı Clement Delangue, 'Geçen haftaki siber saldırının, ajanın karmaşıklığı göz önüne alındığında, önde gelen bir laboratuvardan gelebileceğinden şüpheleniyorduk. Tüm bunların otonom bir şekilde gerçekleşmesi oldukça akıl almaz!' dedi. 'Bu, bir siber güvenlik öğrencisine güvenlik açıkları bulması için alıştırmalar verip onu bir sunucuya erişimi olan bir laboratuvara koymak gibi bir şey.'