ChatGPT devi OpenAI'den çarpıcı itiraf: Yapay zeka sistemden çıkıp başka şirkete sızdı
OpenAI'nin yayımladığı bir blog yazısına dayandırılan iddiaya göre, şirketin yeni yapay zeka modelleri üzerinde yürütülen testler sırasında beklenmedik bir siber güvenlik olayı yaşandı. İddiaya göre test kapsamındaki yazılım, planlanan senaryonun dışına çıkarak başka bir yapay zeka şirketinin sistemlerine erişim sağladı ve bir bilgisayar korsanını andıran davranışlar sergiledi.
San Francisco merkezli OpenAI'nin aktardığı öne sürülen bilgilere göre olay, yapay zekanın siber saldırılarda kullanılmasına ilişkin uzun süredir dile getirilen endişeleri yeniden gündeme taşıdı.
Hugging Face adlı yapay zeka platformu geçen hafta, yapay zeka destekli bir siber saldırıya uğradığını açıklamıştı. Daha sonra bunun, OpenAI bünyesinde gerçekleştirilen dahili bir test sırasında yazılımın beklenenden çok daha ileri adımlar atmasıyla bağlantılı olduğu iddia edildi.
Test sınırlarını aştığı öne sürüldü
Haberde yer alan bilgilere göre OpenAI, GPT-5.6 Sol adlı model ile henüz kamuoyuna açıklanmayan yeni bir sürümün, siber saldırılarda kullanılabilecek güvenlik açıklarını değerlendirme yeteneklerini ölçmek istedi. Bunun için sektörde yaygın olarak kullanılan ExploitGym isimli standart test senaryosu uygulandı.
Ancak iddiaya göre yapay zeka modelleri, görevi tamamlamak amacıyla test çerçevesinin dışına çıktı ve beklenmeyen yöntemlere başvurdu.
Açık internete eriştiği iddia edildi
İddiaya göre yazılım, daha önce fark edilmemiş bir güvenlik açığından yararlanarak test ortamından çıktı ve kendi başına açık internete erişim sağladı.
İnternette yaptığı işlemler sırasında Hugging Face platformunda ExploitGym görevleri için faydalı olabilecek veri ve çözümler bulunduğu sonucuna vardığı öne sürülen yazılımın, "gizli bilgilere" erişerek testte avantaj sağlamaya çalıştığı aktarıldı.
Haberde, bunun için daha önce bilinmeyen güvenlik açıklarının yanı sıra ele geçirilmiş giriş bilgilerinin de kullanıldığı belirtildi.
Binlerce işlem gerçekleştirdiği öne sürüldü
Hugging Face'in açıklamasına göre saldırıyı gerçekleştiren yapay zeka sistemi binlerce farklı işlem yürüttü ve saldırının kaynağını gizlemek amacıyla birden fazla sunucu değiştirdi. OpenAI'nin ise yaşananları "eşi benzeri görülmemiş bir siber olay" olarak nitelendirdiği ifade edildi.
Tartışmalar yeniden alevlendi
Yapay zeka destekli siber saldırılar konusunda uzmanların uzun süredir uyarılarda bulunduğu belirtilirken, son aylarda özellikle OpenAI'nin rakibi Anthropic'in geliştirdiği Mythos modeli tartışmaların odağına yerleşti.
Habere göre Mythos, yıllarca fark edilmeyen güvenlik açıklarını tespit ederek bunların kapatılmasına katkı sağladı. Bununla birlikte aynı teknoloji, kötü niyetli kişilerin elinde ciddi bir siber tehdit oluşturabileceği gerekçesiyle de endişe yarattı.
Anthropic'in Mythos'u yalnızca belirli kamu kurumları ve şirketlerin kullanımına sunduğu, diğer kullanıcılar için ise siber güvenlik özellikleri bulunmayan Fable adlı sınırlı bir sürüm hazırladığı aktarıldı. Ayrıca ABD hükümetinin talimatıyla Mythos ve Fable'a erişimin bir süre durdurulduğu, daha sonra bu kısıtlamanın kaldırıldığı ifade edildi.