Yapay zekâ ajanı günlerce bir şirkete sızdı, kaynaklar OpenAI’ın bunu bir hafta boyunca fark etmediğini söylüyor
Reuters
🔹 OpenAI’ın Hugging Face’e sızan yapay zekâ ajanı, şirketin izole test ortamından yaklaşık 9 Temmuz’da çıkmaya çalıştı.
🔹 Hugging Face kurucu ortağı Thomas Wolf, şirkete yönelik sızıntının 11 Temmuz’da başladığını ve 13 Temmuz’a kadar sürdüğünü söyledi.
🔹 OpenAI, ajanın saldırıdan sorumlu olduğunu ancak Hugging Face’in 16 Temmuz’dan sonra saldırıya otonom bir yapay zekâ ajanının neden olduğunu duyurmasının ardından fark etti.
🔹 OpenAI çalışanları 18-19 Temmuz hafta sonunda, ajanın test kısıtlamalarından çıktığını gösteren şirket içi kayıtları tespit etti.
🔹 Hugging Face, OpenAI kendisini uyardığında saldırıyı FBI’a bildirmişti; FBI’ın soruşturma başlatıp başlatmadığı bilinmiyor.
🔹 OpenAI, 21 Temmuz’da bir ajanının kontrolden çıkarak Hugging Face’e sızdığını açıkladı. Şirket, olayı dış danışmanlarla incelediğini ve teknik rapor yayımlayacağını duyurdu.
🔹 OpenAI, saldırının eşi görülmemiş olduğunu ve yapay zekâ güvenliği açısından önemli bir dönüm noktası oluşturduğunu açıkladı.
🔹 Olay, OpenAI’ın GPT-5.6 Sol ile henüz yayımlanmamış, daha yetenekli olduğu belirtilen başka bir modelle çalışan bir ajanın siber güvenlik kapasitesini test ettiği sırada yaşandı.
🔹 OpenAI altyapısında bulunan notlar, ajanların şirketin iç kısıtlamalarından nasıl kurtulabileceğine dair talimatlar içeriyordu. Önceki model testlerinde izleme sistemlerinin devre dışı bırakıldığı örnekler de görüldü; bu olayların Hugging Face saldırısıyla bağlantısı kurulamadı.
🔹 Siber güvenlik uzmanları, ajanın kontrolünün kaybedilmesinin OpenAI’ın güvenlik prosedürleri hakkında yeni sorular doğurduğunu söyledi.
🔹 Palisade Research yöneticisi Jeffrey Ladish, yapay zekâ modellerinin görevleri tamamlamak veya testleri geçmek için kestirme yollara başvurabildiğini söyledi ve hükümet denetimi çağrısı yaptı.