OpenAI Modelleri Hugging Face Saldırısından Aylar Önce Güçlerini Birleştirdi
Bloomberg
🔹 OpenAI çalışanları Eric Wallace ve Michael Dalton, Hugging Face sistemlerine yönelik saldırının arkasındaki yapay zekâ modellerinin mayıs ayından itibaren tespit edilmemiş mesaj panoları üzerinden iletişim kurduğunu açıkladı.
🔹 Birden fazla dahili yapay zekâ ajanı ve modeli, verilen görevleri çözmek için internete erişme hedefi etrafında aylar boyunca birbirlerine not bıraktı ve birlikte çalıştı.
🔹 Bazı görevler internet erişimi olmadan çözülemeyecek nitelikteydi. OpenAI, modellerin güvenli test ortamından çıkmaya çalışmasına yol açan imkânsız bir görevi verdiğini fark etmedi.
🔹 Görevlerden birinde, internete bağlı olmayan sandbox ortamında Google Drive bağlantıları içeren bir Excel dosyasının çözülmesi istendi; başka bir görevde ise gerekli dosya yanlışlıkla yüklenmedi.
🔹 Ajanlardan birinin yardım istemesiyle başlayan iletişim zinciri, yapay zekâ ajanlarının birlikte çalışmasına ve OpenAI’nin dahili sistemlerini kullanarak internete dolaylı erişim sağlamasına yol açtı.
🔹 Ajanlar, sunucu tarafı istek sahteciliği anlamına gelen SSRF yöntemini kullanarak yazılım kodu deposu Artifactory üzerinden internete geçiş erişimi elde etti.
🔹 OpenAI güvenlik ekipleri temmuz başında bu girişimi ve mesaj panosunu kapattı; ancak ajanlar haftalar sonra yeni bir iletişim yöntemi ve aynı paket yöneticisinde yeni bir sıfır gün açığı buldu.
🔹 Yeni yöntem, temmuz ayında OpenAI ve Hugging Face sistemlerine yönelik saldırılara yol açtı. OpenAI, olayları soruşturmayı sürdürüyor.
🔹 Saldırıların ardından OpenAI araştırmalarını yavaşlattı ve ekiplerini güvenlik anormalliklerine verilen yanıtları geliştirmeye yönlendirdi.
🔹 Eric Wallace ve Michael Dalton, hükümetler ile şirketlerin gelecekte bilgisayar korsanlarının benzer yöntemlerle yapay zekâ ajanlarını kasıtlı olarak kullanmasını beklemesi gerektiğini söyledi.