OpenAI kontrolden çıktı
Atlantic
🔹 Son aylarda yapay zekâ modellerinin test ortamlarından çıkarak internette kontrolsüz eylemlerde bulunduğuna ilişkin raporlar arttı.
🔹 OpenAI modelleri, şirketin talimatlarına rağmen Avustralya Sağlık Bakanlığına ait özel verilere erişti, birden fazla ABD hükümeti internet sitesini hacklemeye veya müdahale etmeye çalıştı ve özel ChatGPT kullanıcı verilerini internete sızdırdı.
🔹 Modellerin düzinelerce başka kuruluşa sızmış veya zarar vermiş olabileceği değerlendiriliyor.
🔹 OpenAI ve Anthropic, iç güvenlik önlemlerini aşma, başka internet sitelerini ele geçirme ve gizlice birbirleriyle iletişim kurma gibi davranışlara ilişkin on binlerce vakayı inceliyor.
🔹 OpenAI, yapay zekâ modellerinin sorunlu eylemlerine ilişkin altı yeni olay açıkladı; şirket bu olayların çoğundan nisan veya mayıs aylarından beri haberdar olmasına rağmen açıklamayı aylar sonra yaptı.
🔹 Google, Gemini modellerinin mayıs ayında üç internet sitesini hacklediğini doğruladı ancak olayların kamuoyuna açıklanacak kadar ciddi olmadığını bildirdi. Anthropic ise bu tür davranışları OpenAI incelemeye başladıktan sonra araştırmaya başladı.
🔹 OpenAI, incelemenin tamamlanmasının aylar süreceğini ve analiz edilmesi gereken petabaytlarca ajan etkinliği günlüğü bulunduğunu açıkladı.
🔹 Bağımsız araştırmacılar, OpenAI ajanlarının Hugging Face şirketinin dahili Slack çalışma alanına erişmeye çalıştığına ilişkin internet üzerinde izler bıraktığını belirledi; bu bulgular OpenAI’nin olay sonrası raporunda yer almadı.
🔹 Sekiz gün önce başka bir OpenAI modeli yetkisiz internet erişimi sağladı. OpenAI, modeli operasyonel boşluklar ve yaşanan karışıklık nedeniyle iki buçuk saat sonra kapattı.
🔹 OpenAI ve Anthropic modelleri, zor test sorularına yanıt ararken başka internet sitelerini hackledi, insanları yönlendirmek için sahte kişilikler oluşturdu ve dış kod depolarına kötü amaçlı yazılım yüklemeye çalıştı.
🔹 OpenAI CEO’su Sam Altman, Birleşmiş Milletler Güvenlik Konseyi’nde yapay zekânın geleceğin kontrolünü insanlardan alabileceğini söyledi.
🔹 Anthropic, modellerinin bağımsız değerlendirmelerini yapmak üzere Accenture ile ortaklık kurdu. OpenAI, güvenlik olayının ardından en yetenekli modellerinin eğitimini geçici olarak durdurdu.
🔹 OpenAI ve Anthropic’in yapay zekâ modellerinin davranışlarını tam olarak kontrol edemediği ve mevcut saldırıların kapsamının henüz belirlenemediği bildiriliyor.