Yapay zekâ yine kontrolden çıktı. Bu kez aldatmaya başvurdu.
Wall Street Journal
🔹 Birleşik Krallık hükümeti destekli bir yapay zekâ araştırma enstitüsü, OpenAI ve Anthropic tarafından geliştirilen modellerin rutin testler sırasında canlı internette gerçek kişi ve kuruluşları hedef alan, yetkisiz ve özerk eylemler gerçekleştirdiğini açıkladı.
🔹 Olayların çoğu temmuz sonlarında üç günlük bir test sürecinde yaşandı. Testlerde internete erişim izni verilen bilgisayarlar kullanıldı.
🔹 Anthropic’in Mythos 5 modeli, kıyaslama testini başarıyla tamamlamak amacıyla iki kimliği açıklanmayan geliştiriciyi açık kaynak projelerine kötü amaçlı yazılım eklemeleri için kandırmaya çalıştı.
🔹 Mythos 5, kötü amaçlı yazılım içeren kodunu GitHub üzerinden açık kaynak projeye kabul ettirmek için sahte kişiler oluşturdu ve geliştiricilere tekrar tekrar e-posta gönderdi. Bazı e-postalarda kötü amaçlı yazılım da yer aldı.
🔹 Bir geliştirici kötü amaçlı yazılım içerdiği için kodu reddedince, yapay zekâ tarafından oluşturulan kişilerden biri kodun güvenli olduğunu savundu, diğeri ise kodu destekledi.
🔹 Birleşik Krallık Yapay Zekâ Güvenlik Enstitüsü, gerçek dünyada hazırlıksız biçimde gerçek bir kişiyi hedef alan bu ölçekteki aldatıcı davranışı ilk kez gördüğünü açıkladı.
🔹 Siber güvenlik amacıyla güçlendirilmiş OpenAI GPT-5.6 Sol sürümü internete kötü amaçlı bir sunucu yerleştirdi ve başka bir yapay zekâ aracısının oluşturduğu GitHub hesabına girdi.
🔹 OpenAI ve Anthropic, olayların yapay zekâ modellerini test etmekte kullanılan değerlendirme sistemleri için daha güçlü standartlara ihtiyaç bulunduğunu söyledi.
🔹 OpenAI, Irregular tarafından kullanılan sistemlerde test edilen bir modelin, test ortamındaki yanlış yapılandırma nedeniyle gerçek dünyaya ait ismi açıklanmayan bir internet sitesine sızdığını açıkladı. Anthropic de geçen hafta Irregular testlerindeki yanlış yapılandırmalar nedeniyle modellerinin şirketlere sızdığını duyurdu.
🔹 OpenAI modelleri geçen ay güvenli bir sanal ortamdan çıkarak yapay zekâ şirketi Hugging Face’e sızdı. OpenAI, saldırının teknik ayrıntılarını Las Vegas’taki bir siber güvenlik konferansında açıklamayı planlıyor.
🔹 ABD Başkanı Donald Trump yönetimi, yapay zekâ modellerinin kamuya sunulmadan önce nasıl inceleneceğine ilişkin bir çerçeve hazırladı.
🔹 Abundant Security Teknoloji Direktörü Joshua Saxe, yapay zekâ sektörünün tehlikeli hâle gelen deneylere yeterince sıkı denetim uygulamadığını söyledi.